英伟达发布全球首款开放式人形机器人参考设计NVIDIA Isaac GR00T,基于Jetson Thor平台与Isaac GR00T开发系统,旨在统一开发流程、缩短从硬件启动到技能验证的周期。该设计整合宇树H2Plus机器人本体、Sharpa Wave触觉灵巧手及Jetson Thor板载计算系统。
Windsurf发布Wave13版本,聚焦模型能力、多智能体协同和终端体验升级。新版默认搭载SWE-1.5模型,具备SWE-Bench-Pro级别性能,可处理复杂代码任务。
百度在WAVE SUMMIT大会上发布文心大模型X1.1,该模型在事实性、指令遵循和智能体表现方面显著提升。个人用户可通过文心一言官网和文小言APP体验,企业客户可通过百度智能云千帆平台使用。
【AI日报】栏目每日提供AI领域热点内容,聚焦技术趋势与创新应用。谷歌DeepMind推出Gemini 2.5 Flash图像编辑模型,具备精准编辑和创意实现能力,支持角色一致性、局部文字编辑、风格迁移和现实推等功能。
WavePix AI平台的나노바나나,可免费生成、编辑AI图像和视频。
加速 AI 图像和视频生成,提升创作效率。
使用 WaveSpeed 去除视频中的水印,保持画面质量。
windsurf_ai推出首个针对软件工程流程优化的模型家族 SWE-1。
waveletdeboshir
俄语自动语音识别模型,支持外部ngram语言模型和束搜索解码,可提取词级时间戳
GigaAM-v2-RNNT 是一个俄语自动语音识别(ASR)模型,基于RNNT架构,适用于语音转文本任务。
GigaAM-v2-CTC 是一个俄语自动语音识别(ASR)模型,基于CTC损失函数训练,可通过Hugging Face transformers库使用。
agentsea
基于PaliGemma 3B 448分辨率权重,在WaveUI数据集上针对目标检测任务微调的视觉语言模型
microsoft
WaveCoder是面向代码领域的大语言模型系列,通过指令跟随学习解决代码相关领域问题。WaveCoder-Ultra-6.7B是该系列中的高性能模型。
shiwangi27
基于facebook/wav2vec2-large-xlsr-53模型微调的印地语语音识别模型,使用OpenSLR和Common Voice印地语数据集训练,支持16kHz采样率语音输入。
基于WAL语言的RTL波形分析MCP服务器,提供波形文件信号提取、时序分析和高级表达式查询功能
一个基于wellen库的MCP服务器,用于读取和分析VCD/FST格式的波形文件,提供信号查看、值读取、事件查找等功能。
一个用于处理VCD波形文件的模型上下文协议(MCP)服务器,提供信号提取工具帮助分析大型波形文件
一个集成Claude与Wave会计软件的MCP服务器,用于自动化费用跟踪和收入交易创建,支持多企业管理、供应商/客户搜索和实时API连接。
基于MCP协议的波形数据服务端项目
Smallest AI MCP Server是一个生产级的ModelContextProtocol服务器,专为Waves文本转语音和语音克隆平台设计,提供快速、安全的AI语音工作流解决方案。