Midjourney跨界进军医疗影像,提出创新身体扫描方案:在环形舱内配置50万枚沙粒大小超声传感器,多角度采集数据,一分钟内生成高精度三维人体影像。此举将数字生成技术延伸至医学领域,有望革新快速检测体验。
蚂蚁集团旗下灵波科技宣布全面开源具身基座模型LingBot-VLA的真机后训练工具链,开发者可利用自有数据快速将模型迁移至自有机器人和具体任务中。此举旨在解决具身智能领域开源模型增多但部署适配困难的问题,因不同机器人在机械臂构型、末端执行器、传感器配置和控制接口等方面存在差异,该工具链可简化适配流程。
Linux内核近日接收了首个明确标注为AI生成的驱动程序补丁prom21-xhci,用于为AMD Promontory 21芯片组的xHCI控制器提供温度传感器数据。这标志着AI生成代码从实验阶段进入系统底层核心组件实用化,填补了相关领域空白,引发广泛关注。
国地中心与纬钛机器人联合发布全球首个跨本体视触觉多模态机器人操作数据集“白虎-VTouch”,规模最大、模态最完整。该数据集首创跨本体视触觉多模态真实交互数据采集范式,包含高精度视触觉传感器数据、RGB-D深度视觉及关节位姿等关键信息,推动机器人视触觉感知从单一形态向跨本体真实交互跨越。
连接实时物理数据,推动物理AI时代
Openai
-
Input tokens/M
Output tokens/M
Context Length
Anthropic
$105
$525
200
$21
Google
$0.7
$2.8
1k
Alibaba
$6
$24
256
$8
$240
52
Moonshot
$4
$16
Baidu
32
$8.75
$70
400
$1.75
$14
$0.35
Tencent
24
Xai
Huawei
128
UsefulSensors
Moonshine Tiny是由Moonshine AI(原有用传感器公司)开发的轻量级越南语自动语音识别模型,仅有27M参数,专为资源受限平台设计,在Fleurs和Common Voice 17数据集上表现出色。
Cnam-LMSSC
EBEN 是一款针对法语语音的带宽扩展模型,专门用于处理体传导语音传感器(如喉部麦克风)采集的音频。它能够对低频、含噪的体传导语音进行降噪,并从低频内容中再生中高频成分,从而显著提升音频的清晰度和质量。该模型基于特定的非传统传感器数据训练,适用于特定领域内的语音增强任务。
nvidia
这是一个用于西班牙语自动语音识别的大型康福默-传感器模型,约1.2亿参数,在1340小时西班牙语语音数据上训练。
Aranet4二氧化碳传感器的MCP服务器,支持设备扫描、数据采集存储、历史查询及可视化功能,提供AI辅助配置。
Createve.AI Nexus是一个开源项目,通过实现模型上下文协议(MCP)标准,为AI代理与企业系统之间搭建桥梁,提供安全、实时的数据访问和系统集成能力。它支持多种AI平台,具备企业级安全架构,并能连接各类业务应用、传感器数据和文档管理系统。
Observium MCP服务器是一个将Observium网络监控数据通过模型上下文协议暴露给LLM的工具,支持自然语言查询设备状态、网络流量、传感器数据和历史趋势。