在3月19日举行的**
此次升级的核心在于深度集成的
商场地库车位级领航: 针对停车难痛点,实现从入口到具体车位的精准导航与自动停泊。
复杂场景理解推理: 凭借大模型的认知能力,车辆能够像人类司机一样理解复杂的交通环境并作出逻辑预判。
语音控车辅助: 进一步强化人车交互,通过语音指令即可实现更细腻、更智能的驾驶辅助功能调节。
从此次发布会释放的信号来看,
在3月19日举行的**
此次升级的核心在于深度集成的
商场地库车位级领航: 针对停车难痛点,实现从入口到具体车位的精准导航与自动停泊。
复杂场景理解推理: 凭借大模型的认知能力,车辆能够像人类司机一样理解复杂的交通环境并作出逻辑预判。
语音控车辅助: 进一步强化人车交互,通过语音指令即可实现更细腻、更智能的驾驶辅助功能调节。
从此次发布会释放的信号来看,
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
DeepSeek工具链升级至0.1.1-rc.1版,在V4Flash与V4Pro基础上新增视觉模型体验版V4Flash Vision-Exp。此前v0.1.0-rc.8已打通多模态能力,支持原生图片请求,/goal、/plan等指令实现图文混合输入。

OpenAI向开发者开放Codex Harness核心能力,该框架是Codex智能体的运行环境,负责连接模型、用户与工具,管理任务、上下文、会话及代码操作。此前已开源Codex CLI及核心代码,并持续完善Harness与App Server。其架构不仅是代码生成工具,更是完整的Agent执行框架。

阿里巴巴推出 GUI 智能体基座模型 Qwen-UI-Agent,以真实世界为中心,覆盖移动端、电脑端、网页端及深度搜索,旨在突破模拟测试限制,实现复杂真实设备无缝操作。其在 MobileWorld 移动端测试中获 82.1% 高分,领先多个主流模型,综合性能全面超越行业旗舰。
SAP与Team Liquid联合开发AI语音应用,可自动处理比赛和训练中的多声道队内语音,精准分离选手语音流,并完成转写、发言人识别和情绪分析,将零散通话转为结构化赛事数据,助力战队分析比赛、优化战术和提升选手表现。

豆包工作任务模式升级,新增技能、连接器、工作伙伴三大功能,协同办公能力增强。平台已上架超200个技能与连接器,支持用户自建专属技能和标准化工作流。“技能”可沉淀个性化工作方法,如周报格式一键保存、每周复用;“连接器”打通豆包与各类办公系统,提升工作流标准化与效率。
Waymo将谷歌Gemini人工智能助手深度整合进定制自动驾驶出租车Ojai,推动无人出行智能化升级。目前该车型已在洛杉矶、菲尼克斯和旧金山向所有普通用户全面开放,官方今年还计划进一步拓展布局。

阿里巴巴8月20日发布GUI智能体基座模型Qwen-UI-Agent,覆盖移动端、电脑端、网页端及深度搜索,多项核心基准超越业界旗舰。移动端MobileWorld得82.1%,分别领先GPT-5.6Sol和Claude Opus4.8达12.0和14.6个百分点,展现强劲实力。
开源智能体工具DeepSeek Harness发布仅一周即升级,新增多模态支持,模型适配器可启用原生图片请求,引发其视觉模型将发布猜想。交互体验改进:/goal、/plan等命令支持带图发送,@引用功能优化。
小米人形机器人“铁大”亮相2026世界机器人大会,身高1.70米、重66公斤,全身66个自由度且半数集中于手部。小米已申请注册多枚“小米铁大”商标,覆盖医疗园艺、健身器材、设计研究、通讯服务等类别,目前已注册成功。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、Google重磅升级搜索与Gemini应用,推出全套AI学习与3D模拟工具Google推出了全新的AI学习工具,包括交互式视觉内容、3D模拟、专属学生中心和定制化练习测验,旨在将Gemini打造成学生首选的学习助手。仿生7轴灵巧机械臂R1发布,9900元起售宇树科技推出的仿生7轴灵巧机械臂R1,以9900元的起售价降低了高性能多轴机器人的门槛,具备高精度和灵活性,适用于多种场景,并且具有良好的扩展性和智能化协作能力。