WAIC2026上,大模型与生成式AI参展主体共130家,其中83家主打AI Agent或智能应用,基础大模型企业仅18家。行业模型发布减少、Agent演示增多,焦点从“模型多聪明”转向“创造多少真实价值”。AI竞争基本单位正从单一模型转向整套体系,进入系统与组织能力比拼阶段。
达摩院联合盛京医院等发布肝癌AI模型DAMO LiON,可借增强CT精准识别微小病灶。两个月前瞻试验中,其发现15例原被漏诊的恶性肿瘤,多为1厘米左右,论文刊于《自然·医学》,展现AI从“看漏”到“补漏”的价值。
美团披露搜索3.0技术迭代:大模型推动搜索引擎迈向认知决策时代,在服务零售排序场景完成三次演进,验证语义表征在本地生活复杂场景的落地价值,实现从关键词匹配到意图理解的升级。
OpenAI提出,衡量AI投资回报,不能再沿用软件行业旧尺子——采用率。真正的刻度是模型实际完成的工作量。其7月17日长文直指企业核心经济问题:从AI投入中究竟换回多少价值,强调以产出效能而非用户数来评估。
探索大型语言模型的偏好和价值观对齐。
提供全面的人工智能大模型产业信息和创新价值研究。
借助 AutoML Vision 从图像中发掘有价值的信息、利用预训练的 Vision API 模型,或使用 Vertex AI Vision 创建计算机视觉应用
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$2
$20
$6
$24
noctrex
这是 aquif-3.5-Plus-30B-A3B 模型的 MXFP4_MOE 量化版本,通过量化技术显著降低了模型资源占用,同时保持了相近的性能表现,具有较高的工程实践价值。
DevQuasar
这是NVIDIA基于Qwen3架构开发的32B参数奖励模型,专门用于强化学习中的奖励评分和原则对齐,帮助训练更安全、更符合人类价值观的AI系统。
本项目是对Qwen3-Coder-30B-A3B-Instruct模型进行MXFP4_MOE量化的成果,将上下文大小从256k扩展到1M,为代码生成和编程任务提供了更优化的模型版本,具有提升性能和节省资源的价值。
redis
这是一个基于预训练模型的句子相似度计算模型,专门用于衡量句子间的语义相似度。模型在redis/sentencepairs-v3-triplets数据集上训练,采用sentence-transformers库构建,在自然语言处理领域具有广泛应用价值。
bigdoinks420518
这是一个使用AI Toolkit by Ostris训练的LoRA模型,基于Wan-AI/Wan2.1-T2V-14B-Diffusers基础模型,主要用于文本到视频生成,在图像生成领域有独特应用价值。
chaoyinshe
EchoVLM是一个专为医学超声领域设计的动态专家混合视觉语言模型,能够处理图像和文本输入并生成文本输出,在超声智能诊断中具有重要应用价值。
tiantiaf
基于Whisper-small架构的语音方言分类模型,专门用于识别8种中国方言变体,包括江淮方言、胶辽官话、冀鲁官话、兰银官话、普通话、西南官话、中原官话和粤语。该模型在Common Voice 11.0数据集上训练,具有重要的语音识别价值。
John6666
Illustrious XL v1.0是基于OnomaAIResearch/Illustrious-xl-early-release-v0训练的文生图模型,专门用于生成多种艺术风格的动漫女性图像,在图像生成领域具有应用价值
OpenMed
专门用于物种实体识别的模型,能够精准识别物种和生物体名称,在生物医学领域有着重要的应用价值。
这是一款专门用于解剖实体识别的生物医学命名实体识别模型,基于ElectraMed架构,拥有1.09亿参数。该模型能够精准识别临床文本中的解剖结构和身体部位,在生物医学领域具有重要应用价值。
Mungert
Mi:dm 2.0是KT开发的韩国中心AI模型,深入内化了韩国社会独特的价值观和认知框架,提供高效的文本生成服务。
一款专门用于化学实体识别的模型,能从生物医学文本中精准识别和提取相关实体,在药物发现、医疗数据分析等领域具有重要价值。
mykor
Mi:dm 2.0 是采用 KT 专有技术开发的'以韩国为中心的 AI'模型,深度内化了韩国社会独特的价值观、认知框架和常识推理。
Mi:dm 2.0 是一款以韩国为中心的 AI 模型,由 KT 运用其专有技术开发。该模型深入内化了韩国社会独特的价值观、认知框架和常识推理,不仅能处理和生成韩语内容,还能体现对韩国社会文化规范和价值观的深刻理解。
HaochenWang
本项目聚焦于可追溯证据增强的视觉定位推理,利用特定的基础模型和数据集开展研究,具有重要的学术和应用价值。
Motif-Technologies
Motif 2.6B是一个拥有26亿参数的语言模型,在AMD Instinct™ MI250 GPU上从头开始训练,旨在构建符合人类价值观、有用且可靠的AI。
QCRI
Fanar-1-9B-Instruct 是一款强大的阿拉伯语 - 英语大语言模型,由卡塔尔计算研究机构(QCRI)开发,支持现代标准阿拉伯语及多种阿拉伯方言,并与伊斯兰价值观和阿拉伯文化保持一致。
lmstudio-community
MedGemma-4B-IT是由Google开发的医疗领域专用多模态模型,支持图像文本到文本的转换任务。该模型针对医疗影像和文本分析进行了优化,在放射学、临床推理、皮肤病学等多个医疗子领域具有重要应用价值。
TutlaytAI
专注于将图像内容转化为文本信息的模型,具有广泛的应用价值。
Multiverse4FM
Multiverse-32B是基于Multiverse构建的首个开源、非自回归模型,在AIME测试中表现优异,具有重要的学术和应用价值。
Copus MCP服务器是一个基于模型上下文协议的服务器,允许AI助手搜索和检索来自Copus平台的人工精选内容推荐。Copus是一个由真人推荐和解释内容价值的发现平台,不同于算法驱动的搜索结果。该服务器提供搜索精选内容和获取详细信息的工具,兼容多种支持MCP的AI平台。