医疗人工智能加速迈向专科化与安全化。中文医疗大模型评测基准MedBench近日升级至5.0版本,由上海人工智能实验室联合广州实验室钟南山院士团队、复旦大学附属中山医院葛均波院士团队等顶尖力量共同构建,致力打造更专业可靠的中文医疗AI评测体系。
7月17日,重庆市卫生健康委员会上线便捷就医智能体“渝小健”,面向全市居民提供AI辅助就医服务。市民可通过支付宝或阿福App搜索使用,功能包括智能导诊、云陪诊、检查报告查询与AI解读。由市卫健委联合市大数据局、蚂蚁集团打造,依托数字重庆基础设施、医疗机构数据与蚂蚁AI大模型技术。
AI医疗行业迎来关键转折,讯飞医疗于6月9日发布基于全国产算力训练的星火医疗大模型V3.5。该模型不再单纯追求参数规模,而是聚焦临床诊疗与居民健康管理两大核心场景,凭借在头部三甲医院的实际应用数据,证明其已从实验室成功走向临床实用阶段。
大模型“幻觉”问题(输出事实性错误)在医疗、法律等高危领域尤为严重。业界对抗幻觉的两大主流方法——扩大训练数据与设置防御机制——均有局限:数据无法覆盖所有事实,防御机制则常导致AI过度谨慎。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
Intelligent-Internet
II-Medical-8B是智能互联网研发的新一代医疗大语言模型,专为增强AI医疗推理能力而设计,在医疗问答能力上实现重大突破。
scutcyr
扁鹊-1.0是一个经过指令与多轮问询对话联合微调的医疗对话大模型,旨在强化AI系统的问询能力,模拟医生问诊过程。