通义千问发布Qwen-Image-3.0 Pro与Standard模型,在Arena文生图榜单位居中国模型第一、主流第二。支持4.5k-token长提示、10px级精细文字渲染及12种语言,Pro版起价0.04美元/张。核心亮点是首次将生成与编辑融合进单一架构,实现多能力统一。
7月31日,阿里通义千问发布语音识别大模型,主打长音频不丢词、行业词不用教。其升级点:长音频上下文记忆,确保会议转写一致;内置医疗、IT等行业词库,专业词召回率分别为95.36%和91.87%,无需人工配置。已在阿里云百炼平台开放调用。
阿里云将“阿里云开发者”公众号更名为“千问AI平台”,定位“为Agent而生,驱动AI生产力”。此举顺应AI向智能体演进趋势,聚焦大模型与Agent前沿技术,依托通义千问模型和阿里云技术,开启AI内容与开发者服务全面升级。
阿里通义千问发布新一代实时语音合成模型Qwen-Audio-3.0-TTS,实现从“能说话”到“会表达”的跨越。Plus版本在Artificial Analysis Speech Arena排名全球第一,超越Gemini3.1TTS等主流模型。双版本中Flash版主打低延迟实时交互(首包约300ms),Plus版专攻高质量自然度与音色还原。
Qwen2.5-Omni 是阿里云通义千问团队开发的端到端多模态模型,支持文本、音频、图像、视频输入。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$6
$24
$2
$20
Baidu
128
TIGER-Lab
Qwen2.5-VL-7B-Instruct是阿里巴巴通义千问团队开发的多模态视觉语言模型,基于70亿参数规模,专门针对视觉问答任务进行优化训练。该模型能够理解和分析图像内容,并生成准确的自然语言回答。
lmstudio-community
Qwen3-Next-80B-A3B-Instruct是阿里云通义千问团队开发的大规模语言模型,经过MLX框架4位量化优化,专门针对苹果芯片设备进行了性能优化,提供高效的推理能力。
unsloth
Qwen3-Next-80B-A3B-Instruct是阿里巴巴通义千问团队开发的最新一代大型语言模型,采用创新的混合注意力机制和高稀疏专家混合架构,在保持80B总参数的同时仅激活3B参数,实现了高效的上下文建模和推理加速,原生支持262K上下文长度并可扩展至1M令牌。
Loke-60000
Qwen3-4B-Instruct是阿里巴巴通义千问团队开发的40亿参数指令微调大语言模型,基于Qwen3架构优化,专门针对对话和指令跟随任务进行训练,具备强大的文本生成和理解能力。
Qwen3-30B-A3B-Instruct-2507是阿里巴巴通义千问团队推出的300亿参数大语言模型,专门针对指令跟随任务进行了优化。该模型支持文本生成、对话交互等多种自然语言处理任务,并通过LM Studio社区模型计划向开发者开放使用。
huynguyendbs
Qwen3-Embedding-8B是阿里巴巴通义千问团队开发的80亿参数文本嵌入模型,基于MLX库优化实现,专门用于句子相似度计算和文本特征提取任务。
ThomasBaruzier
Qwen2.5-72B-Instruct是阿里巴巴通义千问团队开发的大规模语言模型,拥有727亿参数。该模型在知识理解、编码能力、数学推理和多语言支持方面有显著提升,支持长达128K标记的上下文长度,能够生成最多8K标记的内容。