科大讯飞在2026年半年度业绩说明会上透露,将于今年1024开发者节正式推出基于全国产算力的全新主力通用大模型;8月底率先发布阶段性版本,供市场和开发者提前体验,技术落地节奏已明确。
8月20日,2026全球数字经济大会拉萨分会场“数启纳金·智汇高原”论坛举行,拉萨市纳金数智研究院揭牌成立,“阳光清言”通用藏语大模型正式发布。该模型2025年11月19日首次亮相,已通过中央网信办备案,历经近两个月后正式推出。
OpenAI扩展Daybreak网络安全计划,新增两级访问权限并发布专为安全训练的GPT-5.6-Cyber模型。该计划认为,攻击者正利用AI加速攻击,防御窗口急剧收窄,须在恶意应用大规模部署前,将前沿智能交给可信防御方。Daybreak Blue层级提供通用模型GPT-5.6 Sol,移除了妨碍合法防御的限制。
腾讯混元发布语音识别模型Hy ASR3.0preview,基于大语言模型Hy3的语言理解能力,融合高精度识别与深度语义理解。它在通用识别、上下文感知、多场景鲁棒性及方言覆盖等方面全面提升,能结合语境给出更准确连贯的转写,实现从逐字转写到理解语义的进化。
AI通用上下文层,自动更新,通过MCP供各代理和LLM使用,默认分段
一个通用框架,用于在测试时调节大型推理模型的思维进度。
智元发布首个通用具身基座大模型GO-1,开创性提出ViLLA架构,推动具身智能发展。
VLM-R1 是一个稳定且通用的强化视觉语言模型,专注于视觉理解任务。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$6
$24
Baidu
128
$2
$20
$8
$240
52
Bytedance
$1.2
$3.6
4
DavidAU
Qwen3-4B-Hivemind-Instruct-NEO-MAX-Imatrix-GGUF 是一款基于 Qwen3 架构的 4B 参数指令微调大语言模型,采用 NEO Imatrix 与 MAX 量化技术,具备 256k 的超长上下文处理能力。该模型在多个基准测试中表现出色,是一款性能强劲的通用型模型。
lightonai
LightOnOCR-1B-1025是一款紧凑的端到端视觉语言模型,专门用于光学字符识别和文档理解。它在同权重级别中实现了最先进的准确率,同时比大型通用视觉语言模型更快、成本更低。
birder-project
这是一个基于RoPE(旋转位置编码)的Vision Transformer模型,参数规模为150M,采用14x14的patch大小。该模型在约2100万张图像的多样化数据集上进行了预训练,可作为通用视觉特征提取器使用。
KaLM-Embedding
KaLM-Embedding-V2.5是一款通用且轻量级的嵌入模型,通过卓越的训练技术和数据,在同类规模模型中达到最优性能,甚至能与规模大3-26倍的模型相媲美。支持多语言和多种嵌入维度选择。
OpenGVLab
InternVL3.5是开源多模态模型家族的新成员,显著提升了InternVL系列的通用性、推理能力和推理效率,支持GUI交互等新功能,达到开源多模态大语言模型的先进水平。
alakxender
基于google/gemma-3-270m构建的轻量级迪维希语预训练模型,在包含新闻文章、维基百科内容和通用网页文本等大规模迪维希语文本数据上进行训练,为迪维希语相关任务提供强大支持。
ByteDance-Seed
Seed-OSS是由字节跳动Seed团队开发的开源大语言模型系列,具备强大的长上下文处理、推理、智能体交互能力和通用性能。该模型仅使用12T token训练,在多个公开基准测试中表现出色。
JetLM
SDAR是一种新型大语言模型,集成了自回归和离散扩散建模策略,结合了AR模型高效训练和扩散模型并行推理的优势。在通用任务上与SOTA开源AR模型相当,在科学推理任务上表现出色,成为最强大的扩散语言模型。
unsloth
Qwen3-4B-Instruct-2507是阿里云推出的40亿参数大语言模型,基于Unsloth Dynamic 2.0量化技术,在通用能力、长尾知识覆盖、用户偏好对齐和长上下文理解等方面都有显著提升。
NVFP4
Qwen3-30B-A3B-Thinking-2507是一款在推理能力和通用能力上有显著提升的大型语言模型,增强了长上下文理解能力,适用于高度复杂的推理任务。该模型具有305亿参数,其中激活33亿参数,支持262,144 tokens的长上下文处理。
cpatonn
Qwen3-30B-A3B-Thinking-2507是经过量化处理的大语言模型,具有增强的推理能力、通用能力和长上下文理解能力。该模型采用混合专家架构,在逻辑推理、数学、科学、编码等复杂任务上表现出色,支持262,144 tokens的长上下文处理。
Qwen
Qwen3-30B-A3B-Instruct-2507是Qwen3-30B-A3B非思考模式的更新版本,在通用能力、长尾知识覆盖、用户偏好对齐和长上下文理解等方面均有显著提升。这是一个305亿参数的大型语言模型,采用MoE架构,激活参数为33亿。
Qwen3-235B-A22B-Thinking-2507是一款强大的大语言模型,在推理任务、通用能力和长上下文理解等方面有显著提升,适用于高度复杂的推理场景。该模型在过去三个月里持续扩展了思维能力,提升了推理的质量和深度。
tensorblock
一个多用途、多语言支持的大语言模型,适用于通用任务、角色扮演、故事写作等多个领域。
opencompass
CompassJudger-2 是一系列全新的通用评判模型,旨在克服现有大语言模型评判方案专业性狭窄和鲁棒性有限的问题。
DeSTA-ntu
DeSTA2.5-Audio是一个通用的大型音频语言模型,通过自生成的跨模态对齐技术,在无需特定任务指令调优数据的情况下实现高扩展性和效率,同时保留语言能力并避免灾难性遗忘。
EleutherAI
深度无知模型套件是一个包含18个69亿参数的大语言模型集合,旨在研究通过过滤预训练数据来防止模型学习不安全技术能力(如CBRN相关能力)的方法。该套件展示了过滤数据可以有效避免不良知识学习,同时保持通用性能并具备抗篡改能力。
bartowski
一个多语言、多用途的大型语言模型,支持多种专业领域和通用任务,适用于角色扮演、故事创作、编程等多种场景。
beetlware
基于Qwen3-14B微调的阿拉伯语逻辑推理大模型,优化了阿拉伯语逻辑和演绎推理能力,同时保留通用对话能力。
MathLLMs
MathCoder-VL系列开源大型多模态模型,专为通用数学问题解决而设计,结合视觉与代码增强数学推理能力。
Zyla API Hub MCP服务器是一个通用API调用工具,允许大型语言模型通过MCP协议访问Zyla API Hub上的任何公共API,支持多种HTTP方法和安全认证。
XiYan MCP Server是一个基于XiYan-SQL的模型上下文协议服务器,支持通过自然语言查询数据库,提供多种模型配置选项,包括通用大模型、SOTA文本转SQL模型及本地模型,适用于不同安全性和性能需求场景。
openEuler MCP Servers仓库是一个用于存放各种MCP Server的仓库,旨在通过通用的大模型上下文协议(MCP)调用各种应用,拓展大模型能力,特别是在操作系统领域。