姚顺雨称大模型并无秘密,腾讯混元4(Hy4preview)近期表现印证此言。面对智谱、月之暗面、DeepSeek、千问等竞争,腾讯四个月内完成混元大语言与多模态部门重组,推出770B参数、支持百万上下文的模型,显示所谓技术壁垒并非不可逾越。
国光量超人工智能团队将前沿量子技术引入大语言模型决策与推理核心,推出面向科研学术领域的“玄幂”大模型家族。该模型在科研科普、任务路由、智能体决策等垂直任务中展现独特竞争优势,助力大语言模型突破纯经典计算物理边界。
特斯拉中国车机系统近日更新,全面上线字节跳动旗下豆包大模型。7月31日起分批推送2026.14.13版本,覆盖Model 3、Model Y、Model S、Model X全系车型,新交付车辆优先搭载。车主OTA升级后,可长按方向盘语音按钮、呼喊“嘿,Tesla”或操作滚轮唤醒AI语音助手。
OpenAI对ChatGPT桌面端进行重大更新,上线ChatGPT Voice语音功能。用户可直接用语音指令让AI智能体在电脑上独立完成复杂任务。该功能依托于新推出的ChatGPT-Live语音模型系列,大幅提升桌面交互体验。
百度基于文心大模型的智能体平台,支持开发者打造产品能力。
EverOS将无状态大语言模型转变为能真正记忆的智能代理,具备自进化技能记忆等
GLM-5是智谱AI第五代大模型,7450亿参数,具多项前沿能力,现已开放。
由中国电信人工智能研究院研发的语言模型。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
$8
$240
52
Bytedance
$1.2
$3.6
4
Guilherme34
Qwen3-32B是Qwen系列最新一代的大语言模型,具备强大的推理、指令遵循、智能体交互和多语言处理能力。它支持100多种语言和方言,能在思维模式和非思维模式间无缝切换,为用户提供自然流畅的对话体验。
ErenAta00
赛博智脑是一个专门针对夺旗赛(CTF)挑战和网络安全任务进行微调的大语言模型。它基于Llama-3.1-8B-Instruct架构,能够协助解决CTF问题、分析安全漏洞、进行逆向工程和密码学挑战,并在遵循道德准则的前提下提供漏洞利用推理。
BAAI
Emu3.5是北京智源人工智能研究院开发的原生多模态模型,能够跨视觉和语言联合预测下一状态,实现连贯的世界建模和生成。通过端到端预训练和大规模强化学习后训练,在多模态任务中展现出卓越性能。
unsloth
Qwen3-VL是通义大模型系列中最强大的视觉语言模型,具备卓越的文本理解与生成能力、深入的视觉感知与推理能力、长上下文支持、强大的空间和视频动态理解能力以及出色的智能体交互能力。该模型采用混合专家(MoE)架构,是增强推理的思维版。
SamuelBang
AesCoder-4B是一个专注于提升代码美学质量的大语言模型,通过智能奖励反馈机制优化代码生成的美学表现,在网页设计、游戏开发等视觉编码任务中表现出色。
Qwen
Qwen3-VL-32B-Thinking-FP8是Qwen系列中最强大的视觉语言模型的FP8量化版本,采用块大小为128的细粒度fp8量化技术,性能指标与原始BF16模型几乎相同。该模型具备出色的文本理解与生成能力、深入的视觉感知与推理能力、长上下文支持以及强大的智能体交互能力。
cpatonn
Qwen3-VL是通义大模型系列中最强大的视觉语言模型,具备卓越的文本理解与生成能力、深入的视觉感知与推理能力、长上下文支持、强大的空间和视频动态理解能力,以及出色的智能体交互能力。
quwsarohi
NanoAgent是一个紧凑的智能大语言模型,拥有1.35亿参数和8k上下文长度。它专门针对工具调用和指令遵循进行了优化,能够在个人设备上高效运行,支持轻量级推理和ReAct风格的交互。
Mungert
通义深度研究30B是一款具有300亿参数的大语言模型,专为长周期、深度信息搜索任务设计。该模型在多个智能搜索基准测试中表现出色,采用创新的量化方法提升性能,支持智能预训练、监督微调与强化学习。
Qwen3-VL-30B-A3B-Instruct-FP8是通义系列中最强大的视觉语言模型的FP8量化版本,采用块大小为128的细粒度FP8量化,性能与原始BF16模型几乎相同。该模型具备卓越的文本理解和生成能力、深入的视觉感知和推理能力、长上下文支持以及强大的智能体交互能力。
Qwen3-VL-235B-A22B-Thinking-FP8是通义系列中最强大的视觉语言模型的FP8量化版本,采用块大小为128的细粒度fp8量化,性能指标与原始BF16模型几乎相同。该模型具备卓越的文本理解与生成能力、深入的视觉感知与推理能力、长上下文支持以及强大的智能体交互能力。
GLM-4.6是智谱AI开发的新一代大语言模型,相比GLM-4.5在上下文处理、编码能力和推理性能方面有显著提升。该模型支持200K上下文长度,在多个公开基准测试中表现出色,特别在代码生成、推理和代理任务方面具有竞争优势。
Qwen3-VL是通义大模型系列中最强大的视觉语言模型,在文本理解与生成、视觉感知与推理、上下文长度、空间和视频动态理解以及智能体交互能力等方面均有显著提升。该模型提供密集架构和混合专家模型架构,支持从边缘到云的不同规模部署。
geoffmunn
这是阿里巴巴Qwen系列80亿参数大语言模型的GGUF量化版本,专为高级推理、智能体行为和多语言任务设计,可与llama.cpp及兼容工具配合使用。
XiaomiMiMo
MiMo Audio是小米开发的音频语言模型,通过大规模预训练展现出强大的少样本学习能力。该模型突破了传统模型依赖特定任务微调的局限,在语音智能、音频理解等任务中表现出色,在开源模型中达到先进水平。
MiMo Audio是一款基于大规模预训练的音频语言模型,在语音智能和音频理解基准测试中取得了开源模型的SOTA性能。该模型展现出强大的少样本学习能力,能够泛化到训练数据中未包含的任务,支持语音转换、风格迁移和语音编辑等多种音频任务。
这是Qwen/Qwen3-4B语言模型的GGUF量化版本,由阿里巴巴通义系列开发的40亿参数大语言模型,专为消费级硬件设计,支持强大推理、智能体工作流和多语言交互。
QuantTrio
DeepSeek-V3.1是基于DeepSeek-V3.1-Base进行后训练的大型语言模型,具有128K上下文长度,支持混合思维模式、智能工具调用和代码代理功能。该模型在多项基准测试中表现出色,特别在数学推理、代码生成和搜索代理任务上有显著提升。
stepfun-ai
Step-Audio 2 是一款端到端的多模态大语言模型,专为满足行业级音频理解和语音对话需求而设计。具备先进的语音和音频理解能力、智能语音对话功能、工具调用和多模态检索增强生成能力,在多个音频理解和对话基准测试中取得了领先的性能。
gabriellarson
Seed-OSS是由字节跳动Seed团队开发的开源大语言模型系列,具备强大的长上下文处理、推理和智能体交互能力。仅使用12T token训练,在多个公开基准测试中表现出色,支持高达512K的原生长上下文处理。
LLM Context是一个帮助开发者快速将代码/文本项目内容注入大型语言模型聊天界面的工具,支持智能文件选择和多种集成方式。
一个基于模型上下文协议(MCP)的服务器,通过构建代码知识图谱为大型语言模型提供TypeScript代码库的深度上下文理解。它使用AST分析解析代码,在Neo4j中构建全面的图表示,并通过语义搜索和图遍历提供智能查询能力。
Unity MCP服务器是一个基于C#的模型上下文协议(MCP)服务,用于连接Unity编辑器与外部大型语言模型(LLM)或云端AI代理,实现实时自动化与智能交互。
AI驱动的图表与原型绘制MCP服务器,集成多种大语言模型,支持根据自然语言描述智能生成多种风格的draw.io格式图表和HTML交互式产品原型。
本项目构建了一个基于IBM Watsonx.ai的检索增强生成(RAG)服务器,使用ChromaDB进行向量索引,并通过模型上下文协议(MCP)暴露接口。该系统能够处理PDF文档并基于文档内容回答问题,实现了将大型语言模型与特定领域知识相结合的智能问答功能。
FastApply MCP Server是一个企业级代码智能平台,通过本地AI模型、AST语义搜索、安全扫描和智能模式识别,提供全面的代码分析、搜索和重构能力,支持多语言开发和大规模代码库处理。
MCP代码索引器是一个专为AI大语言模型设计的智能代码检索工具,通过语义理解和向量化索引提升代码处理效率和准确性,支持代码分析、质量评估和依赖管理等功能。
一个为大型语言模型提供文件系统上下文的MCP服务器,支持文件操作、代码分析和智能搜索。
MCP开发框架是一个用于创建与大语言模型交互自定义工具的强大框架,提供文件处理、网页内容获取等功能,支持PDF、Word、Excel等多种格式,具有智能识别、高效处理和内存优化等技术特点。
MCP GitHub Reader是一个轻量级的MCP服务器,用于将GitHub仓库内容整合到大型语言模型的上下文中,提供仓库分析、文件访问、智能过滤和搜索功能。
BinAssistMCP是一个连接Binary Ninja与大型语言模型(LLM)的MCP服务,提供40多种逆向工程工具,支持双传输协议和智能上下文管理
Kolada MCP Server是一个连接大型语言模型与瑞典Kolada统计数据库的智能中间件,提供语义搜索、KPI分析、多年度比较等功能,简化公共部门数据的查询与解读。
TokenScope是一个面向大型语言模型的令牌感知目录探索工具,提供智能目录结构分析、文件内容令牌感知提取、令牌使用统计和综合报告生成功能。
Unified MCP Tool Graph 是一个研究驱动的项目,通过将来自不同MCP服务器的工具API聚合并结构化到一个集中的Neo4j图数据库中,为大型语言模型(LLMs)和代理AI系统提供动态检索最相关工具的智能基础设施层。
MCP开发框架是一个用于与大语言模型交互的强大工具集,提供文件处理(PDF/Word/Excel)、网页内容获取等功能,支持Cursor IDE扩展,具有智能文件识别、高效处理和内存优化等技术特点。
基于大模型的智能对话机器人项目,支持多平台接入和多种AI模型,具备文本、语音、图像处理及插件扩展能力,可定制企业AI应用。
该项目实现了一个基于MCP协议的CRM-AI服务中间层,提供数据安全处理、智能对话管理和潜在客户分析功能,通过匿名化技术和令牌系统保护敏感数据,同时支持与大型语言模型的集成。
一个为大型语言模型提供文件系统上下文的服务器,支持文件操作、代码分析和智能缓存等功能。
MCP是一个帮助用户在大型语言模型(LLM)基础上构建智能体和复杂工作流的工具
一个基于MCP协议的服务器,支持大型语言模型控制WizConnected智能灯具。