智谱发布大模型GLM-5.3,参数量仍为7400多亿,与GLM-5.2同底,未升级万亿参数(或留待5.5)。其依靠后训练使性能较上代提升50%,在多项主流基准中居开源模型榜首,编程与智能体能力接近Claude Fable5,编程体验优于其他国产模型。
智谱发布GLM-5.3,基座模型完全未变,提升全部来自后训练Scaling。通过数十倍规模长程任务环境、更丰富环境类型和超长后训练时间,相同基座智能上界被显著抬高。内部评测编程体感较GLM-5.2提升约50%,成为当前编程能力最强的开源模型,公开基准表现同样亮眼。
DeepSeek Harness 开发者预览版 v0.1 发布并以 MIT 协议开源。其采用“一切皆插件”设计,基于 Cordis 插件系统构建 Agent Harness,模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等能力均以插件形式组合,可独立替换与灵活重组。Cordis 元框架负责插件加载等基础能力。
DeepSeek于8月13日发布首款Agent产品Harness v0.1开发者预览版,以MIT协议开源。其定位为模型之外的基础设施,公式“模型+Harness=Agent”:模型负责思考推理,Harness负责实际执行,旨在让AI真正落地执行任务。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
prithivMLmods
ActIO-UI-7B-RLVR 是由 Uniphore 发布的 70 亿参数视觉语言模型,专门用于计算机界面自动化任务。它基于 Qwen2.5-VL-7B-Instruct,通过监督微调和可验证奖励的强化学习进行优化,在 GUI 导航、元素定位和交互规划等任务上表现出色,在 WARC-Bench 基准测试中达到了开源 7B 模型的领先水平。
manuelcaccone
Gemma-3 ActuaryEnough2是一款专为精算领域打造的AI模型,基于超过11,000个精算问答对进行微调训练,能够将简单的保险问题转化为严谨的精算专业语言。该模型为ActuaryEnough提供支持,以开源形式发布供教育和研究使用。
giladgd
GPT-OSS-120b-GGUF 是 OpenAI 发布的 1200 亿参数开源文本生成模型,采用 Apache 2.0 宽松许可证,支持灵活的推理强度配置和完整思维链访问,具备原生函数调用、网页浏览和代码执行能力。
cpatonn
GLM-4.5-Air-AWQ是基于GLM-4.5-Air基础模型的8位量化版本,专为智能代理设计,采用混合推理模式,支持复杂推理和即时响应,在MIT开源许可下发布。
minpeter
这是一个基于transformers库开发的多语言基础模型,特别针对韩语进行了优化。模型参数量为1.87亿,采用Apache-2.0开源许可证发布。
inclusionAI
玲珑线性预览版是由InclusionAI开源发布的混合线性稀疏大语言模型,总参数量17.1B,激活参数量3.0B。该模型基于混合线性注意力机制实现长文本推理,在推理过程中具备近线性计算复杂度与近恒定空间复杂度。
tensorblock
NVIDIA发布的8B参数规模的开源大语言模型,基于Llama-3架构,提供多种量化版本
Gemma 3.4B IT 是 Google 发布的轻量级开源大语言模型,基于 3.4B 参数规模,适用于对话和指令跟随任务。
tencent
混元-7B是腾讯发布的开源大语言模型,具有256K长文本处理能力和分组查询注意力机制(GQA),在中文7B稠密模型中表现优异。
kifai
GECKO是基于韩语、英语和代码训练的70亿参数解码器专用Transformer模型,采用Apache 2.0许可开源发布。
emrecanacikgoz
Llama 2 是 Meta 发布的新一代开源大语言模型,包含 7B、13B 和 70B 三种参数规模版本,支持商用许可。
ibm-granite
IBM发布的基于Apache-2.0许可证的开源大语言模型,复现了Meta的Llama2-7B架构,使用2T token数据训练而成。
meta-llama
Meta发布的80亿参数指令微调大语言模型,优化对话场景并在基准测试中超越多数开源聊天模型
TheBloke
Mistral 7B v0.1是由Mistral AI开发的一个70亿参数的开源大语言模型,采用Apache 2.0许可证发布。
openlm-research
OpenLLaMA是LLaMA大语言模型的开源复现版本,基于宽松许可证发布,包含3B/7B/13B参数规模的系列模型
OpenLLaMA是Meta AI LLaMA模型的开源复现版本,采用Apache 2.0许可协议发布,包含3B/7B/13B参数规模
Salesforce
Salesforce AI Research发布的7B参数大语言模型,支持8K长序列输入,基于Apache-2.0协议开源
Askinkaty
该模型是一个支持俄语的开源模型,采用Apache-2.0许可证发布。
ahmed-masry
一个基于GPL-3.0许可证发布的开源模型,具体功能和应用领域需进一步确认
huggyllama
LLaMA-7b是由Meta发布的开源大语言模型,参数规模为70亿,适用于自然语言处理任务。
Open Data MCP是一个开源项目,旨在通过MCP协议将公开数据集快速接入LLM应用,实现开放数据的便捷访问和社区化发布。
Open Data MCP是一个开源项目,旨在通过MCP协议将公开数据集快速接入LLM应用。项目提供CLI工具实现2分钟接入(当前支持Claude),并建立社区协作框架让开发者能轻松贡献和发布公开数据集。核心目标是构建连接所有LLM应用与数百万公开数据集的基础设施。
gitctx是一个MCP服务器,为AI编程工具提供针对性的GitHub仓库上下文访问,包括代码、问题、拉取请求、提交和发布等,是Librarian的开源替代方案。
该项目使用优化的GitHub Actions工作流,为开源项目设计,最小化资源使用同时保持质量。包含快速PR检查、完整CI/CD管道、安全扫描、自动化发布等功能。
Model Context Protocol (MCP) 是Anthropic发布的开源协议,旨在解决大型语言模型(LLM)与外部数据源和系统连接的标准化问题。它通过提供结构化框架,使模型能够集成和利用外部上下文,从而扩展其能力并提高响应准确性。MCP支持知识扩展、外部工具调用和预写提示等功能。