腾讯混元与WorkBuddy联合发布Hy4 preview升级公告,针对用户反馈的复杂任务长思考、过度自我验证等问题进行专项优化并全量上线。经Bench指标与人工评测双重验证,新版在保持任务效果的同时,显著降低任务轮次及输入输出消耗。
9月7日,腾讯混元与WorkBuddy联合团队宣布混元Hy4preview模型升级全量上线。此次升级基于用户与开发者反馈,专项优化复杂任务下长思考、过度自我验证等问题,并通过Bench指标与人工评测双重验证,确保优化不牺牲任务效果。
Meta发布最强AI模型Muse Spark 1.3,主打长周期智能体工作流与编码能力。其编码表现超越OpenAI GPT-5.6 Sol,与Claude Fable 5.1持平;相比上代代码更简洁、token消耗更少,减少冗余迭代,工具调用更清晰。
千问办公平台上线Qwen3.8-Flash大模型及标准模式,全体用户可体验,具有更低积分消耗与更快Token吞吐优势。后续将形成标准与高级双模型体系,标准模式覆盖95%日常办公需求,剩余5%复杂任务由高级模式处理。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$7
$35
Alibaba
$4
$16
$2
$20
-
$6
$24
256
Bytedance
$0.8
$0.15
$1.5
Baidu
32
$10.5
Tencent
$1
$8
$0.75
$0.35
400
rhysjones
该模型源自karpathy的llm.c项目,为研究bfloat16性能而转换为HuggingFace格式,训练过程消耗了1500亿token。
princeton-nlp
Sheared-LLaMA-2.7B是基于Llama-2-7b通过剪枝和继续预训练得到的轻量级语言模型,仅消耗50B tokens预算。
MCP文本编辑器服务器是一个基于Model Context Protocol的文本文件编辑服务,提供行导向的文本文件操作能力,支持高效的部分文件访问以减少LLM工具的token消耗。具备并发编辑检测、多文件原子操作和多种编码支持等特性。
godoc-mcp是一个高效的Go文档访问工具,通过MCP协议为LLM提供结构化、低token消耗的Go项目文档访问服务,支持本地和远程包文档查询。
OneTool是一个统一的MCP服务器,通过Python API暴露100多种工具,大幅减少AI调用工具时的token消耗和成本,避免上下文污染,支持Web搜索、数据库、文件操作、图表绘制等多种功能。
用于对xcstrings(字符串目录)文件进行增删改查操作的CLI工具和MCP服务器,提供针对性的本地化键值管理,避免AI助手处理大型文件时消耗过多token。
一个基于MCP协议的内存缓存服务器,通过高效缓存语言模型交互数据来减少token消耗,支持自动管理和配置优化。
NCP是一个MCP协议智能编排器,将多个MCP服务器统一管理,通过语义理解自动路由工具调用,大幅减少AI工具的认知负担和token消耗,提升AI助手的工作效率和响应速度。
MCP BatchIt是一个MCP工具调用批处理服务器,通过聚合多个MCP工具调用到一个请求中,显著减少AI代理的通信开销和token消耗。
一个优化的Playwright MCP服务器,采用客户端-服务端架构实现浏览器自动化,通过创新的语义快照算法大幅减少页面内容传输量,保留关键元素的同时降低90%的token消耗。
OneMCP是一个通用的MCP协议聚合器,通过元工具架构将多个外部MCP服务器的工具统一管理,采用渐进式发现和语义搜索技术,显著降低LLM的token消耗并提高工具发现效率。
基于语义搜索的代码导航MCP服务器,通过AI嵌入和AST解析实现高效代码检索,减少token消耗