AIBase
首页
AI 资讯
AI 产品库
GEO 平台
MCP 服务
模型算力广场
ZH

AI资讯

查看更多

长文本理解新王者?Gemini2.5Pro 击败 o3领跑 Fiction.Live 基准测试

在最近的 Fiction.Live 基准测试中,Gemini2.5Pro 在理解和再现复杂故事和背景方面表现出色,领先于竞争对手 OpenAI 的 o3模型。这项测试远超传统的“大海捞针”式任务,专注于模型在海量上下文中处理深层语义和背景依赖信息的能力。据测试数据显示,在上下文窗口长度达到192,000个词条(约14.4万个单词)时,o3模型性能急剧下滑,而 Gemini2.5Pro 的6月预览版(preview-06-05)在同一条件下依然保持了超过90% 的准确率。值得注意的是,OpenAI 的 o3模型在8K 代币以下保持完美准确率,但当上下文扩展至1

13.7k 昨天
长文本理解新王者?Gemini2.5Pro 击败 o3领跑 Fiction.Live 基准测试

模型

查看更多

Fiction.live Kimiko V2 70B GGUF

TheBloke

F

Fiction Live Kimiko V2 70B 是一个基于 Llama 2 架构的大型语言模型,提供多种量化格式,适用于不同推理场景。

自然语言处理TransformersTransformers英语
TheBloke
868
13
AIBase
智启未来,您的人工智能解决方案智库
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商务合作网站地图