OpenAI工程师Tibo宣布,Codex中GPT-5.6 Sol模型的100万Token上下文窗口,已从仅限API密钥扩展至ChatGPT账号。订阅用户可手动开启百万窗口,解决处理大项目时被迫截断历史记录的限制。
阿里巴巴办公Agent“千问办公”首发上线智谱GLM-5.3与DeepSeek V4Pro,用户可在首页直接选用。加上已接入的Qwen3.8-Max,其成为业内首款同时覆盖阿里、智谱、DeepSeek三家国产旗舰模型的办公Agent。两款模型均为各自最新旗舰,DeepSeek V4Pro支持100万Token上下文。
金山办公“灵犀专业版”于2026年8月14日接入DeepSeek-V4-Pro正式版,用户无需配置,手动切换即可体验。该模型支持100万token超长上下文,单次最大输出38.4万token,基准测试较Preview全面提升,落地场景具差异化优势。
月之暗面于7月28日开源2.8万亿参数大模型Kimi K3,支持100万token上下文与视觉理解,采用KDA混合注意力机制。同日,摩尔线程宣布基于MTT S5000智算卡完成对其的快速适配与稳定运行,实现国产算力与开源大模型的协同突破。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$7
$35
Alibaba
$4
$16
$6
$24
256
$2
$20
-
Bytedance
$0.8
$0.15
$1.5
Baidu
32
$10.5
$8
Tencent
$1
$0.75
$0.35
400
$0.63
$3.15
131
Mungert
aquif-3.5系列中的顶尖模型,具备先进推理能力和100万标记的大上下文窗口,在多个基准测试中表现卓越,AAII综合得分达到60分。
unsloth
aquif-3.5系列是2025年11月3日发布的巅峰之作,包含Plus和Max两个版本,提供先进的推理能力和前所未有的100万标记上下文窗口,在各自类别中实现了最先进的性能。
moonshotai
Kimi Linear是一种高效混合线性注意力架构,在短上下文、长上下文和强化学习场景中均优于传统全注意力方法。它通过Kimi Delta Attention (KDA)机制优化注意力计算,显著提升性能和硬件效率,特别擅长处理长达100万令牌的长上下文任务。
nightmedia
基于Qwen3-Next的800亿参数指令微调模型,采用Deckard qx64n混合精度量化技术,支持100万上下文长度,在抽象推理、内存效率和长上下文处理方面表现优异
DavidAU
这是一个基于Qwen3-Coder-30B-A3B-Instruct的混合专家模型,拥有540亿参数和100万上下文长度。模型通过三步合并和Brainstorm 40X优化,具备强大的编程能力和通用场景处理能力,特别集成了思考模块,能够在回答前进行深度推理。
这是一个基于Qwen3-Next-80B模型转换的MLX格式大语言模型,具有100万标记的超长上下文处理能力。该模型采用独特的qx65量化公式,注重情感共鸣而非单纯的技术优化,能够感知问题背后的情感并生成更具人性化的回复。
基于Llama 3.1的8B参数模型,支持100万token上下文长度,专为创意写作和角色扮演优化,具有高度稳定性和低困惑度特性。
YOYO-AI
Qwen2.5-YOYO第五代模型,整合了多个先进模型的特点,优化了模型合并公式,支持100万token上下文。
gradientai
由Gradient开发的Llama-3 8B长上下文扩展版本,支持超过100万token的上下文长度,通过优化RoPE theta参数实现高效长文本处理能力。
LongSafari
HyenaDNA是一个长距离基因组基础模型,预训练上下文长度可达100万个标记,具有单核苷酸分辨率。
HyenaDNA是一个长距离基因组基础模型,在高达100万个标记的上下文长度上以单核苷酸分辨率进行预训练。该模型使用Hyena算子替代传统注意力机制,实现了次二次计算复杂度,能够处理超长DNA序列。
HyenaDNA是一个长距离基因组基础模型,在单核苷酸分辨率下预训练了长达100万个标记的上下文长度。