金山办公“灵犀专业版”于2026年8月14日接入DeepSeek-V4-Pro正式版,用户无需配置,手动切换即可体验。该模型支持100万token超长上下文,单次最大输出38.4万token,基准测试较Preview全面提升,落地场景具差异化优势。
稀宇科技发布新一代大语言模型MiniMax M3,具备顶尖编程能力、100万超长上下文窗口及原生多模态交互,成为国内首个集齐这三项技术指标的模型,也是全球唯一具备此性能的开源模型,在多项权威评测中表现亮眼。
DeepSeek于4月24日发布新一代大模型DeepSeek-V4,性能比肩顶级闭源模型,成为开源AI里程碑。它支持100万tokens超长上下文,适用于长文档分析、代码生成和多轮任务。同时推出轻量版Flash和标准版,分别满足快速迭代与深度应用需求。
阿里千问系列最新模型Qwen3.6Plus Preview已上线OpenRouter平台,目前限时免费,并具备100万超长上下文处理能力。该模型在底层架构上进行了深度优化,采用更先进的混合架构,显著提升了扩展性并降低了成本,性能比前代更强。
Xai
$1.4
Input tokens/M
$3.5
Output tokens/M
2k
Context Length
Google
$0.7
$2.8
1k
Baidu
-
32
Alibaba
$0.75
256
$1
$4
Bytedance
$0.8
$8
$0.3
$2
Tencent
$0.5
224
$8.75
$70
Baichuan
$16
192
Minimax
128
$1.05
$4.2
Moonshot
$32
262
nightmedia
这是一个基于Qwen3-Next-80B模型转换的MLX格式大语言模型,具有100万标记的超长上下文处理能力。该模型采用独特的qx65量化公式,注重情感共鸣而非单纯的技术优化,能够感知问题背后的情感并生成更具人性化的回复。
LongSafari
HyenaDNA是一个长距离基因组基础模型,在高达100万个标记的上下文长度上以单核苷酸分辨率进行预训练。该模型使用Hyena算子替代传统注意力机制,实现了次二次计算复杂度,能够处理超长DNA序列。