Meta被曝内部预测每年在Anthropic AI模型上的支出最高或达100亿美元。Anthropic凭Claude系列在长文本处理、复杂逻辑推理及企业级应用生态构筑技术壁垒。这一潜在百亿美元级支出,折射出大模型军备竞赛正迎来更具想象力的资本博弈。
小红书开源RedKnot推理引擎,破解生成式AI长文本处理的速度与成本难题。其核心创新在于打破传统KV Cache的token维度存储模式,为长上下文任务带来降本增效新方案。
昆仑万维集团正式发布高性能Agent模型SkyClaw-v1.0及轻量化版本SkyClaw-v1.0-lite,支持百万token超长上下文与多步任务执行,适用于复杂工具调用、多轮任务、代码生成等场景,标志着国产大模型在智能体生态与长文本处理领域取得重要进展。
近日,OpenAI Codex日志中曝光未官宣的GPT-5.6模型(代号“iris-alpha”),其上下文窗口高达150万Token,较GPT-5.5提升近43%,引发行业关注,标志着长文本处理能力的重大技术突破。
GPT-4.1 是一款在编程、指令跟随和长文本理解方面有显著提升的模型。
AI21推出的Jamba 1.6模型,专为企业私有部署设计,具备卓越的长文本处理能力。
AI21 Jamba Large 1.6 是一款强大的混合 SSM-Transformer 架构基础模型,擅长长文本处理和高效推理。
QwQ-32B 是一款强大的推理模型,专为复杂问题解决和文本生成设计,性能卓越。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Anthropic
$21
$105
200
Alibaba
$2
-
256
$0.8
128
Baidu
$525
Huawei
32
$14
$56
Tencent
$1.5
$6
30
$4
$12
28
Deepseek
8
Minimax
$1.6
$16
Sensetime
$8
$32
IbrahimSalah
这是一个基于300小时纯净阿拉伯语音频数据微调的文本转语音模型,专门为带完整元音符号的现代标准阿拉伯语提供高质量语音合成,支持声音克隆和长文本处理功能。
nightmedia
Qwen3-Next-80B-A3B-Thinking-1M-qx64n-mlx是一个采用混合专家架构和Deckard混合精度量化技术的大语言模型,具有800亿参数和1M标记的上下文长度。该模型在科学技术推理和长文本处理方面表现卓越,相比指令模型在认知基准测试中提升20-35%。
Gensyn
Qwen2.5是通义大语言模型的最新系列,提供从5亿到720亿参数的多种模型,在编码、数学、指令遵循和长文本处理方面有显著改进。
zhiqing
基于Hugging Face transformers库的4B参数大语言模型,支持文本生成、思维模式切换、工具调用和长文本处理等功能。
lmstudio-community
Mistral-Community推出的多模态大模型,支持图像和文本处理,具备128k上下文长度和可变图像尺寸处理能力。
DavidAU
基于Llama 3.2架构的3B参数推理增强模型,采用Neo Imatrix技术和极致量化方案,支持128k长文本处理,具备卓越的指令跟随和输出生成能力。
morenolq
LEGIT-BART是一系列基于Transformer的预训练模型,专为意大利法律文本处理设计,支持长文本处理和法律文档分析。
LEGIT-BART是一系列基于BART-IT预训练的意大利法律文本处理模型,支持长文本处理和法律领域任务。
LEGIT-BART是一系列基于Transformer预训练的模型,专为意大利法律文本处理设计,支持长文档处理和法律文本生成任务。
LEGIT-BART是一系列基于BART-IT预训练的意大利法律文本处理模型,支持长文本处理和法律文档分析。
tencent
混元-7B是腾讯发布的开源大语言模型,具有256K长文本处理能力和分组查询注意力机制(GQA),在中文7B稠密模型中表现优异。
Alibaba-NLP
基于ModernBERT预训练架构的英语文本重排序模型,由阿里巴巴通义实验室开发,支持8192 tokens长文本处理。
基于ModernBERT预训练编码器的文本嵌入模型,支持8192 tokens长文本处理,在MTEB、LoCO和COIR等评估任务中表现优异。
ibm-granite
Granite-3.1-1B-A400M-Base 是 IBM 开发的一款语言模型,通过渐进式训练策略将上下文长度从4K扩展到128K,支持多语言和多种文本处理任务。
cl-nagoya
Ruri是一个日语通用文本嵌入模型,专注于句子相似度计算和特征提取,支持长文本处理。
CalamitousFelicitousness
Qwen2.5-72B-Instruct是阿里巴巴推出的720亿参数大语言模型,在Qwen2基础上进行了显著改进,具有丰富的知识储备、出色的编码和数学能力,支持长文本处理和多语言交互,能为用户提供高质量的文本生成和对话服务。
Ruri-Large 是一个专注于日语文本相似度计算的高性能嵌入模型,基于 transformer 架构,支持长文本处理(最大长度8192)。
GTE系列中的首个多语言重排序模型,支持70+语言,具备高性能和长文本处理能力。
基于Qwen2-1.5B构建的通用文本嵌入模型,支持多语言和长文本处理
Orion-zhen
通义千问新一代72B参数大语言模型,支持131K长文本处理,在语言理解、文本生成、编程和数学推理等领域表现优异
一个通过MCP客户端与全球出版书籍交互的工具,支持长文本分页缓存,并计划集成Gemini问答和SciHub资源。
基于MCP协议的多语言AI翻译服务,支持长文本处理和自动语言检测