Meta发布最强AI模型Muse Spark1.3,主打智能体工作流与编码能力增强。官方称其编程表现超越GPT-5.6Sol,与Claude Fable5.1持平。定价延续前代,通过Meta Model API付费开放,每百万词元输入费1.25美元。
Meta推出首个实时音频感知模型Muse Voice Transcribe,可通过Model API调用,定价每1000分钟3美元(约每小时0.18美元)。该模型整合流式语音识别、说话人分离与端点检测,支持边说边转写,无需等待整段音频,并可自动区分20余名说话者分轨输出。
智谱开源原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能和极致定价推动AI普惠。该模型测评获57分,与Claude Opus4.8持平,编程能力相当,综合性能超越GLM-5.2。发布前以匿名“Ox-Alpha”公开测试,登顶OpenCode、OpenRouter平台调用。
阿里千问发布多模态MoE模型Qwen3.8-Flash,并开源下一代架构Qwen3.8-Flash-Next(Qwen4雏形)。模型总参数125B,搭载51B N-gram Embedding,每token仅激活6B;原生支持26万token,可扩展至100万。训练成本为前代1/9,API定价输入每百万Tokens 1元、输出3元。
在izzedo chat一处访问GPT、Gemini等高级AI模型,功能先进,定价简单。
开源AI模型数据库,涵盖模型规格、定价和特性信息
Oxlo.ai提供前沿AI模型推理API,定价灵活,保护隐私。
学习顶级人工智能和SaaS产品的定价页面,改进定价策略、模型和设计。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$2
$20
$6
$24
这是一个为AI助手提供实时模型信息的MCP服务器,支持查询300多个AI模型的定价、上下文限制和功能,并能进行实时测试。