字节跳动火山引擎旗下火山方舟体验中心上线Seedance 2.0 Mini视频生成模型,主打高性价比,近期将开放API服务。该轻量化版本在保持高质量输出的同时,生成速度比同系列标准快速版更快,旨在服务更广泛的视频创作与规模化生产市场。
月之暗面公司继Kimi 2.7 Code大模型后,推出高速版本,输出速度提升5-6倍,常规编程下约180 Token/s,大幅缩减等待时间,旨在提升开发者代码编写效率。
月之暗面于6月15日上线Kimi K2.7Code模型高速版,面向Beta计划成员、API开发者及商业用户开放。该版本保持原有模型逻辑,但通过技术优化使输出速度提升5到6倍,尤其短上下文任务响应效率显著提高,标志着AI编程工具迎来新一轮提速。
谷歌于2026年6月发布开源语言模型DiffusionGemma,首次将图像AI扩散机制引入文本生成,打破传统逐字自回归范式。该模型从随机噪声迭代优化,并行输出256个词块。经英伟达优化,在单GPU单用户模式下,运行速度比同类传统模型快近四倍,如H100显卡处理单请求时表现显著提升。
Google
$0.49
Input tokens/M
$2.1
Output tokens/M
1k
Context Length
Xai
$1.4
$3.5
2k
Openai
$7.7
$30.8
200
$0.7
$2.8
Anthropic
$7
$35
$21
$105
Alibaba
-
$15.8
$12.7
64
Moonshot
$4
$16
256
Bytedance
$10.5
Tencent
$1
32
$0.35
400
magiccodingman
这是一个实验性的混合量化模型,采用MXFP4_MOE混合权重技术,在保持接近Q8精度的同时,实现了更小的文件大小和更高的推理速度。模型探索了MXFP4与高精度嵌入/输出权重的组合,在密集模型上取得了精度近乎无损的优化效果。
这是一个基于Qwen3 4B模型的混合量化版本,采用MXFP4_MOE混合权重技术,在保持近乎无损精度的同时实现了更小的文件大小和更高的推理速度。该模型通过精心组合MXFP4和高精度嵌入/输出权重,达到了接近Q8量化的精度水平,同时具备Q4-Q6级别的吞吐量。