谷歌推出Gemini Omni 1.1 Flash视频生成模型,最高支持4K输出,较720p在速度与成本上取舍,面向专业成片。亮点包括场景扩展:可从已有视频结尾无缝续生成,每次10秒、累计最长40秒;指定首尾帧即可实现平滑转场与运镜。
OpenAI正式推出GPT-5.6 Sol“超快”模式,输出速度最高达每秒750个token,整体处理速度较标准模式最高快14倍,且无需更换更小或低性能模型。该突破主要得益于Cerebras晶圆级引擎架构,其内置44GB片上静态随机存取存储器,打破了传统GPU系统的性能瓶颈。
8月13日,OpenAI发布“Ultrafast”超快模式,搭载于旗舰大模型GPT-5.6Sol,速度较标准处理提升14倍,每秒最多生成750个输出标记,并保持原有智能与输出质量。该功能由OpenAI与芯片厂商Cerebras联合开发,目前处于预览阶段,优先向部分企业客户开放,后续随算力扩容逐步推广。
字节跳动火山引擎旗下火山方舟体验中心上线Seedance 2.0 Mini视频生成模型,主打高性价比,近期将开放API服务。该轻量化版本在保持高质量输出的同时,生成速度比同系列标准快速版更快,旨在服务更广泛的视频创作与规模化生产市场。
Google
$0.49
输入tokens/百万
$2.1
输出tokens/百万
1k
上下文长度
Xai
$1.4
$3.5
2k
Openai
$7.7
$30.8
200
$0.7
$2.8
Anthropic
$7
$35
$21
$105
Alibaba
-
$15.8
$12.7
64
Moonshot
$4
$16
256
Bytedance
$10.5
Tencent
$1
32
$0.35
400
magiccodingman
这是一个实验性的混合量化模型,采用MXFP4_MOE混合权重技术,在保持接近Q8精度的同时,实现了更小的文件大小和更高的推理速度。模型探索了MXFP4与高精度嵌入/输出权重的组合,在密集模型上取得了精度近乎无损的优化效果。
这是一个基于Qwen3 4B模型的混合量化版本,采用MXFP4_MOE混合权重技术,在保持近乎无损精度的同时实现了更小的文件大小和更高的推理速度。该模型通过精心组合MXFP4和高精度嵌入/输出权重,达到了接近Q8量化的精度水平,同时具备Q4-Q6级别的吞吐量。