腾讯将海外大模型品牌“混元”简化为“Tencent HY”,以优化国际品牌标识。此举与新版发布同步,12月5日推出的Tencent HY2.0已率先应用于腾讯AI应用如元宝和im。
腾讯混元开源10亿参数OCR模型HunyuanOCR,基于多模态架构,在多项任务中实现领先性能,支持多场景文字识别应用。
腾讯发布1B参数开源模型HunyuanOCR,基于混元多模态架构,在OCR应用中达到SOTA水平。模型采用端到端设计,一次推理即可获得最优结果,包含原生分辨率视频编码器、自适应视觉适配和轻量化混元语言三大核心组件。
腾讯混元开源10亿参数OCR模型HunyuanOCR,采用端到端设计,集成视频编码器、视觉适配器和轻量化语言模型,在多项榜单获SOTA成绩,以体积小、部署便捷为核心优势,提供高效OCR解决方案。
HunyuanVideo-I2V 是腾讯推出的基于 HunyuanVideo 的图像到视频生成框架。
Hunyuan3D 2.0 是腾讯推出的高分辨率 3D 资产生成系统,基于大规模扩散模型。
Bytedance
-
Input tokens/M
Output tokens/M
Context Length
Tencent
$1
$4
32
24
Alibaba
$0.7
$1.95
16
$0.8
$2
$0.5
224
$3
$9
4
$8
28
$2.4
$9.6
$1.5
$6
128
30
$12
250
$18
6
jayn7
本项目提供了腾讯HunyuanVideo-1.5-I2V-720p模型的量化GGUF版本,专门用于图像转视频和视频生成任务。该模型支持将静态图像转换为高质量视频内容,提供了多种量化版本以优化性能。
Mungert
Hunyuan-MT-7B是腾讯推出的7B参数翻译模型,支持33种语言的互译,包括5种中国少数民族语言。该模型在WMT25比赛中表现出色,在31个语言类别中的30个类别获得第一名,提出了从预训练到集成优化的完整翻译模型训练框架。
mradermacher
基于腾讯 Hunyuan-MT-Chimera-7B 的多语言翻译模型的量化版本,提供多种量化精度选择,支持36种语言的翻译任务,包括主流和小众语言,为多语言交流提供高效工具。
hunyuanvideo-community
腾讯HunyuanVideo-I2V是一个基于Diffusers的图像转视频模型,能够将静态图像转换为动态视频。
jbilcke-hf
SkyReels-V1-Hunyuan-I2V是由腾讯SkyworkAI开发的文本生成视频模型,基于Hunyuan架构,支持从文本输入生成视频内容。