索尼音乐再诉AI音乐公司Udio侵权,指控其未经授权使用超3万段录音训练模型,且仅为已发现违规模板的一小部分。此前Udio曾因版权纠纷被三大唱片公司联合起诉,后与环球、华纳和解。索尼因扩大诉讼范围申请被驳回,故重新提起诉讼。
Meta因内部数据泄露,紧急暂停“模型能力计划”AI训练项目。该项目通过记录员工键盘鼠标数据训练模型,泄露事故致私人对话、绩效数据及语音转文字记录等敏感信息意外公开,公司被迫叫停。
斯坦·李将以AI数字形式“复活”。ElevenLabs获授权,用生成式AI技术还原其声音与形象,深度训练再现其独特幽默,让这位2018年去世的漫威之父重归粉丝身边。
Meta推出“模型能力倡议”(MCI),计划利用员工工作行为数据加速大语言模型训练。CEO扎克伯格和首席AI官宣布新模型“Muse Spark”持续进步,但为加快进程,将整合日常工作数据。
Alibaba
$6
Input tokens/M
$24
Output tokens/M
256
Context Length
$8
$240
52
$2
-
Moonshot
$4
$16
Baidu
32
Chatglm
128
Iflytek
$0.5
Huawei
Tencent
28
Google
$1.6
4
$12
Openai
$3.5
$10.5
16
Minimax
1k
Minthy
RouWei-0.8是基于Illustrious深度再训练的SDXL动漫模型,专注于提升提示遵从性、知识广度和性能表现。
amphion
墨提斯是一个面向统一语音生成的基础模型,采用预训练与微调范式,通过掩码生成建模在大规模无标注语音数据上进行预训练,再通过微调适配多样化语音生成任务。
2121-8
基于parler-tts-large-v1再训练的日语文本转语音模型,可生成高质量日语语音
nota-ai
BK-SDM-v2是通过压缩SD-v2.1-base获得的高效文本到图像合成模型,采用块移除知识蒸馏技术,在有限数据下实现有效的蒸馏再训练,为图像生成提供更轻量化的解决方案。
Cnam-LMSSC
EBEN 是一款针对法语语音的带宽扩展模型,专门用于处理体传导语音传感器(如喉部麦克风)采集的音频。它能够对低频、含噪的体传导语音进行降噪,并从低频内容中再生中高频成分,从而显著提升音频的清晰度和质量。该模型基于特定的非传统传感器数据训练,适用于特定领域内的语音增强任务。
Darna
该模型是基于DeTr架构在5000张表格检测图像上预训练后,再针对特定表格检测任务进行微调的版本
facebook
蒸馏版视觉Transformer模型,先在224x224分辨率下预训练,再于384x384分辨率下在ImageNet-1k上微调,通过蒸馏标记从教师模型中学习。
nielsr
BEiT是一种基于图像变换器的视觉模型,采用类似BERT的自监督预训练方法,先在ImageNet-22k上预训练和微调,再在ImageNet-1k上微调。
mbartolo
基于ELECTRA-Large架构的两阶段训练问答模型,先在合成对抗数据上训练,再在SQuAD和AdversarialQA数据集上微调
一个基于强化学习的智能电商对话代理系统,集成了本体推理、业务工具链、对话记忆和Gradio界面,通过Stable Baselines3 PPO算法实现从数据到训练再到部署的闭环学习,能自主优化购物助手的决策策略。