英伟达研究团队实现KV缓存跨模型迁移,让目标模型跳过预填充阶段,转换速度比重新处理上下文快2.7到25倍。KV缓存解释了聊天机器人首词延迟现象:生成第一个词前需预处理全部输入,后续词可复用缓存快速生成,该突破能大幅减少响应等待。
MiniMax发布通用全模态模型H3,首次统一文本、图像、视频、音频的理解与生成,打破视频生成任务割裂,推动从“专用专家”向“通用助手”转型。H3支持原生双声道音视频输出,可生成最高15秒2K分辨率内容,在指令遵循、品牌呈现及视频到视频迁移等方面表现突出。
海光DCU完成万亿参数大模型Kimi K3全栈适配与验证,标志着国产算力首次稳稳支撑此类超大模型。通过底层算子到推理引擎的深度优化,模型无需任何代码改动,迁移成本近乎零,开发者拿到算力即可部署。同时针对KDA注意力与896专家MoE架构实现从容兼容,打破海外旗舰芯片垄断,提供开箱即用的国产方案。
Adobe为旗下实验性iOS相机应用Indigo新增AI功能,通过大语言模型分析照片,提供摄影点评、编辑建议与智能优化。该应用此前已支持专业控制、多帧超分辨率和多种模式,此次添加了照片点评、拍摄与编辑建议、高级物体移除、AI景深生成及风格迁移,强化AI辅助创作。
基于LLM的代理框架,用于在代码库中执行大规模代码迁移。
一种用于控制视频扩散模型运动模式的高效方法,支持运动模式的自定义和迁移。
一种基于潜在扩散模型的自监督层次化化妆迁移技术
基于DIT模型自注意力能力的单概念迁移研究
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$2
$20
$6
$24
dx8152
这是一个基于Qwen-Image-Edit-2509的LoRA微调模型,专门用于解决图像二次光照处理问题。它能够移除原始图像的光照效果,并根据参考图像的光照和色调,为目标图像重新生成逼真的照明和阴影,实现图像风格的迁移与融合。
valiantcat
Qwen-Image-Edit-Cosplay LoRA是基于Qwen-Image-Edit-2509图像编辑模型微调而来的动漫角色装扮迁移模型,专注于将动漫人物的发型、服饰和装饰道具精准迁移到真实人物图像上,同时保持原始人物的面部特征。
XiaomiMiMo
MiMo Audio是一款基于大规模预训练的音频语言模型,在语音智能和音频理解基准测试中取得了开源模型的SOTA性能。该模型展现出强大的少样本学习能力,能够泛化到训练数据中未包含的任务,支持语音转换、风格迁移和语音编辑等多种音频任务。
valentinocc
基于MobileNetV2架构的深度学习模型,专门用于识别和分类120种不同犬种。通过迁移学习技术微调,能够准确识别各类犬种并提供置信度评分。
Chumafly
该模型是基于BERT-uncased微调的功能性/非功能性需求预测模型,在AWS g5实例上使用PROMISE数据集和定制数据进行迁移学习,整体精确率达到97%。
hanxunh
X-TransferBench是一个开源基准测试平台,提供全面的UAPs/TUAPs集合,能够实现跨数据、跨领域、跨模型和跨任务的通用对抗迁移。
Takaharadesu
支持《BanG Dream!》角色对话风格迁移翻译的模型
efficientscaling
Z1是一个基于Qwen2.5-Coder-7B-Instruct的大语言模型,专注于通过思维迁移进行高效推理。
xiaozaa
CATVTON-Flux是一款融合CATVTON与Flux填充修复模型的先进虚拟试衣解决方案,能实现逼真精准的服装迁移效果。
Esperanto
基于LLaVA 7B模型通过皮肤病学图像迁移学习进行微调的版本,专注于皮肤病症诊断
Intel
ZoeDepth是一个用于单目深度估计的视觉模型,在KITTI数据集上进行了微调,能够实现零样本迁移的度量深度估计。
ZoeDepth是一个用于单目深度估计的模型,特别在NYU数据集上进行了微调,能够实现零样本迁移和度量深度估计。
stylellm
基于Yi-6b微调的文本风格迁移模型,能够将输入文本改写为《三国演义》的文学风格
RedHatAI
基于Meta的Llama-2-7B模型,使用UltraChat 200k数据集进行聊天任务微调的语言模型。该模型由Neural Magic和Cerebras联合开发,支持高效的稀疏迁移和推理加速。
tartuNLP
Llammas是基于Llama-2-7B模型适配爱沙尼亚语的开源对话模型,通过两阶段训练实现跨语言知识迁移
facebook
SAM是一个能够通过输入提示点或边界框生成高质量物体掩膜的视觉模型,具备零样本迁移能力。
X-MOD是基于81种语言的多语言掩码语言模型,采用语言特定模块化组件进行预训练,支持跨语言迁移学习。
rifkat
GPTuz是基于GPT-2小型模型的乌兹别克语先进语言模型,通过迁移学习和微调技术训练而成。
keras-io
基于VGG19的图像风格迁移模型,可将艺术风格与内容图像融合生成新图像
pucpr
基于OpenAI GPT-2模型的葡萄牙语生物医学文本生成模型,通过迁移学习与微调技术训练
Jij MCP服务器是一个提供数学优化和量子计算支持的工具平台,集成了JijModeling建模工具和Qiskit量子编程框架,提供代码检查、模型创建、版本迁移指南等功能。
该项目是一个OpenRewrite配方集合,用于自动将Spring Web REST API转换为Spring AI的模型上下文协议(MCP)服务器工具,实现传统API向AI代理可访问工具的迁移。
Neon MCP Server是一个基于Model Context Protocol(MCP)标准的服务器,用于管理大型语言模型(LLMs)与Neon数据库之间的上下文交互。它支持通过自然语言指令执行数据库操作,如创建项目、管理分支、运行SQL查询和迁移等。
Neon MCP Server是一个基于Model Context Protocol(MCP)标准的服务器,用于连接大型语言模型(如Claude)与Neon数据库服务,支持通过自然语言操作数据库项目、分支、表结构及迁移等。