AIBase
首页
AI 资讯
AI 产品库
GEO 平台
MCP 服务
模型算力广场
ZH

AI资讯

查看更多

AMD 推出 vLLM-ATOM 插件,深度优化国产大模型推理表现

AMD发布vLLM-ATOM插件,旨在不改变现有工作流的前提下,充分挖掘硬件潜力,为DeepSeek-R1、Kimi-K2等主流大语言模型推理显著提速。vLLM本身是优化高并发场景吞吐量与显存利用率的开源框架,专注请求调度和缓存管理,ATOM插件则进一步强化了这一能力。

16.4k 5 天前
AMD 推出 vLLM-ATOM 插件,深度优化国产大模型推理表现

加速国产大模型:AMD推出vLLM-ATOM插件大幅提升推理效率

AMD发布vLLM-ATOM插件,专为大语言模型部署优化,在不改变现有工作流下,显著提升DeepSeek-R1、Kimi-K2等国产大模型在AMD硬件上的推理性能。该插件针对Instinct系列GPU定制,利用vLLM框架的高显存利用率优势,让开发者以低学习成本实现技术迁移,获得性能平滑升级。

22.9k 3 天前
加速国产大模型:AMD推出vLLM-ATOM插件大幅提升推理效率
AIBase
智启未来,您的人工智能解决方案智库
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商务合作网站地图