AIBase
首頁
AI 資訊
AI 產品庫
GEO 平台
MCP 服务
模型算力廣場
TW

AI資訊

查看更多

AMD 推出 vLLM-ATOM 插件,深度優化國產大模型推理表現

AMD發佈vLLM-ATOM插件,旨在不改變現有工作流的前提下,充分挖掘硬件潛力,爲DeepSeek-R1、Kimi-K2等主流大語言模型推理顯著提速。vLLM本身是優化高併發場景吞吐量與顯存利用率的開源框架,專注請求調度和緩存管理,ATOM插件則進一步強化了這一能力。

16.4k 1 天前
AMD 推出 vLLM-ATOM 插件,深度優化國產大模型推理表現

加速國產大模型:AMD推出vLLM-ATOM插件大幅提升推理效率

AMD發佈vLLM-ATOM插件,專爲大語言模型部署優化,在不改變現有工作流下,顯著提升DeepSeek-R1、Kimi-K2等國產大模型在AMD硬件上的推理性能。該插件針對Instinct系列GPU定製,利用vLLM框架的高顯存利用率優勢,讓開發者以低學習成本實現技術遷移,獲得性能平滑升級。

22.9k 6 小時前
加速國產大模型:AMD推出vLLM-ATOM插件大幅提升推理效率
AIBase
智啟未來,您的人工智能解決方案智庫
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商務合作網站地圖