NVIDIA推出Nemotron3Embed嵌入向量模型系列,專爲生產級RAG、智能體檢索、代碼檢索和記憶場景設計。8B版本在RTEB基準測試中排名第一,成爲性能最強的開源嵌入模型。系列包含三個開放檢查點:精度優先的Nemotron-3-Embed-8B-BF16、輕量化的1B-BF16版,以及針對Blackwell架構優化的1B-NVFP4四比特版本,所有模型均採用雙向注意力機制。
6月29日,英偉達宣佈微軟Azure全面上線Anthropic的Claude系列大模型。部署基於最新的GB300 Blackwell Ultra超級芯片,旨在爲開發者和企業提供頂級推理能力。此舉再次凸顯算力架構升級對AI應用落地的關鍵作用,也標誌着微軟AI生態建設邁出重要一步。
Anthropic的Claude模型已在微軟Azure面向企業全面開放,部署採用英偉達最新Blackwell Ultra GB300 GPU平臺,整合GB300NVL72系統。此舉標誌着企業級AI代理應用邁入高性能算力支撐的新階段。
特斯拉下一代AI5芯片已完成流片,預計2027年量產,將接替AI4成爲自動駕駛和人形機器人的核心算力平臺。其單芯片性能媲美英偉達Hopper架構,雙芯配置表現更優。
NVIDIA GeForce RTX 5070 Ti顯卡,採用Blackwell架構,支持DLSS 4技術,為遊戲和創作帶來強大性能。
開創計算新時代的NVIDIA Blackwell平臺現已發佈
mratsim
GLM-4.5-Iceblink-v2-106B-A12B-FP8是基於GLM-4.5-Iceblink-v2-106B-A12B模型,採用最先進的混合專家量化方法進行FP8量化的版本。該模型專門針對支持硬件FP8的Ada、Hopper或Blackwell系列GPU優化,在保持高質量輸出的同時顯著提升推理效率。
QuantStack
這是基於Danrisi的Flux架構文本到圖像模型UltraReal Fine-Tune的Nunchaku量化(SVDQ)版本。該模型提供了兩種量化格式:INT4適用於非Blackwell架構GPU(50系列之前),NVFP4適用於Blackwell架構GPU(50系列),旨在降低硬件需求同時保持圖像生成質量。
spooknik
這是UltraReal Fine-Tune模型的SVDQ量化版本,由Danrisi基於Flux開發,是一款文本到圖像生成模型。該版本提供了多種量化方案,適配不同GPU硬件,特別針對非Blackwell系列和Blackwell系列GPU進行了優化。
這是Project0模型的SVDQ量化版本,基於Flux Dev和Flux Krea創建的文本到圖像模型。該模型提供了多種量化格式,針對不同GPU架構進行了優化,包括INT4和FP4量化版本,適用於Blackwell和非Blackwell GPU用戶。