Claude Opus5模型展現強大的代碼生成能力,開發者用同一條提示詞讓其直接生成射擊、潛艇、賽車及沙盒等多款遊戲。整個過程無需任何外部素材,模型可直接輸出幾何結構、紋理、物理效果與音樂,全部在瀏覽器中運行,顛覆傳統依賴資源庫的遊戲開發模式。
谷歌地球推出基於Nano Banana2模型的AI圖像生成功能,融合衛星、航空與3D實景地圖。網頁端用戶可放大目標區域,輸入描述指令,直接在真實地理數據上視覺重塑現實地點。
谷歌將AI圖像生成模型Nano Banana2集成至Google Earth網頁版,向全球用戶開放。該功能融合衛星影像、航拍與3D地形數據,用戶在任意地點輸入場景描述,即可自動生成高精度可視化圖像。
谷歌DeepMind推出GenCeption模型,將視頻生成AI逆向改造爲視覺分析引擎,單一模型即可同時完成深度估計、圖像分割、3D姿態估計等五項核心視覺任務。模型基於阿里通義萬相Wan2.1框架訓練,一次前向傳播實現預測,打破任務孤立格局。
V2Fun的AI 3D創作平臺,可從文本或圖像生成3D模型、角色、遊戲資源和動畫。
AI 3D工具,可從文本或圖像快速創建、動畫高質量3D模型
一款通過文本提示詞或圖像在線生成高質量3D模型的AI工具。
Tripo AI 3D 模型生成器可將文本和圖片幾秒內轉為可用於生產的3D模型。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$6
$24
256
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
$2
HIT-TMG
Uni-MoE 2.0-Omni 是荔枝科技(Lychee)推出的完全開源全模態模型,採用全模態 3D RoPE 和動態容量專家混合架構,顯著提升了以語言為中心的多模態理解、推理和生成能力。該版本集成了全模態理解以及音頻和圖像生成能力。
GatorBarbarian
TRELLIS Text XL是一個大型3D生成模型,是TRELLIS的文本條件版本,模型大小為XL。該模型基於論文《Structured 3D Latents for Scalable and Versatile 3D Generation》提出,能夠根據文本描述生成高質量的3D內容。
Ashmotv
animat3d_style_wan-lora是基於AI Toolkit by Ostris訓練的LoRA模型,專門用於文本到視頻生成,可為圖像生成帶來獨特的3D動畫風格效果。該模型基於Wan2.2-T2V-A14B基礎模型進行微調,支持多種主流AI平臺使用。
manycore-research
FLUX.1-Layout-ControlNet是SpatialGen框架的關鍵組件,是一個基於語義圖像條件化的ControlNet模型。它能夠根據文本描述生成2D圖像,同時嚴格遵循輸入語義圖像的佈局約束,主要用於3D室內場景合成。
lhjiang
AnySplat是一種先進的3D高斯散點渲染模型,能夠從不同視角的圖像高效生成高質量的3D場景。該模型具有快速推理能力和良好的泛化性能,為3D重建和渲染提供了創新的解決方案。
tencent
混元3D-2是一款支持圖像到3D、文本到3D轉換的工具,為3D內容生成提供了強大的解決方案。
shakamone
TRELLIS是一個基於圖像條件的大型3D生成模型,採用結構化3D潛變量實現可擴展與多功能的3D生成。
davidleiva4999
TRELLIS的文本條件版本,採用XL大模型規模,是一款強大的3D生成模型。
ImrozeAslamMalik
LGM是一個整合了多視角擴散模型的圖像轉3D工作流,能夠從單張圖像生成高質量3D內容。
ImrozeAslam
混元3D 2.0是一個先進的大規模3D合成系統,用於生成高分辨率帶紋理的3D資產。
Surn
TRELLIS圖像條件版本是一個大型3D生成模型,能夠從圖像生成3D內容。
larsquaedvlieg
TRELLIS是一個基於文本條件的大型3D生成模型,採用結構化3D潛變量實現可擴展與多功能的3D內容生成。
TRELLIS是一個大型3D生成模型,通過結構化3D潛變量實現可擴展與多功能的3D內容生成。
TRELLIS文本XL模型是一個大型3D生成模型,能夠根據文本描述生成3D內容。
multimodalart
FLUX.1-dev是一個基於通量模型的文本生成圖像模型,支持LoRA技術和擴散模型架構,專注於生成等距視角的3D圖標。
MonsterMMORPG
TRELLIS圖像條件版本是一個大型3D生成模型,能夠根據輸入的2D圖像生成對應的3D模型。
jetx
TRELLIS的條件圖像版本,一個大型3D生成模型,能夠從2D圖像生成3D內容。
gordon-0115
一個實驗性的自然語言到3D模型生成流程,基於改進的預訓練多視角擴散模型
Borcherding
基於FLUX.1-dev模型的LoRA適配器,專為生成標誌、圖標和表情符號設計,支持微軟FluentUI風格等多種3D渲染效果。
kvuong2711
AerialMegaDepth是一個專注於空地重建與視角合成的深度學習模型,能夠從航拍圖像中重建3D場景並生成新視角。
Tripo MCP Server是一個連接AI助手與Tripo AI的接口項目,支持通過自然語言生成3D資產並導入Blender。
Tripo MCP Server是一個連接AI助手與Tripo AI的接口工具,支持通過自然語言生成3D資產並導入Blender。
MCP STL 3D浮雕生成器是一個將2D圖像轉換為3D浮雕模型的工具,支持控制模型尺寸、添加基座和深度反轉等功能,適合3D打印和渲染。
Trellis MCP是一個連接AI助手與Trellis 3D生成模型的接口服務,支持通過自然語言快速生成3D資產並導入Blender。該項目基於開源模型,需自行部署API後端,具有快速、免費的特點,但存在穩定性風險。
SMMS項目構建了一個基於語義地圖的MCP服務器,提供3D實例對象管理功能,包括數據庫操作、RAG檢索和認知拓撲圖生成。
Unity AI ProBuilder是一個基於MCP協議的AI驅動3D建模工具,通過自然語言命令在Unity編輯器中創建和編輯可編輯網格,支持快速原型設計和程序化幾何生成。
遊戲資產生成器利用AI模型和MCP協議,通過文本提示快速生成2D和3D遊戲資源。
GH_mcp_server是一個通過LLM直接與Rhino和Grasshopper交互的工具,支持分析3DM文件、3D建模及自動生成Grasshopper的GHPython代碼。
GH_mcp_server是一個通過LLMs直接與Rhino和Grasshopper交互的工具,支持分析3dm文件、3D建模及自動生成GHPython代碼。
一個基於Model Context Protocol的交互式數據可視化服務器,提供關係圖、散點圖、3D可視化等多種圖表生成功能,支持自動保存和即時顯示。
OpenSCAD MCP服務器是一個通過文本或圖像生成參數化3D模型的服務,支持多視角重建、AI圖像生成、遠程CUDA處理和工作流審批,最終輸出OpenSCAD兼容的模型文件。
一個基於OpenSCAD的MCP服務器,通過AI生成多視角圖像並重建為參數化3D模型,支持遠程CUDA加速處理。
一個利用AI生成遊戲資源的工具,支持2D和3D資源創建,集成Hugging Face和MCP協議。
TRELLIS Blender插件將先進的文本/圖像生成3D模型功能集成到Blender中,支持通過文本或圖像生成帶紋理的3D網格,並提供細節調整功能。插件還集成了MCP服務,可與Cursor/Windsurf等工具通信。
OpenSCAD MCP服務器是一個通過文本或圖像生成參數化3D模型的工具,支持多視角重建和遠程處理。
該項目是一個連接Claude桌面應用與Unreal Engine 5.3的Python服務器,通過文本指令實現3D場景的創建與編輯,支持基礎物體生成、藍圖調用和場景操作等功能。
VGGT-MPS是基於蘋果芯片優化的3D視覺重建工具,使用Metal Performance Shaders加速,能夠從單張或多張圖像生成深度圖、相機姿態和3D點雲,支持稀疏注意力實現城市級重建。
Poly.Pizza MCP服務器是一個將免費低多邊形3D模型直接導入Unity項目的工具,支持模型搜索、批量導入、自動生成預製體和記錄版權信息。
一個結合3D卡通圖像生成與文件系統管理的專業服務器,提供基於Gemini AI的高質量3D卡通生成和安全的文件操作功能。
Ludo AI MCP服務器是一個通過模型上下文協議(MCP)提供AI生成遊戲資產(如圖像、3D模型、動畫、音頻)的服務,支持與Claude Desktop和Cursor等客戶端集成。