ByteDance傘下の即夢AIがSeedance 2.5モデルを導入し、MayaやBlender向けプラグインなど専門ツールを同時公開。一般向けクリエイティブプラットフォームからプロの映像・3D制作への転換を加速。動画生成の長さが30秒に倍増。....
Google EarthがNano Banana2モデルを活用したAI画像生成機能を導入。衛星・航空・3Dマップを融合し、Web上でエリアを拡大し指示を入力すると、実際の地理データ上で場所を視覚的に再構築可能。....
グーグルはAI画像生成モデルであるナノバナナ2をGoogle Earthのウェブ版に統合し、世界中のユーザーに公開しました。この機能は衛星画像、航空写真、3D地形データを統合しており、ユーザーは任意の場所でシーンの説明を入力するだけで、高精度なビジュアル画像を自動生成できます。
Google DeepMindがGenCeptionを発表。動画生成AIを逆転させ、単一モデルで深度推定・画像分割・3D姿勢推定など5つの視覚タスクを同時実行。AlibabaのWan2.1フレームワークで訓練し、1回の順伝播で予測可能。タスクの分断を打破。....
無料の画像とテキストから3Dモデルを生成するツールで、登録不要で1分で結果が得られます。
AI 3Dモデル生成器で、テキストや画像から印刷可能な3Dモデルを生成できます。
無料のAI 3Dモデル生成ツールで、テキストや画像を瞬時に3Dモデルに変換でき、多くの分野のクリエイターに適しています。
V2FunのAI 3D創作プラットフォームは、テキストや画像から3Dモデル、キャラクター、ゲームアセット、アニメーションを生成します。
Google
$0.49
入力トークン/百万
$2.1
出力トークン/百万
1k
コンテキスト長
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
Baidu
128
$6
$24
$2
$20
$4
$16
HIT-TMG
Uni-MoE 2.0-Omniは、ライチ科技(Lychee)が発表した完全オープンソースの全モーダリティモデルで、全モーダリティ3D RoPEと動的容量エキスパート混合アーキテクチャを採用し、言語を中心としたマルチモーダリティ理解、推論、生成能力を大幅に向上させました。このバージョンには、全モーダリティ理解とオーディオおよび画像生成能力が統合されています。
GatorBarbarian
TRELLIS Text XLは大型の3D生成モデルで、TRELLISのテキスト条件付きバージョンで、モデルサイズはXLです。このモデルは論文「Structured 3D Latents for Scalable and Versatile 3D Generation」に基づいて提案され、テキスト記述に基づいて高品質の3Dコンテンツを生成することができます。
Ashmotv
animat3d_style_wan-loraは、OstrisによるAIツールキットを基にトレーニングされたLoRAモデルで、テキストからビデオへの生成に特化しており、画像生成に独特な3Dアニメーションスタイルの効果をもたらします。このモデルはWan2.2 - T2V - A14Bベースモデルを基に微調整されており、複数の主流のAIプラットフォームで使用できます。
manycore-research
FLUX.1-Layout-ControlNetはSpatialGenフレームワークの重要なコンポーネントで、セマンティック画像条件付きのControlNetモデルです。これはテキスト記述に基づいて2D画像を生成することができ、同時に入力されたセマンティック画像のレイアウト制約を厳密に遵守し、主に3D室内シーン合成に使用されます。
lhjiang
AnySplatは、高度な3Dガウス散点レンダリングモデルで、異なる視点の画像から効率的に高品質の3Dシーンを生成することができます。このモデルは、高速推論能力と良好な汎化性能を持ち、3D再構築とレンダリングに革新的な解決策を提供します。
shakamone
TRELLISは画像条件に基づく大規模3D生成モデルで、構造化された3D潜在変数を使用してスケーラブルで多機能な3D生成を実現します。
davidleiva4999
TRELLISのテキスト条件付きバージョンで、XL大規模モデルを採用した強力な3D生成モデルです。
ImrozeAslamMalik
LGMはマルチビュー拡散モデルを統合した画像から3Dへのワークフローで、単一画像から高品質な3Dコンテンツを生成できます。
Surn
TRELLIS画像条件バージョンは、画像から3Dコンテンツを生成できる大規模3D生成モデルです。
larsquaedvlieg
TRELLISはテキスト条件付きの大規模3D生成モデルで、構造化された3D潜在変数を使用してスケーラブルで多機能な3Dコンテンツ生成を実現します。
TRELLISは構造化3D潜在変数を用いて、スケーラブルで多機能な3Dコンテンツ生成を実現する大規模3D生成モデルです。
TRELLISテキストXLモデルは、テキスト記述に基づいて3Dコンテンツを生成できる大規模3D生成モデルです。
multimodalart
FLUX.1-devはフラックスモデルをベースにしたテキストから画像を生成するモデルで、LoRA技術と拡散モデルアーキテクチャをサポートし、等距離視点の3Dアイコン生成に特化しています。
MonsterMMORPG
TRELLIS画像条件バージョンは、入力された2D画像に対応する3Dモデルを生成できる大規模3D生成モデルです。
jetx
TRELLISの条件付き画像バージョンで、2D画像から3Dコンテンツを生成できる大規模3D生成モデルです。
gordon-0115
実験的な自然言語から3Dモデル生成のプロセスで、改良された事前学習済みマルチビュー拡散モデルに基づく
Borcherding
FLUX.1-devモデルを基にしたLoRAアダプターで、ロゴ、アイコン、絵文字の生成に特化しており、マイクロソフトFluentUIスタイルを含む様々な3Dレンダリング効果をサポートします。
kvuong2711
AerialMegaDepthは航空写真からの3Dシーン再構築と新規視点生成に特化した深層学習モデルです。
VAST-AI
TripoSG-scribbleは、落書き画像とテキストプロンプトから迅速に3Dモデルを生成するAIツールで、TripoSGのバリエーションであり、クリエイティブデザインや迅速なプロトタイピングに適しています。
cavargas10
テキスト条件付きの大規模3D生成モデルで、XLスケールのアーキテクチャを採用し、テキスト記述に基づいて3Dコンテンツを生成可能
Trellis MCPはAIアシスタントとTrellis 3D生成モデルをつなぐインターフェースサービスで、自然言語で迅速に3Dアセットを生成してBlenderにインポートできます。このプロジェクトはオープンソースモデルに基づいており、APIバックエンドを自分でデプロイする必要があり、高速で無料という特徴がありますが、安定性のリスクがあります。
MCP STL 3Dレリーフ生成器は、2D画像を3Dレリーフモデルに変換するツールで、モデルのサイズ制御、ベースの追加、深度反転などの機能に対応し、3D印刷やレンダリングに適しています。
ゲームアセット生成ツールはAIモデルとMCPプロトコルを利用し、テキストプロンプトによって迅速に2Dおよび3Dゲームリソースを生成します。
OpenSCAD MCPサーバーは、テキストまたは画像からパラメトリック3Dモデルを生成するツールで、多視点再構築とリモート処理をサポートします。
GH_mcp_serverはLLMを通じて直接RhinoとGrasshopperと対話できるツールで、3DMファイルの分析、3Dモデリング、GrasshopperのGHPythonコードの自動生成をサポートします。
OpenSCADに基づくMCPサーバーで、AIを通じて多視点画像を生成し、パラメトリック3Dモデルに再構成し、リモートCUDAアクセラレーション処理をサポートしています。
GH_mcp_serverは、LLMsを通じて直接RhinoとGrasshopperと対話できるツールで、3dmファイルの分析、3Dモデリング、GHPythonコードの自動生成をサポートします。
TRELLIS Blenderプラグインは、高度なテキスト/画像から3Dモデルを生成する機能をBlenderに統合します。テキストまたは画像を通じてテクスチャ付きの3Dメッシュを生成し、詳細調整機能も提供します。プラグインはMCPサービスも統合しており、Cursor/Windsurfなどのツールと通信できます。
OpenSCAD MCPサーバーは、テキストまたは画像からパラメトリック3Dモデルを生成するサービスで、多視点再構成、AI画像生成、リモートCUDA処理、ワークフロー承認をサポートし、最終的にOpenSCAD互換のモデルファイルを出力します。
Unity AI ProBuilderは、MCPプロトコルに基づくAI駆動の3Dモデリングツールで、自然言語コマンドを使用してUnityエディタで編集可能なメッシュを作成および編集し、迅速なプロトタイプ設計とプロシージャルなジオメトリ生成をサポートします。
Ludo AI MCPサーバーは、モデルコンテキストプロトコル(MCP)を介してAI生成ゲームアセット(画像、3Dモデル、アニメーション、オーディオなど)を提供するサービスで、Claude DesktopやCursorなどのクライアントとの統合をサポートしています。
Poly.Pizza MCPサーバーは、無料の低ポリゴン3Dモデルを直接Unityプロジェクトにインポートするツールで、モデル検索、一括インポート、自動プレハブ生成、著作権情報の記録をサポートします。
Meshy AI MCPサーバーは、Meshy AI APIとやり取りするためのモデルコンテキストプロトコルサーバーで、テキストや画像から3Dモデルを生成し、テクスチャを適用し、モデルを再メッシュ化するなどの機能を提供します。