谷歌将AI图像生成模型Nano Banana2集成至Google Earth网页版,向全球用户开放。该功能融合卫星影像、航拍与3D地形数据,用户在任意地点输入场景描述,即可自动生成高精度可视化图像。
Roblox发布AI创作工具Build并升级Studio体系,利用人工智能降低开发门槛,用户通过文本提示可直接生成可编辑游戏内容。该功能7月28日开启测试,深化“用户生成内容”理念。平台日活已达1.32亿,Build为移动优先工具,让创作随时随地进行。
高德发布ABot-World Studio,融合交互式视频生成与3D场景构建,用户输入文字或图片即可一键生成高保真、可实时交互的AI数字世界。其技术突破在于支持单张5090显卡本地部署,并打破以往世界模型推理时长限制,实现更低门槛高效创作。
高德发布ABot-World Studio通用世界模型工坊,首度将交互视频生成与3DGS场景生成合一。用户输入文图即可生成可交互分享的AI世界,支持导出视频与3DGS文件。能单卡RTX 5090本地部署,架构不设推理限制。
1.3B参数的图像转视频模型,用于生成3D一致的新场景视图
通过多实例扩散模型将单张图像生成高保真度的3D场景。
生成任何3D和4D场景的先进框架
从文本描述生成高质量的3D室内场景。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
Baidu
128
$6
$24
256
Bytedance
$1.2
$3.6
4
$2
manycore-research
FLUX.1-Layout-ControlNet是SpatialGen框架的关键组件,是一个基于语义图像条件化的ControlNet模型。它能够根据文本描述生成2D图像,同时严格遵循输入语义图像的布局约束,主要用于3D室内场景合成。
lhjiang
AnySplat是一种先进的3D高斯散点渲染模型,能够从不同视角的图像高效生成高质量的3D场景。该模型具有快速推理能力和良好的泛化性能,为3D重建和渲染提供了创新的解决方案。
kvuong2711
AerialMegaDepth是一个专注于空地重建与视角合成的深度学习模型,能够从航拍图像中重建3D场景并生成新视角。
VAST-AI
MIDI是一款面向单图像生成组合式3D场景的生成模型。
Kai422kx
DAS3R是一种用于静态场景重建的3D模型,采用动态感知高斯泼溅技术,能够从图像生成高质量的3D重建效果。
strangerzonehf
基于LoRA微调的3D萌系卡通风格文本生成图像模型,可生成高质量的3D卡通角色和场景
基于LoRA微调的文本生成图像扩散模型,专注于生成等轴测3D风格的场景和物体
WizWhite
一个用于生成纸质微缩模型的LoRA模型,擅长创作平面纸板场景和3D纸质物件,具有复古风格。
davizca87
Coinmaker是一款专门用于生成硬币资产的LORA模型,基于SDXL 0.9训练而成。它能让电子游戏、渲染等场景中的硬币资产创建变得更加轻松、有趣且美观,尤其适用于3D投影和3D软件中的挤压建模。
该项目是一个连接Claude桌面应用与Unreal Engine 5.3的Python服务器,通过文本指令实现3D场景的创建与编辑,支持基础物体生成、蓝图调用和场景操作等功能。