索尼PS6迎來技術變革,爆料稱其將融合視頻幀插補、獨家超分辨率算法與AI光線追蹤,藉助AI幀生成等黑科技,目標在4K分辨率下實現120幀超高流暢度體驗。
即夢AI網頁版6月23日上線原生4K功能,核心突破在於直接在生成階段以4K渲染,而非後期低分辨率放大。這項技術路徑創新從源頭保留了高密度細節,使人物髮絲、服裝紋理、建築線條等精細元素得到更完整清晰的呈現,標誌其視頻生成品質的關鍵提升。
AI設計平臺Lovart推出Touch Edit觸控功能,公測48小時吸引超10萬創作者。該功能通過快捷鍵自動識別並鎖定髮絲、服飾等元素,用戶只需用自然語言描述修改需求,即可在4K分辨率下即時完成融合,無需手動操作。同時支持多圖上傳,系統自動編輯混搭。
谷歌於12月1日推出Gemini 3大模型,接入搜索AI模式,覆蓋近120個國家地區,向AI Pro與Ultra訂閱用戶開放。同時上線Nano Banana Pro圖像模型,支持2K/4K分辨率、精準文本渲染及專業級攝影控制,定價1080p爲0.139美元、4K爲0.24美元。Gemini 3採用原生多模態架構,統一處理文本、圖像、音頻和視頻。
一款支持多模態輸入、可單次生成30秒原生4K畫質及同步音頻的AI視頻生成器。
Wan 2.7 AI視頻製作器,4K分辨率,30秒片段,原生音頻與唇形同步。
veo 4 是一款支持 4K 分辨率、原生音頻同步及角色一致性的生成式 AI 視頻製作工具。
OpenAI推出的GPT Image 2,可生成4K視覺效果,文字準確率高。
Alibaba
$1
輸入tokens/百萬
$10
輸出tokens/百萬
256
上下文長度
Bytedance
-
$1.8
$5.4
16
Baidu
32
$3
$9
$1.5
$4.5
128
Huawei
Google
$0.14
$0.28
131
$0.35
$0.7
Chatglm
4
Minimax
Tencent
$3.5
$7
Mungert
GLM-4.1V-9B-Thinking是基於GLM-4-9B-0414基礎模型開發的視覺語言推理模型,專注於圖像文本到文本轉換,在複雜多模態任務中表現出色,支持64K長上下文和4K分辨率圖像處理,提供中英雙語支持。
THUDM
GLM-4.1V-9B-Thinking是基於GLM-4-9B-0414基礎模型的開源視覺語言模型,專注於提升複雜任務中的推理能力,支持64k上下文長度和4K圖像分辨率。
zai-org
GLM-4.1V-9B-Base是智譜AI開發的開源視覺語言基礎模型,擁有90億參數,專注於多模態推理能力,支持中英雙語,處理高達4K分辨率的圖像和64K上下文長度。
Efficient-Large-Model
Sana是一個高效生成4K分辨率圖像的文本生成圖像框架,能夠快速合成高分辨率、高質量且文本-圖像對齊性強的圖像,並可在筆記本電腦GPU上部署。
depth-anything
Prompt Depth Anything 是一種高分辨率且精確的度量深度估計方法,通過提示(prompting)釋放深度基礎模型的潛力,能夠生成高達4K分辨率的精確度量深度。
internlm
InternLM-XComposer2-4KHD是基於InternLM2的通用視覺語言大模型,具備4K分辨率圖像理解能力。
Banana Image MCP是一個基於MCP協議的AI圖像生成服務器,讓Claude等助手能夠使用Google Gemini模型生成高質量圖像,支持4K分辨率和智能模型選擇。