Adobe爲旗下實驗性iOS相機應用Indigo新增AI功能,通過大語言模型分析照片,提供攝影點評、編輯建議與智能優化。該應用此前已支持專業控制、多幀超分辨率和多種模式,此次添加了照片點評、拍攝與編輯建議、高級物體移除、AI景深生成及風格遷移,強化AI輔助創作。
索尼PS6迎來技術變革,爆料稱其將融合視頻幀插補、獨家超分辨率算法與AI光線追蹤,藉助AI幀生成等黑科技,目標在4K分辨率下實現120幀超高流暢度體驗。
軟通動力聯合MULEI STUDIO發佈“美通 AI”視覺模型,專爲B端商業場景設計,旨在解決大屏內容製作成本高、更新難、同質化問題。該模型在分辨率上實現重大突破,滿足巨幅顯示需求,推動商用視覺內容創作的技術革新。
LG在CES2026前發佈全新UltraGear evo系列電競顯示器,全線採用5K超高分辨率,並首次搭載專爲遊戲的AI像素超分技術,引領電競顯示進入AI時代。系列包含39英寸5K2K OLED、32英寸5K Mini-LED及27英寸5K OLED三款旗艦型號,均支持高刷新率與先進顯示技術,兼顧遊戲性能與專業創作需求。
HiPixel 是一款用於 AI 驅動的圖像超分辨處理的 macOS 桌面客戶端應用。
一種無混疊的任意尺度超分辨率方法。
AI驅動的視頻音頻增強解決方案,提供視頻超分辨率、降噪、音頻上混等功能。
STAR是一種用於真實世界視頻超分辨率的時空增強框架,首次將強大的文本到視頻擴散先驗集成到真實世界視頻超分辨率中。
Xai
$1.4
輸入tokens/百萬
$3.5
輸出tokens/百萬
2k
上下文長度
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
$1
$10
256
Bytedance
-
$0.8
$2
128
Baidu
32
Tencent
$4
$8
$0.3
Google
$140
$280
$0.5
224
$1.5
$4.5
vafipas663
基於Qwen-Image-Edit-2509的圖像超分辨率LoRA模型,專門用於提升低質量圖像的分辨率和視覺效果。該模型在攝影風格的圖像上表現出色,能夠處理多種圖像退化問題。
lmms-lab
LLaVA-OneVision-1.5 是一系列完全開源的大型多模態模型,通過在原生分辨率圖像上進行訓練,以較低的成本實現了先進的性能。該模型在多個多模態基準測試中展現出卓越性能,超越了Qwen2.5-VL等競爭對手。
Lightricks
基於擴散模型的視頻空間分辨率增強工具,專門針對LTX視頻模型生成的潛在視頻表示進行超分辨率訓練
XiangZ
HiT-SR是一種提升基於變換器的超分辨率方法的通用策略,通過改進現有模型結構,在降低計算負擔的同時實現更優的超分辨率性能。
osunlp
Qwen2-VL是Qwen-VL模型系列的最新迭代,具備全分辨率圖像理解、超長視頻解析和多語言圖文識別能力。
3587jjh
一種通過像素級分類實現計算資源自適應分配的高效圖像超分辨率方法
Yntec
真實視界 v1.3 是一個基於穩定擴散技術的文本生成圖像模型,專注於生成超寫實、寫實和半寫實風格的圖像。該模型支持768x768分辨率,強調構圖自由和創造力。
NVEagle
鷹(Eagle)是一系列以視覺為中心的高分辨率多模態大語言模型,支持超過1K的輸入分辨率,在光學字符識別和文檔理解等任務上表現出色。
fal
基於GAN的超分辨率技術,用於提升生成圖像的質量
xinsir
基於Stable Diffusion XL的ControlNet Tile模型,專注於圖像細節修復、變體生成和超分辨率處理
Ketansomewhere
這是一個無條件生成肺部超聲圖像的擴散模型,能夠生成720x720分辨率的醫學影像。
Xenova
基於GAN的4倍超分辨率圖像放大模型,兼容Transformers.js
dataautogpt3
TempestV0.1是一款高性能文本生成圖像模型,基於超過600萬張高質量圖像數據集訓練,支持超高分辨率圖像生成。
輕量級的Swin2SR圖像超分辨率模型,可將圖像分辨率提升2倍
基於Swin2SR架構的壓縮圖像超分辨率模型,可將圖像分辨率提升4倍
基於Swin2SR架構的經典圖像超分辨率模型,可將圖像分辨率提升4倍
基於Swin2SR架構的經典圖像超分辨率模型,可將圖像分辨率提升2倍
LongSafari
HyenaDNA是一個長距離基因組基礎模型,在高達100萬個標記的上下文長度上以單核苷酸分辨率進行預訓練。該模型使用Hyena算子替代傳統注意力機制,實現了次二次計算複雜度,能夠處理超長DNA序列。
radames
基於擴散模型的文本引導潛在超分辨率工具,可將低分辨率圖像提升4倍分辨率
lllyasviel
ControlNet v1.1 是一個通過添加額外條件來控制預訓練大型擴散模型的神經網絡結構,特別適用於基於瓦片圖像條件的圖像生成和超分辨率任務。
一個基於Stable Diffusion WebUI API的文本生成圖像MCP服務器
這是一個基於Runway API的MCP服務器項目,允許用戶通過Claude Desktop調用Runway的各種AI生成功能,包括視頻生成、圖像生成、視頻編輯和超分辨率等工具。