崑崙萬維發佈Mureka V7.6和O2模型,推動AI音樂創作發展。新模型優化用戶體驗和生成效果,引發全球關注。自3月底O1和V6模型上線後,平臺新增近700萬用戶,覆蓋超100個國家。持續迭代的V7系列進一步提升了服務能力。
小米更新超級小愛至v7.8.50版,新增“隨心修圖”功能。用戶可通過自然語言指令,利用AI模型自動修圖,支持多模態交互識別屏幕和攝像頭畫面。操作方式包括在相冊喚醒小愛或通過App上傳照片並輸入文字,系統自動完成色彩增強、背景虛化等處理。
9月24日,阿里巴巴旗下夸克發佈AI創作平臺“造點”,集成AI生圖與生視頻功能,率先接入通義萬相Wan2.5,成爲國內首個支持音畫同步視頻生成的平臺。平臺引入Midjourney V7模型提升圖像生成能力,結合自研技術,爲用戶提供一站式創作體驗。通義萬相Wan2.5的集成是核心亮點,強化了音視頻同步生成效果。
崑崙萬維發佈AI音樂單曲《Digital Heartbeat》,由最新Mureka V7.5模型創作,支持10種語言歌詞,展示AI音樂潛力。該模型於8月15日上線,升級功能包括多語言支持、參考歌曲、自定義歌手和音頻編輯等。
MidAPI.ai提供免費MidJourney API,支持V7等模型生成圖像與視頻。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
$6
$24
$2
$20
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
TheLounger
提供Jib Mix Flux V7 Pixel Heaven - beta模型的GGUF格式量化權重,包含3、4和5比特的'K'量化版本
Yntec
Anything V7 是一個基於穩定擴散技術的文本到圖像生成模型,專注於動漫、動畫和卡通風格的圖像生成。
SimianLuo
潛在一致性模型是從Stable-Diffusion v1-5的Dreamshaper v7微調版本蒸餾而來的文本生成圖像模型,能在極短推理時間內生成高質量圖像。
facebook
基於fairseq S^2的Transformer文本轉語音模型,支持簡體中文,單人女聲,在Common Voice v7和CSS10數據集上訓練。
基於fairseq S^2的Transformer文本轉語音模型,支持土耳其語單說話人男聲,訓練數據來自Common Voice v7。
基於fairseq S²的Transformer文本轉語音模型,支持俄語單說話人男聲,在Common Voice v7上預訓練並在CSS10上微調。