ブラックフォレストラボがFlux3マルチモーダルモデルを発表。20秒のネイティブ音声映像同期生成を初めてサポート
ドイツの新興企業ブラックフォレスト・ラボが、Self-Flowアーキテクチャを採用したマルチモーダル基盤モデルFlux3を発表。画像、動画、音声、動作のコーデックを統合し、物理環境とデジタル環境の統一的理解と生成を実現。初のネイティブ音声生成対応モデルとして、20秒の音声同期動画を一度に出力可能。テキスト、画像、動画からの動画変換やキーフレーム駆動生成にも対応し、生成動画技術を大きく前進させる。....