गूगल डीप माइंड ने अपने शीर्ष की वीडियो बनाने वाले मॉडल वीओ के लिए एक क्रांतिकारी "सटीक संपादन" फ़ंक्शन की घोषणा की है। इस फ़ंक्शन के माध्यम से उपयोगकर्ता आसान टेक्स्ट निर्देशों का उपयोग करके अस्तित्व में वीडियो में वस्तुएं, चरित्र या पृष्ठभूमि वस्तुएं आसानी से जोड़ सकते हैं या हटा सकते हैं, जबकि स्थिति बुद्धिमानी से पुनर्निर्मित की जाती है ताकि भौतिक वास्तविकता और दृश्य संगति सुनिश्चित की जा सके और मूल वीडियो की अखंडता पूरी तरह से बरकरार रखी जा सके।
AIbase के अनुसार, यह अपडेट की वीडियो संपादन के लिए KI के बदलाव को कच्ची जनरेशन से बेहतर संसाधन तक ले जाता है और फ्लो प्लेटफॉर्म पर कलाकारों के लिए उत्पादन दक्षता में महत्वपूर्ण सुधार करता है। Veo के सटीक संपादन फ़ंक्शन Veo3.1 सुधार का हिस्सा है और खास तौर पर Google के KI फिल्म टूल फ्लो के लिए विकसित किया गया है। इसका उपयोग उन्नत जनरेटिव KI एल्गोरिदम करता है जो प्रकाश अनुपात, अनुपात, वस्तु अंतःक्रिया और गति पथ को ध्यान में रखते हुए बिना बुराई के संशोधन प्राप्त करते हैं।
उदाहरण के लिए, उपयोगकर्ता निर्देश दे सकते हैं, "इस सीन में एक पीला स्कूल बस जोड़ें" या "सड़क के किनारे एक पैदल यात्री हटाएं", और मॉडल स्वचालित रूप से पृष्ठभूमि भरता है, छाया को समायोजित करता है और एक संगत कैमरा गति बनाए रखता है, जिससे सामान्य समस्याओं जैसे "छवि झंकार" या सामान्य सॉफ्टवेयर में होने वाले अस्वाभाविक ट्रेस को बचा जा सकता है। डेमो वीडियो में फ़ंक्शन ने स्थिर छवि से गतिशील बहु-कैमरा सीन तक पूरी प्रक्रिया दिखाई, जिससे उपयोगकर्ता कुछ सेकंड में अपने सामग्री के आसपास घूम सकते हैं, बिना फिर से शूट किए या हाथ से मास्क बनाए।
AIbase के विश्लेषण के अनुसार, Veo3.1 के मुख्य नवाचार में सुधार ऑडियो सिंक्रनाइजेशन, मल्टी-प्रॉम्प्ट सीन बनाना और मूल 1080p आउटपुट शामिल हैं, जहां वीडियो की लंबाई एक मिनट तक बढ़ाई जा सकती है। इस तरह, सटीक संपादन केवल छोटे फिल्म निर्माताओं के लिए उपयुक्त नहीं है, बल्कि विज्ञापन, मार्केटिंग और व्यवसायिक प्रशिक्षण के लिए भी है। उदाहरण के लिए, उपयोगकर्ता फ्लो में "घटक" (जैसे पूर्व निर्धारित चरित्र या शैली संदर्भ) अपलोड कर सकते हैं और फिर सटीक संपादन के माध्यम से सीन विस्तारित कर सकते हैं, जिससे एकल छवि से पूर्ण स्टोरीबोर्ड तक स्वचालित संक्रमण प्राप्त किए जा सकते हैं। पिछले संस्करण Veo3 की तुलना में, इस संस्करण में चरित्र संगति और कथा नियंत्रण 30% से अधिक सुधार हुआ है, जबकि बेंचमार्क परीक्षणों में 95% के संपादन सटीकता दर दर्शाई गई है, जो OpenAI के Sora2 के समान उत्पादों की तुलना में बहुत अच्छा है। "सटीक संपादन वास्तव में KI वीडियो निर्माण को ऐसा बनाता है जिसका उपयोग कोई भी व्यक्ति पेशेवर क्षमता के बिना कर सकता है।"




