
ที่มาภาพ: Blognone
Google เปิดตัว Gemini Omni 1.1 Flash อัปเกรดโมเดลสร้างวิดีโอ ทำงานได้เร็วขึ้นและต้นทุนลดลง
⚡ สรุป 30 วิ
Google เปิดตัว Gemini Omni 1.1 Flash โมเดลสร้างวิดีโอที่พัฒนาความสามารถด้าน Context เป็น 10 วินาที และรับอินพุตแบบ Multimodal ได้อย่างแม่นยำ…
ในโลกของการสร้างสรรค์สื่อดิจิทัลที่ขับเคลื่อนด้วยปัญญาประดิษฐ์ (AI) การสร้างวิดีโอคุณภาพสูงที่สม่ำเสมอและมีประสิทธิภาพสูงกลายเป็นหัวใจสำคัญของอุตสาหกรรม การพัฒนาล่าสุดจาก Google ได้เปิดตัวโมเดล Gemini Omni 1.1 Flash ซึ่งเป็นเวอร์ชันอัปเกรดของโมเดลสร้างวิดีโอ Omni เดิม โดยเน้นการปรับปรุงทั้งด้านคุณภาพ ความเร็ว และลดต้นทุนในการใช้งาน ทำให้โมเดลนี้เข้ามามีบทบาทสำคัญในการช่วยให้ทั้งนักออกแบบและนักผลิตคอนเทนต์สามารถเข้าถึงการสร้างสรรค์วิดีโอระดับมืออาชีพได้ง่ายขึ้น โมเดล Omni ถูกออกแบบมาให้เป็นระบบที่รับอินพุตแบบผสมผสาน (Multimodal) อย่างแท้จริง ซึ่งหมายความว่าไม่ว่าจะรับคำสั่งเข้ามาในรูปแบบใด ไม่ว่าจะเป็น ข้อความ (Text), รูปภาพ (Image), หรือวิดีโอ (Video) โมเดลก็สามารถนำข้อมูลเหล่านั้นมาประมวลผลและสร้างผลลัพธ์เป็นวิดีโอที่สมบูรณ์ได้
Overview: การยกระดับความสามารถและเป้าหมายของ Omni 1.1 Flash
Google ได้ปรับปรุง Gemini Omni ให้เป็นเวอร์ชัน 1.1 Flash เพื่อยกระดับขีดความสามารถให้สูงขึ้นอย่างชัดเจน โมเดลนี้ถือเป็นหนึ่งในโมเดลสร้างวิดีโอระดับแนวหน้าของ Google ซึ่งถูกระบุว่ามีประสิทธิภาพเหนือกว่าโมเดลบางตัวที่เน้นเพียงด้านใดด้านหนึ่ง โดยเฉพาะการสร้างวิดีโอที่มีความต่อเนื่องและเป็นธรรมชาติ การอัปเกรดครั้งนี้มุ่งเน้นไปที่การเพิ่มความยืดหยุ่นในการควบคุมผลลัพธ์ รวมถึงการลดอุปสรรคด้านต้นทุนในการเข้าถึงเครื่องมือระดับสูง ซึ่งเดิมทีอาจจำกัดอยู่เฉพาะกลุ่มมืออาชีพเท่านั้น
ความสามารถที่โดดเด่นของ Omni 1.1 Flash คือการรักษา Context หรือบริบทของวิดีโอให้มีความต่อเนื่องสูงมาก นี่คือจุดที่ได้รับการปรับปรุงครั้งใหญ่ เมื่อเทียบกับเวอร์ชัน 1.0 ที่เคยรองรับเพียงบริบทของวินาทีสุดท้ายของวิดีโอแรกเท่านั้น แต่เวอร์ชัน 1.1 ได้ขยายขีดจำกัดนี้ออกไปถึง 10 วินาที ซึ่งช่วยให้นักสร้างสรรค์สามารถกำหนดรายละเอียดการเคลื่อนไหวหรือการเปลี่ยนแปลงภาพที่ต้องการให้เกิดขึ้นในช่วงเวลาที่ยาวนานขึ้นได้ อย่างละเอียด
Advanced Feature: การควบคุมโครงสร้างวิดีโอที่แม่นยำ
การเพิ่มขีดจำกัดของ Context ไม่ได้หมายถึงเพียงแค่การขยายระยะเวลาเท่านั้น แต่ยังรวมถึงการให้เครื่องมือควบคุมที่ละเอียดมากยิ่งขึ้น ผู้ใช้งานสามารถระบุได้อย่างชัดเจนว่าต้องการให้วิดีโอที่สร้างขึ้นมานั้นต้องมี เฟรมแรก และ เฟรมสุดท้าย เป็นอย่างไร โดยให้โมเดลทำหน้าที่สร้างรายละเอียดของเฟรมที่อยู่ตรงกลางเหล่านั้น การทำงานเช่นนี้มีความสำคัญอย่างยิ่งต่อการสร้างฉากที่มีการเคลื่อนไหวที่ราบรื่น (Smooth Transition) หรือการเปลี่ยนภาพจากจุด A ไปยังจุด B ได้อย่างเป็นธรรมชาติ โดยลดความจำเป็นที่ AI จะต้องตีความการเปลี่ยนผ่านเหล่านั้นทั้งหมดด้วยตัวเอง
นอกจากนี้ สำหรับผู้ที่ต้องการทำการทดลองหรือสร้างภาพตัวอย่างก่อนที่จะนำไปใช้งานจริง โมเดลยังเปิดให้ผู้ใช้สามารถสั่งให้สร้างคลิปความละเอียด 360p ออกมาเป็นพรีวิวได้ก่อน ซึ่งเป็นคุณสมบัติที่ช่วยให้ Workflow ในการออกแบบเรื่องราว (Storyboarding) หรือการทดลองแนวคิดใหม่ๆ สามารถทำได้อย่างรวดเร็วและประหยัดทรัพยากรสูงสุด ก่อนที่จะตัดสินใจลงทุนในวิดีโอความละเอียดสูงกว่า
Efficiency Gains: การประหยัดเวลาและต้นทุนในการผลิต
Gemini Omni 1.1 Flash ได้รับการปรับปรุงด้านประสิทธิภาพอย่างก้าวกระโดด โดยทาง Google ระบุว่าโมเดลสามารถทำงานได้รวดเร็วยิ่งขึ้นสูงสุดถึง **60% เมื่อเทียบกับเวอร์ชันก่อนหน้า ความเร็วที่เพิ่มขึ้นนี้เมื่อรวมกับต้นทุนที่ถูกกว่า ทำให้การเข้าถึงเครื่องมือระดับพรีเมียมเป็นไปได้มากขึ้นอย่างที่ไม่เคยมีมาก่อน
จุดที่สร้างความโดดเด่นด้านเศรษฐศาสตร์คือเรื่องของต้นทุน โดยโมเดลนี้สามารถสร้างผลลัพธ์ระดับ 360p ด้วยต้นทุนที่ถูกลงกว่าเดิมถึง 1 ใน 3 เมื่อเทียบกับการสร้างคลิปความละเอียด 720p ทำให้ผู้ที่ต้องผลิตคอนเทนต์จำนวนมาก หรือทำการทดลองด้วย Concept ที่หลากหลาย สามารถบริหารงบประมาณในการผลิตได้อย่างมีประสิทธิภาพยิ่งขึ้น นี่คือการเปลี่ยนแปลงเชิงโครงสร้างที่ช่วยผลักดันให้การสร้างสรรค์วิดีโอด้วย AI ไม่ใช่เรื่องที่ต้องแลกมาด้วยค่าใช้จ่ายที่สูงลิบลิ่วเสมอไป
สำหรับงานระดับมืออาชีพที่ต้องการคุณภาพสูงสุด โมเดลยังรองรับการ อัพสเกลวิดีโอ ให้มีความละเอียดสูงถึง 1080p หรือแม้กระทั่ง 4K ได้ ซึ่งตอบโจทย์งานที่ต้องนำไปใช้ในการเผยแพร่สื่อที่ต้องการความคมชัดสูงได้อย่างสมบูรณ์แบบ
Advanced Application: การใช้ Video Reference สำหรับงานซับซ้อน
ขีดความสามารถที่เพิ่มเข้ามาอีกอย่างหนึ่งคือการรองรับการใช้ **วิดีโอตัวอ้างอิง (Video Reference) โดยผู้ใช้สามารถใส่คลิปวิดีโอที่เป็นตัวอย่างการเคลื่อนไหวหรือสไตล์ที่ต้องการได้ โดยมีความยาวสูงสุดถึง 3 วินาที จุดเด่นคือการที่ผู้ใช้สามารถใส่คลิปวิดีโอตัวอ้างอิงพร้อมกันหลายคลิปได้ ซึ่งเป็นการขยายขีดจำกัดในการป้อนข้อมูลจากเพียงแค่คำสั่งข้อความให้กลายเป็นชุดข้อมูลภาพเคลื่อนไหวที่ซับซ้อน
ยกตัวอย่างเช่น ในงานสร้างสรรค์วิดีโอแนวการ์ตูนที่ต้องการความซับซ้อน โมเดลสามารถนำภาพนิ่งของการ์ตูนมาใช้ร่วมกับคลิปวิดีโอของแดนเซอร์เพื่อจำลองท่าทางให้เกิดขึ้นได้จริงในฉากการ์ตูน ซึ่งเป็นสิ่งที่บ่งชี้ถึงความสามารถในการวิเคราะห์และจำลองการเคลื่อนไหวจากแหล่งข้อมูลที่หลากหลายและซับซ้อนมากๆ ในการสร้างงานที่ต้องการการควบคุมองค์ประกอบหลายอย่างพร้อมกัน (Multi-element control) เช่น การผสมผสานระหว่างภาพกราฟิกกับตัวละครที่เคลื่อนไหวได้จริง
Deployment and Pricing Structure: การเข้าถึงผ่าน API
Gemini Omni 1.1 Flash ถูกเปิดให้ใช้งานผ่าน **Application Programming Interface (API) ซึ่งเป็นการเปิดโอกาสให้บริษัทต่างๆ นักพัฒนา และสตูดิโอสามารถนำพลังการสร้างวิดีโอของ AI นี้ไปผสานเข้ากับระบบและ Workflow ภายในของตัวเองได้โดยตรง การเปิดตัวผ่าน API แสดงให้เห็นถึงการมุ่งเน้นไปที่การใช้งานเชิงพาณิชย์ในวงกว้าง (Enterprise Adoption) ซึ่งจะช่วยให้เกิดการบูรณาการเข้ากับเครื่องมือด้านการผลิตสื่อได้ในทุกระดับ ตั้งแต่การทดลองไอเดียไปจนถึงการผลิตเชิงอุตสาหกรรม
สำหรับโครงสร้างราคาที่ประกาศออกมาคือ 0.03 ดอลลาร์ ต่อวินาที สำหรับการสร้างวิดีโอในความละเอียด 360p ซึ่งเป็นอัตราที่ถูกออกแบบมาเพื่อกระตุ้นให้เกิดการทดลองใช้งานและใช้เป็นรากฐานในการสร้างต้นแบบอย่างรวดเร็ว การกำหนดราคาที่ระดับนี้ถือเป็นปัจจัยสำคัญที่ทำให้ผู้ประกอบการรายย่อยสามารถเข้าถึงการสร้างสรรค์วิดีโอคุณภาพสูงได้โดยมีต้นทุนที่เหมาะสมกับวัตถุประสงค์ทางธุรกิจ
Summary
Gemini Omni 1.1 Flash คือการอัปเกรดที่สำคัญของ Google สำหรับการสร้างวิดีโอ AI ที่เหนือกว่าเดิม ด้วยการขยาย Context เป็น 10 วินาที ทำให้สามารถสร้างการเคลื่อนไหวที่ต่อเนื่องและซับซ้อนได้มากขึ้น นอกจากนี้ยังปรับปรุงด้านประสิทธิภาพ ทำให้สร้างวิดีโอได้รวดเร็วขึ้น 60% และลดต้นทุนลงถึง 1 ใน 3 เหมาะสำหรับการใช้งานทั้งงานต้นแบบไปจนถึงงานระดับมืออาชีพ
แชร์บทความนี้:
ชอบบทความแบบนี้?
สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม
แหล่งข่าวต้นฉบับ
- ชื่อต้นฉบับ
- กูเกิลออกโมเดลสร้างวิดีโอ Gemini Omni 1.1 Flash ทำคลิป 360p ได้ ราคาถูกลงเหลือ 1/3
- ผู้เขียน
- mk
- แหล่ง
- Blognone
- วันที่เผยแพร่
- 29 สิงหาคม 2569 เวลา 08:39
- URL ต้นฉบับ
- https://www.blognone.com/node/151489



