Google เปิดตัว Gemini Omni 1.1 Flash อัปเกรดโมเดลสร้างวิดีโอ ทำงานได้เร็วขึ้นและต้นทุนลดลง

ที่มาภาพ: Blognone

AI-อ่าน 9 นาทีBlognone

Google เปิดตัว Gemini Omni 1.1 Flash อัปเกรดโมเดลสร้างวิดีโอ ทำงานได้เร็วขึ้นและต้นทุนลดลง

⚡ สรุป 30 วิ

Google เปิดตัว Gemini Omni 1.1 Flash โมเดลสร้างวิดีโอที่พัฒนาความสามารถด้าน Context เป็น 10 วินาที และรับอินพุตแบบ Multimodal ได้อย่างแม่นยำ…

ในโลกของการสร้างสรรค์สื่อดิจิทัลที่ขับเคลื่อนด้วยปัญญาประดิษฐ์ (AI) การสร้างวิดีโอคุณภาพสูงที่สม่ำเสมอและมีประสิทธิภาพสูงกลายเป็นหัวใจสำคัญของอุตสาหกรรม การพัฒนาล่าสุดจาก Google ได้เปิดตัวโมเดล Gemini Omni 1.1 Flash ซึ่งเป็นเวอร์ชันอัปเกรดของโมเดลสร้างวิดีโอ Omni เดิม โดยเน้นการปรับปรุงทั้งด้านคุณภาพ ความเร็ว และลดต้นทุนในการใช้งาน ทำให้โมเดลนี้เข้ามามีบทบาทสำคัญในการช่วยให้ทั้งนักออกแบบและนักผลิตคอนเทนต์สามารถเข้าถึงการสร้างสรรค์วิดีโอระดับมืออาชีพได้ง่ายขึ้น โมเดล Omni ถูกออกแบบมาให้เป็นระบบที่รับอินพุตแบบผสมผสาน (Multimodal) อย่างแท้จริง ซึ่งหมายความว่าไม่ว่าจะรับคำสั่งเข้ามาในรูปแบบใด ไม่ว่าจะเป็น ข้อความ (Text), รูปภาพ (Image), หรือวิดีโอ (Video) โมเดลก็สามารถนำข้อมูลเหล่านั้นมาประมวลผลและสร้างผลลัพธ์เป็นวิดีโอที่สมบูรณ์ได้

Overview: การยกระดับความสามารถและเป้าหมายของ Omni 1.1 Flash

Google ได้ปรับปรุง Gemini Omni ให้เป็นเวอร์ชัน 1.1 Flash เพื่อยกระดับขีดความสามารถให้สูงขึ้นอย่างชัดเจน โมเดลนี้ถือเป็นหนึ่งในโมเดลสร้างวิดีโอระดับแนวหน้าของ Google ซึ่งถูกระบุว่ามีประสิทธิภาพเหนือกว่าโมเดลบางตัวที่เน้นเพียงด้านใดด้านหนึ่ง โดยเฉพาะการสร้างวิดีโอที่มีความต่อเนื่องและเป็นธรรมชาติ การอัปเกรดครั้งนี้มุ่งเน้นไปที่การเพิ่มความยืดหยุ่นในการควบคุมผลลัพธ์ รวมถึงการลดอุปสรรคด้านต้นทุนในการเข้าถึงเครื่องมือระดับสูง ซึ่งเดิมทีอาจจำกัดอยู่เฉพาะกลุ่มมืออาชีพเท่านั้น

ความสามารถที่โดดเด่นของ Omni 1.1 Flash คือการรักษา Context หรือบริบทของวิดีโอให้มีความต่อเนื่องสูงมาก นี่คือจุดที่ได้รับการปรับปรุงครั้งใหญ่ เมื่อเทียบกับเวอร์ชัน 1.0 ที่เคยรองรับเพียงบริบทของวินาทีสุดท้ายของวิดีโอแรกเท่านั้น แต่เวอร์ชัน 1.1 ได้ขยายขีดจำกัดนี้ออกไปถึง 10 วินาที ซึ่งช่วยให้นักสร้างสรรค์สามารถกำหนดรายละเอียดการเคลื่อนไหวหรือการเปลี่ยนแปลงภาพที่ต้องการให้เกิดขึ้นในช่วงเวลาที่ยาวนานขึ้นได้ อย่างละเอียด

Advanced Feature: การควบคุมโครงสร้างวิดีโอที่แม่นยำ

การเพิ่มขีดจำกัดของ Context ไม่ได้หมายถึงเพียงแค่การขยายระยะเวลาเท่านั้น แต่ยังรวมถึงการให้เครื่องมือควบคุมที่ละเอียดมากยิ่งขึ้น ผู้ใช้งานสามารถระบุได้อย่างชัดเจนว่าต้องการให้วิดีโอที่สร้างขึ้นมานั้นต้องมี เฟรมแรก และ เฟรมสุดท้าย เป็นอย่างไร โดยให้โมเดลทำหน้าที่สร้างรายละเอียดของเฟรมที่อยู่ตรงกลางเหล่านั้น การทำงานเช่นนี้มีความสำคัญอย่างยิ่งต่อการสร้างฉากที่มีการเคลื่อนไหวที่ราบรื่น (Smooth Transition) หรือการเปลี่ยนภาพจากจุด A ไปยังจุด B ได้อย่างเป็นธรรมชาติ โดยลดความจำเป็นที่ AI จะต้องตีความการเปลี่ยนผ่านเหล่านั้นทั้งหมดด้วยตัวเอง

นอกจากนี้ สำหรับผู้ที่ต้องการทำการทดลองหรือสร้างภาพตัวอย่างก่อนที่จะนำไปใช้งานจริง โมเดลยังเปิดให้ผู้ใช้สามารถสั่งให้สร้างคลิปความละเอียด 360p ออกมาเป็นพรีวิวได้ก่อน ซึ่งเป็นคุณสมบัติที่ช่วยให้ Workflow ในการออกแบบเรื่องราว (Storyboarding) หรือการทดลองแนวคิดใหม่ๆ สามารถทำได้อย่างรวดเร็วและประหยัดทรัพยากรสูงสุด ก่อนที่จะตัดสินใจลงทุนในวิดีโอความละเอียดสูงกว่า

Efficiency Gains: การประหยัดเวลาและต้นทุนในการผลิต

Gemini Omni 1.1 Flash ได้รับการปรับปรุงด้านประสิทธิภาพอย่างก้าวกระโดด โดยทาง Google ระบุว่าโมเดลสามารถทำงานได้รวดเร็วยิ่งขึ้นสูงสุดถึง **60% เมื่อเทียบกับเวอร์ชันก่อนหน้า ความเร็วที่เพิ่มขึ้นนี้เมื่อรวมกับต้นทุนที่ถูกกว่า ทำให้การเข้าถึงเครื่องมือระดับพรีเมียมเป็นไปได้มากขึ้นอย่างที่ไม่เคยมีมาก่อน

จุดที่สร้างความโดดเด่นด้านเศรษฐศาสตร์คือเรื่องของต้นทุน โดยโมเดลนี้สามารถสร้างผลลัพธ์ระดับ 360p ด้วยต้นทุนที่ถูกลงกว่าเดิมถึง 1 ใน 3 เมื่อเทียบกับการสร้างคลิปความละเอียด 720p ทำให้ผู้ที่ต้องผลิตคอนเทนต์จำนวนมาก หรือทำการทดลองด้วย Concept ที่หลากหลาย สามารถบริหารงบประมาณในการผลิตได้อย่างมีประสิทธิภาพยิ่งขึ้น นี่คือการเปลี่ยนแปลงเชิงโครงสร้างที่ช่วยผลักดันให้การสร้างสรรค์วิดีโอด้วย AI ไม่ใช่เรื่องที่ต้องแลกมาด้วยค่าใช้จ่ายที่สูงลิบลิ่วเสมอไป

สำหรับงานระดับมืออาชีพที่ต้องการคุณภาพสูงสุด โมเดลยังรองรับการ อัพสเกลวิดีโอ ให้มีความละเอียดสูงถึง 1080p หรือแม้กระทั่ง 4K ได้ ซึ่งตอบโจทย์งานที่ต้องนำไปใช้ในการเผยแพร่สื่อที่ต้องการความคมชัดสูงได้อย่างสมบูรณ์แบบ

Advanced Application: การใช้ Video Reference สำหรับงานซับซ้อน

ขีดความสามารถที่เพิ่มเข้ามาอีกอย่างหนึ่งคือการรองรับการใช้ **วิดีโอตัวอ้างอิง (Video Reference) โดยผู้ใช้สามารถใส่คลิปวิดีโอที่เป็นตัวอย่างการเคลื่อนไหวหรือสไตล์ที่ต้องการได้ โดยมีความยาวสูงสุดถึง 3 วินาที จุดเด่นคือการที่ผู้ใช้สามารถใส่คลิปวิดีโอตัวอ้างอิงพร้อมกันหลายคลิปได้ ซึ่งเป็นการขยายขีดจำกัดในการป้อนข้อมูลจากเพียงแค่คำสั่งข้อความให้กลายเป็นชุดข้อมูลภาพเคลื่อนไหวที่ซับซ้อน

ยกตัวอย่างเช่น ในงานสร้างสรรค์วิดีโอแนวการ์ตูนที่ต้องการความซับซ้อน โมเดลสามารถนำภาพนิ่งของการ์ตูนมาใช้ร่วมกับคลิปวิดีโอของแดนเซอร์เพื่อจำลองท่าทางให้เกิดขึ้นได้จริงในฉากการ์ตูน ซึ่งเป็นสิ่งที่บ่งชี้ถึงความสามารถในการวิเคราะห์และจำลองการเคลื่อนไหวจากแหล่งข้อมูลที่หลากหลายและซับซ้อนมากๆ ในการสร้างงานที่ต้องการการควบคุมองค์ประกอบหลายอย่างพร้อมกัน (Multi-element control) เช่น การผสมผสานระหว่างภาพกราฟิกกับตัวละครที่เคลื่อนไหวได้จริง

Deployment and Pricing Structure: การเข้าถึงผ่าน API

Gemini Omni 1.1 Flash ถูกเปิดให้ใช้งานผ่าน **Application Programming Interface (API) ซึ่งเป็นการเปิดโอกาสให้บริษัทต่างๆ นักพัฒนา และสตูดิโอสามารถนำพลังการสร้างวิดีโอของ AI นี้ไปผสานเข้ากับระบบและ Workflow ภายในของตัวเองได้โดยตรง การเปิดตัวผ่าน API แสดงให้เห็นถึงการมุ่งเน้นไปที่การใช้งานเชิงพาณิชย์ในวงกว้าง (Enterprise Adoption) ซึ่งจะช่วยให้เกิดการบูรณาการเข้ากับเครื่องมือด้านการผลิตสื่อได้ในทุกระดับ ตั้งแต่การทดลองไอเดียไปจนถึงการผลิตเชิงอุตสาหกรรม

สำหรับโครงสร้างราคาที่ประกาศออกมาคือ 0.03 ดอลลาร์ ต่อวินาที สำหรับการสร้างวิดีโอในความละเอียด 360p ซึ่งเป็นอัตราที่ถูกออกแบบมาเพื่อกระตุ้นให้เกิดการทดลองใช้งานและใช้เป็นรากฐานในการสร้างต้นแบบอย่างรวดเร็ว การกำหนดราคาที่ระดับนี้ถือเป็นปัจจัยสำคัญที่ทำให้ผู้ประกอบการรายย่อยสามารถเข้าถึงการสร้างสรรค์วิดีโอคุณภาพสูงได้โดยมีต้นทุนที่เหมาะสมกับวัตถุประสงค์ทางธุรกิจ

Summary

Gemini Omni 1.1 Flash คือการอัปเกรดที่สำคัญของ Google สำหรับการสร้างวิดีโอ AI ที่เหนือกว่าเดิม ด้วยการขยาย Context เป็น 10 วินาที ทำให้สามารถสร้างการเคลื่อนไหวที่ต่อเนื่องและซับซ้อนได้มากขึ้น นอกจากนี้ยังปรับปรุงด้านประสิทธิภาพ ทำให้สร้างวิดีโอได้รวดเร็วขึ้น 60% และลดต้นทุนลงถึง 1 ใน 3 เหมาะสำหรับการใช้งานทั้งงานต้นแบบไปจนถึงงานระดับมืออาชีพ

แชร์บทความนี้:

ชอบบทความแบบนี้?

สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม

แหล่งข่าวต้นฉบับ

ชื่อต้นฉบับ
กูเกิลออกโมเดลสร้างวิดีโอ Gemini Omni 1.1 Flash ทำคลิป 360p ได้ ราคาถูกลงเหลือ 1/3
ผู้เขียน
mk
แหล่ง
Blognone
วันที่เผยแพร่
29 สิงหาคม 2569 เวลา 08:39
URL ต้นฉบับ
https://www.blognone.com/node/151489

Related

บทความที่เกี่ยวข้อง

Spotify ผสาน Gemini กับแว่น Android XR เพื่อสร้างเพลย์ลิสต์แบบจับภาพอัตโนมัติAI
11 กรกฎาคม 2569 เวลา 14:30

Spotify ผสาน Gemini กับแว่น Android XR เพื่อสร้างเพลย์ลิสต์แบบจับภาพอัตโนมัติ

Spotify กำลังพัฒนา Gemini ให้ทำงานร่วมกับแว่นตา Android XR ของ Google เพื่อสร้างเพลย์ลิสต์ส่วนบุคคลโดยใช้การจับภาพจากกล้อง.…

Android Authority6 นาที
Gmail เปิด AI Inbox ใหม่ ช่วยสรุปเมลและตอบอัตโนมัติอย่างยอดเยี่ยมAI
24 มิถุนายน 2569 เวลา 17:00

Gmail เปิด AI Inbox ใหม่ ช่วยสรุปเมลและตอบอัตโนมัติอย่างยอดเยี่ยม

Google Workspace นำ AI Inbox ที่ใช้โมเดล Gemini มาให้ผู้ใช้สรุปอีเมลและแนะนำการตอบอย่างรวดเร็ว แม้บางครั้งอาจสรุปไม่ครบ แต่ช่วยลดเวลาอ่านเมลอย่างมีนัยสำคัญ

Android Authority7 นาที
Gemini แทน Google Assistant ช่วยให้ระบบ Google Home และอุปกรณ์ Nest ทำงานได้เต็มที่AI
22 มิถุนายน 2569 เวลา 16:30

Gemini แทน Google Assistant ช่วยให้ระบบ Google Home และอุปกรณ์ Nest ทำงานได้เต็มที่

การนำ Gemini มาแทน Google Assistant ใน Google Home ทำให้ระบบสมาร์ทโฮมเสถียรขึ้นและอุปกรณ์ Nest รุ่นเก่ากลับทำงานได้เต็มที่ตามมาตรฐาน Matter…

Android Authority5 นาที
Google เปิดฟีเจอร์ Avatar ของ Gemini ให้สมาชิกพรีเมียมสร้…AI
5 มิถุนายน 2569 เวลา 12:00

Google เปิดฟีเจอร์ Avatar ของ Gemini ให้สมาชิกพรีเมียมสร้…

Google เปิดให้บริการฟีเจอร์ Avatar ของ Gemini‑Omni แก่สมาชิกพรีเมียม ซึ่งผู้ใช้สามารถอัปโหลดภาพและเสียงเพื่อสร้างโคลนดิจิทัลที่พูดและเคลื่อนไหวได้ ระบบใส่…

Android Authority6 นาที
คัดลอกลิงก์แล้ว!