
ที่มาภาพ: VentureBeat
LTX‑2.5 สร้างวิดีโอ AI 10 วินาทีจากภาพภายใน 6.8 วินาทีบนชิป NVIDIA GB200
⚡ สรุป 30 วิ
LTX‑2.5 ของ LTX เปิดโมเดล open‑weights ที่สร้างวิดีโอ AI 10 วินาทีจากภาพเดียวภายใน 6.8 วินาทีบนชิป NVIDIA GB200. โมเดลรองรับการปรับแต่งผ่าน ComfyUI…
LTX บริษัทผู้พัฒนาโมเดล “open‑world” ที่แยกออกมาจาก Lighttricks เพิ่งเปิดตัว LTX‑2.5 รุ่นล่าสุดที่ให้การสร้างวิดีโอ AI ความยาว 10 วินาทีจากภาพเดียวได้ภายใน 6.8 วินาทีบนชิป NVIDIA GB200 ซึ่งเป็นความเร็วที่เหนือกว่าคู่แข่งหลายราย นอกจากนี้โมเดลยังเปิดน้ำหนัก (open‑weights) บน Hugging Face และรวมเข้ากับเครื่องมือสร้างสรรค์แบบโหนด ComfyUI ทำให้ผู้พัฒนาสามารถใช้งานได้โดยตรง ทั้งบนคลาวด์และอุปกรณ์ท้องถิ่น
Overview
LTX‑2.5 เป็นการปรับโครงสร้างขั้นตอนการผลิตวิดีโอใหม่ทั้งหมด แทนการเพียงเพิ่มฟีเจอร์เข้าไปในรุ่นเก่า การเปิดน้ำหนักทำให้ผู้ใช้สามารถดาวน์โหลดโมเดลได้ฟรีหากบริษัทมีรายได้ต่อปีต่ำกว่า 10 ล้านดอลลาร์ และต้องต่อรองสัญญาไลเซนส์สำหรับองค์กรขนาดใหญ่ ตามข้อมูลจาก LTX โมเดลของตระกูลนี้ได้รับการดาวน์โหลดแล้วกว่า 33 ล้านครั้ง ทำให้เป็นชุดโมเดล “open‑world” ที่ใช้งานมากที่สุดในตลาด
Technical Highlights
หนึ่งในจุดเด่นสำคัญคือ diffusion video decoder ใหม่ที่ช่วยลด artefacts ในฉากเคลื่อนไหวสูงและรักษารายละเอียดเช่น ตัวอักษรและใบหน้าได้ดีขึ้น โดยยังคงอัตราการบีบอัดของ LTX ไว้เหมือนเดิม นอกจากนี้โมเดลรองรับ multishot generation ที่สร้างลำดับภาพต่อเนื่องเป็นผลลัพธ์เดียว ทำให้ตัวละคร ฉาก และเสียงสอดคล้องกันตลอดการเปลี่ยนช็อต
โมเดลยังใช้ Gemma 4 language backbone เฉพาะและมี prompt enhancer เพื่อจัดการกับพรอมต์หลายหัวข้อได้แม่นยำขึ้น อีกทั้งมี checkpoint ที่ฝึกมาเพื่องานด้าน AI ฟิสิกส์และหุ่นยนต์ ทำให้ทีมพัฒนาสามารถ fine‑tune บนข้อมูลเฉพาะโดเมนที่ไม่เหมือนวิดีโอภาพยนตร์ทั่วไป
Performance Benchmarks
ตามการทดสอบของ LTX การสร้างคลิป 10 วินาที ความละเอียด 720p ใช้เวลา 6.8 วินาที บนสองชิป NVIDIA GB200 ซึ่งเทียบกับ API ของบริษัทเองที่ใช้ 23.7 วินาที ที่ความละเอียด 1080p ตัวเลขเปรียบเทียบกับโมเดลอื่น ๆ มีดังนี้
- Google Gemini Omni Flash: 52 วินาที
- xAI Grok 1.5: 63 วินาที
- Google Veo 3.1 (8‑วินาที): 70 วินาที
- MiniMax H3: 180 วินาที
- ByteDance Seedance 2.5: 317 วินาที
- Kuaishou Kling 3.0 Pro: 398 วินาที
ในด้านคุณภาพ LTX‑2.5 ได้รับผลการทดสอบแบบ blind test ที่ให้ผู้ประเมินเลือกวีดีโอที่ชอบจากหลายโมเดล โดยได้ **อัตราชนะ 67 % เหนือ Seedance 2.5 (65 %) และ Gemini Omni Flash (55 %) อย่างไรก็ตามตัวเลขเหล่านี้เป็นผลการทดสอบโดย LTX เองและยังไม่ได้รับการตรวจอิสระ
Business Model & Licensing
LTX เปิดน้ำหนักโมเดลให้ใช้ฟรีแก่บริษัทที่มี ARR < 10 ล้านดอลลาร์ เพื่อสนับสนุนการพัฒนาเทคโนโลยีในระดับ SME ส่วนองค์กรใหญ่ต้องต่อรองสัญญาไลเซนส์ การเปิดน้ำหนักช่วยให้ลูกค้าสามารถปรับแต่งโมเดลบนข้อมูลของตนเองได้โดยไม่จำกัดจาก API ปิด เช่น Google หรือ ByteDance ที่ไม่มีตัวเลือกการ fine‑tune
บริษัทยังเสนอการใช้ผ่าน API สำหรับทีมที่ต้องการโซลูชันแบบจัดการ (managed) โดยค่าใช้จ่ายต่อภาพจะต่ำกว่าโมเดลคู่แข่งประมาณหนึ่ง‑แปดของต้นทุนและหนึ่ง‑เจ็ดของเวลาเรนเดอร์ ทั้งนี้ LTX‑2.5 รองรับ GPU ที่มี VRAM ขั้นต่ำ 16 GB ทำให้สามารถใช้งานได้บนเซิร์ฟเวอร์ศูนย์ข้อมูล, edge device หรือแม้แต่บนเครื่อง Mac
Industry Impact
CEO ของ LTX Zeev Farbman กล่าวว่าการเปิดน้ำหนักเป็นการตอบสนองต่อแนวโน้มของอุตสาหกรรมที่มุ่งไปสู่โมเดลปิดและ API‑only “เราเริ่มพัฒนาโมเดลของเราเองเพราะเมื่อ Sora เปิดตัว เราเห็นว่าผู้เล่นใหญ่กำลังปิดโมเดลของตน และการทำงานผ่าน API ไม่ตอบโจทย์หลายธุรกิจ” เขาเน้นว่าอุตสาหกรรมวิดีโอและ world‑model มี surface area การใช้งานที่กว้างกว่า LLM จึงต้องการการเข้าถึงน้ำหนักโมเดลเพื่อสร้าง workflow ที่เหมาะกับงานเฉพาะ
ด้วยความเร็วที่เหนือกว่าและข้อได้เปรียบด้านการปรับแต่ง LTX‑2.5 มีศักยภาพในการกระตุ้นการแข่งขันระหว่างผู้ให้บริการแบบเปิดและปิด โดยอาจทำให้บริษัทขนาดกลางถึงเล็กสามารถสร้างสรรค์เนื้อหา AI ที่ซับซ้อนได้โดยไม่ต้องพึ่งพา API ของยักษ์ใหญ่ นอกจากนี้การรวมเข้ากับ ComfyUI ทำให้เครื่องมือโปรโตไทป์สำหรับสื่อเชิงสร้างสรรค์เป็นมาตรฐานใหม่ในวงการ
Summary
LTX‑2.5 เปิดตัวพร้อมคุณสมบัติการเรนเดอร์วิดีโอ AI ที่เร็วกว่าและมีคุณภาพดีกว่าโมเดลคู่แข่งหลายรุ่น พร้อมเปิดน้ำหนักให้ผู้พัฒนาใช้งานฟรีภายใต้เงื่อนไขรายได้ต่ำ การตัดสินใจเน้นความเป็น open‑weights และการรวมกับ ComfyUI อาจเปลี่ยนโฉมหน้าตลาดวิดีโอ AI โดยเพิ่มตัวเลือกแก่ธุรกิจที่ต้องการควบคุมและปรับแต่งโมเดลของตนเอง.
แชร์บทความนี้:
ชอบบทความแบบนี้?
สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม
แหล่งข่าวต้นฉบับ
- ชื่อต้นฉบับ
- LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it's open weights
- ผู้เขียน
- [email protected] (Carl Franzen)
- แหล่ง
- VentureBeat
- วันที่เผยแพร่
- 11 สิงหาคม 2569 เวลา 20:00



