LTX‑2.5 สร้างวิดีโอ AI 10 วินาทีจากภาพภายใน 6.8 วินาทีบนชิป NVIDIA GB200

ที่มาภาพ: VentureBeat

AI-อ่าน 6 นาทีVentureBeat

LTX‑2.5 สร้างวิดีโอ AI 10 วินาทีจากภาพภายใน 6.8 วินาทีบนชิป NVIDIA GB200

⚡ สรุป 30 วิ

LTX‑2.5 ของ LTX เปิดโมเดล open‑weights ที่สร้างวิดีโอ AI 10 วินาทีจากภาพเดียวภายใน 6.8 วินาทีบนชิป NVIDIA GB200. โมเดลรองรับการปรับแต่งผ่าน ComfyUI…

LTX บริษัทผู้พัฒนาโมเดล “open‑world” ที่แยกออกมาจาก Lighttricks เพิ่งเปิดตัว LTX‑2.5 รุ่นล่าสุดที่ให้การสร้างวิดีโอ AI ความยาว 10 วินาทีจากภาพเดียวได้ภายใน 6.8 วินาทีบนชิป NVIDIA GB200 ซึ่งเป็นความเร็วที่เหนือกว่าคู่แข่งหลายราย นอกจากนี้โมเดลยังเปิดน้ำหนัก (open‑weights) บน Hugging Face และรวมเข้ากับเครื่องมือสร้างสรรค์แบบโหนด ComfyUI ทำให้ผู้พัฒนาสามารถใช้งานได้โดยตรง ทั้งบนคลาวด์และอุปกรณ์ท้องถิ่น

Overview

LTX‑2.5 เป็นการปรับโครงสร้างขั้นตอนการผลิตวิดีโอใหม่ทั้งหมด แทนการเพียงเพิ่มฟีเจอร์เข้าไปในรุ่นเก่า การเปิดน้ำหนักทำให้ผู้ใช้สามารถดาวน์โหลดโมเดลได้ฟรีหากบริษัทมีรายได้ต่อปีต่ำกว่า 10 ล้านดอลลาร์ และต้องต่อรองสัญญาไลเซนส์สำหรับองค์กรขนาดใหญ่ ตามข้อมูลจาก LTX โมเดลของตระกูลนี้ได้รับการดาวน์โหลดแล้วกว่า 33 ล้านครั้ง ทำให้เป็นชุดโมเดล “open‑world” ที่ใช้งานมากที่สุดในตลาด

Technical Highlights

หนึ่งในจุดเด่นสำคัญคือ diffusion video decoder ใหม่ที่ช่วยลด artefacts ในฉากเคลื่อนไหวสูงและรักษารายละเอียดเช่น ตัวอักษรและใบหน้าได้ดีขึ้น โดยยังคงอัตราการบีบอัดของ LTX ไว้เหมือนเดิม นอกจากนี้โมเดลรองรับ multishot generation ที่สร้างลำดับภาพต่อเนื่องเป็นผลลัพธ์เดียว ทำให้ตัวละคร ฉาก และเสียงสอดคล้องกันตลอดการเปลี่ยนช็อต

โมเดลยังใช้ Gemma 4 language backbone เฉพาะและมี prompt enhancer เพื่อจัดการกับพรอมต์หลายหัวข้อได้แม่นยำขึ้น อีกทั้งมี checkpoint ที่ฝึกมาเพื่องานด้าน AI ฟิสิกส์และหุ่นยนต์ ทำให้ทีมพัฒนาสามารถ fine‑tune บนข้อมูลเฉพาะโดเมนที่ไม่เหมือนวิดีโอภาพยนตร์ทั่วไป

Performance Benchmarks

ตามการทดสอบของ LTX การสร้างคลิป 10 วินาที ความละเอียด 720p ใช้เวลา 6.8 วินาที บนสองชิป NVIDIA GB200 ซึ่งเทียบกับ API ของบริษัทเองที่ใช้ 23.7 วินาที ที่ความละเอียด 1080p ตัวเลขเปรียบเทียบกับโมเดลอื่น ๆ มีดังนี้

  • Google Gemini Omni Flash: 52 วินาที
  • xAI Grok 1.5: 63 วินาที
  • Google Veo 3.1 (8‑วินาที): 70 วินาที
  • MiniMax H3: 180 วินาที
  • ByteDance Seedance 2.5: 317 วินาที
  • Kuaishou Kling 3.0 Pro: 398 วินาที

ในด้านคุณภาพ LTX‑2.5 ได้รับผลการทดสอบแบบ blind test ที่ให้ผู้ประเมินเลือกวีดีโอที่ชอบจากหลายโมเดล โดยได้ **อัตราชนะ 67 % เหนือ Seedance 2.5 (65 %) และ Gemini Omni Flash (55 %) อย่างไรก็ตามตัวเลขเหล่านี้เป็นผลการทดสอบโดย LTX เองและยังไม่ได้รับการตรวจอิสระ

Business Model & Licensing

LTX เปิดน้ำหนักโมเดลให้ใช้ฟรีแก่บริษัทที่มี ARR < 10 ล้านดอลลาร์ เพื่อสนับสนุนการพัฒนาเทคโนโลยีในระดับ SME ส่วนองค์กรใหญ่ต้องต่อรองสัญญาไลเซนส์ การเปิดน้ำหนักช่วยให้ลูกค้าสามารถปรับแต่งโมเดลบนข้อมูลของตนเองได้โดยไม่จำกัดจาก API ปิด เช่น Google หรือ ByteDance ที่ไม่มีตัวเลือกการ fine‑tune

บริษัทยังเสนอการใช้ผ่าน API สำหรับทีมที่ต้องการโซลูชันแบบจัดการ (managed) โดยค่าใช้จ่ายต่อภาพจะต่ำกว่าโมเดลคู่แข่งประมาณหนึ่ง‑แปดของต้นทุนและหนึ่ง‑เจ็ดของเวลาเรนเดอร์ ทั้งนี้ LTX‑2.5 รองรับ GPU ที่มี VRAM ขั้นต่ำ 16 GB ทำให้สามารถใช้งานได้บนเซิร์ฟเวอร์ศูนย์ข้อมูล, edge device หรือแม้แต่บนเครื่อง Mac

Industry Impact

CEO ของ LTX Zeev Farbman กล่าวว่าการเปิดน้ำหนักเป็นการตอบสนองต่อแนวโน้มของอุตสาหกรรมที่มุ่งไปสู่โมเดลปิดและ API‑only “เราเริ่มพัฒนาโมเดลของเราเองเพราะเมื่อ Sora เปิดตัว เราเห็นว่าผู้เล่นใหญ่กำลังปิดโมเดลของตน และการทำงานผ่าน API ไม่ตอบโจทย์หลายธุรกิจ” เขาเน้นว่าอุตสาหกรรมวิดีโอและ world‑model มี surface area การใช้งานที่กว้างกว่า LLM จึงต้องการการเข้าถึงน้ำหนักโมเดลเพื่อสร้าง workflow ที่เหมาะกับงานเฉพาะ

ด้วยความเร็วที่เหนือกว่าและข้อได้เปรียบด้านการปรับแต่ง LTX‑2.5 มีศักยภาพในการกระตุ้นการแข่งขันระหว่างผู้ให้บริการแบบเปิดและปิด โดยอาจทำให้บริษัทขนาดกลางถึงเล็กสามารถสร้างสรรค์เนื้อหา AI ที่ซับซ้อนได้โดยไม่ต้องพึ่งพา API ของยักษ์ใหญ่ นอกจากนี้การรวมเข้ากับ ComfyUI ทำให้เครื่องมือโปรโตไทป์สำหรับสื่อเชิงสร้างสรรค์เป็นมาตรฐานใหม่ในวงการ

Summary

LTX‑2.5 เปิดตัวพร้อมคุณสมบัติการเรนเดอร์วิดีโอ AI ที่เร็วกว่าและมีคุณภาพดีกว่าโมเดลคู่แข่งหลายรุ่น พร้อมเปิดน้ำหนักให้ผู้พัฒนาใช้งานฟรีภายใต้เงื่อนไขรายได้ต่ำ การตัดสินใจเน้นความเป็น open‑weights และการรวมกับ ComfyUI อาจเปลี่ยนโฉมหน้าตลาดวิดีโอ AI โดยเพิ่มตัวเลือกแก่ธุรกิจที่ต้องการควบคุมและปรับแต่งโมเดลของตนเอง.

แชร์บทความนี้:

ชอบบทความแบบนี้?

สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม

แหล่งข่าวต้นฉบับ

ชื่อต้นฉบับ
LTX-2.5 can generate a 10-second AI video from an image in just 6.8 seconds on Nvidia superchips — and it's open weights
ผู้เขียน
[email protected] (Carl Franzen)
แหล่ง
VentureBeat
วันที่เผยแพร่
11 สิงหาคม 2569 เวลา 20:00

Related

บทความที่เกี่ยวข้อง

Wistron เปิดโรงงานอัจฉริยะ AI แรกในสหรัฐฯ มูลค่า 700 ล้านดอลลาร์AI
25 กรกฎาคม 2569 เวลา 01:30

Wistron เปิดโรงงานอัจฉริยะ AI แรกในสหรัฐฯ มูลค่า 700 ล้านดอลลาร์

Wistron เปิด D1 AI Smart Facility ที่เท็กซัส ด้วยมูลค่ากว่า 700 ล้านดอลลาร์และพื้นที่กว่า 324,000 ตารางฟุตเพื่อผลิตชิป NVIDIA GB300 Grace Blackwell Ultra…

TechPowerUp6 นาที
นีเวเดียร่วมมือวอลล์สตรีทจัดกองทุน 500 พันล้านดอลลาร์เพื่อโครงสร้างพื้นฐาน AIAI
-

นีเวเดียร่วมมือวอลล์สตรีทจัดกองทุน 500 พันล้านดอลลาร์เพื่อโครงสร้างพื้นฐาน AI

NVIDIA ประกาศร่วมกับกลุ่มบริษัทวอลล์สตรีทระดับโลกจัดแพคเกจเงินทุน 500 พันล้านดอลลาร์เพื่อสนับสนุนโครงสร้างพื้นฐาน AI การลงทุนนี้ทำให้หุ้น NVIDIA…

TechPowerUp6 นาที
ความคาดหวังการตอบเร็วกลายเป็นเกณฑ์ใหม่ในประเมินผลทำงานAI
10 สิงหาคม 2569 เวลา 14:30

ความคาดหวังการตอบเร็วกลายเป็นเกณฑ์ใหม่ในประเมินผลทำงาน

สำรวจของ Use.AI พบว่า 52% พนักงานส่งอีเมลหรือข้อความที่ไม่นำไปใช้จริงเพียงเพื่อแสดงว่ากำลังทำงาน การคาดหวังความเร็วในการตอบกลับกลายเป็นเกณฑ์ใหม่ในประเมินผล…

TechRadar5 นาที
SoloMD เปิดแอปจดบันทึกโอเพ่นซอร์สแทน Obsidian พร้อม AI panel ในตัวAI
10 สิงหาคม 2569 เวลา 05:30

SoloMD เปิดแอปจดบันทึกโอเพ่นซอร์สแทน Obsidian พร้อม AI panel ในตัว

SoloMD เป็นแอปจดบันทึกโอเพ่นซอร์สที่รองรับ Markdown โดยตรงและมี AI panel ช่วยสร้างเนื้อหาอัตโนมัติ การเปิด vault ของ Obsidian ใน SoloMD ทำได้ราบรื่น…

XDA Developers7 นาที
คัดลอกลิงก์แล้ว!