ข้ามไปเนื้อหาหลัก

ย่อสตูดิโอลงโต๊ะทำงาน: LTX-2.5 เผยโฉมเวิลด์โมเดลโอเพนเวทเร่งความด้วย NVIDIA

LTX-2.5 ปลดล็อกการสร้างวิดีโอหลายช็อตด้วยความสม่ำเสมอสูง ทำงานบนการ์ดจอ NVIDIA RTX ตัวเดียวในเครื่อง โดยไม่ต้องพึ่งคลาวด์หรือสตูดิโอราคาแพง

เรียบเรียงโดย AI
Inewgen
12 Aug 2026ที่มา: MarkTechPost4 นาทีอ่าน (0 ครั้ง)
แชร์
ย่อสตูดิโอลงโต๊ะทำงาน: LTX-2.5 เผยโฉมเวิลด์โมเดลโอเพนเวทเร่งความด้วย NVIDIA

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ขนาดตัวอักษร
  • LTX-2.5 เปิดตัวเป็นเวิลด์โมเดลโอเพนเวท รองรับการสร้างวิดีโอหลายช็อตต่อเนื่องกันโดยตัวละครไม่เพี้ยน
  • ทำงานได้รวดเร็วบนการ์ดจอ NVIDIA RTX ภายใน ComfyUI โดยไม่ต้องพึ่งพาคลาวด์หรือเสียค่าใช้จ่ายรายคลิป
  • ทำความเร็วในการสร้างคลิป 10 วินาที ได้ภายใน 6.8 วินาที เมื่อรันบนเซิร์ฟเวอร์ออนพรีมิส 2x NVIDIA GB200
  • เปิดให้องค์กรที่มีรายได้ประจำต่อปีต่ำกว่า 10 ล้านดอลลาร์ใช้งานได้ฟรี

การผลิตวิดีโอคุณภาพสูงที่เคยต้องพึ่งพาสตูดิโอ ทีมงานกองถ่าย และค่าใช้จ่ายคลาวด์มหาศาล กำลังถูกย่อส่วนลงมาเหลือเพียงคอมพิวเตอร์ตั้งโต๊ะเครื่องเดียว ด้วยการเปิดตัว LTX-2.5 เวิลด์โมเดลโอเพนเวทที่ได้รับการเร่งความเร็วด้วยฮาร์ดแวร์ NVIDIA โดยจุดเด่นสำคัญคือความสามารถในการสร้างวิดีโอแบบหลายช็อตต่อเนื่องกัน (Native multishot generation) ซึ่งช่วยรักษาหน้าตาของตัวละครและองค์ประกอบต่างๆ ให้คงที่จากช็อตหนึ่งไปยังอีกช็อตหนึ่งอย่างแม่นยำ แก้ไขปัญหาภาพกระตุกหรือความไม่ต่อเนื่องที่เคยเป็นอุปสรรคของโมเดลเปิดรุ่นก่อนหน้า

โมเดลนี้ยังมาพร้อมกับแกนกลางภาษา Gemma 4 ที่คมชัดขึ้น และตัวถอดรหัส (Decoder) แบบใหม่ที่ช่วยลดภาพหลอนหรือสิ่งแปลกปลอมในช็อตที่มีการเคลื่อนไหวสูง ทำให้ผลลัพธ์ที่ได้พร้อมนำไปใช้งานโพสต์โปรดักชันได้ทันที ผู้ใช้งานเพียงแค่มี การ์ดจอ NVIDIA RTX บนคอมพิวเตอร์ตั้งโต๊ะ ก็สามารถล็อกตัวละครหรือสไตล์เฉพาะตัวของแบรนด์ผ่านการปรับแต่ง LoRA อย่างรวดเร็วได้ทันที โดยไม่ต้องพึ่งพาสตูดิโอ ไม่ต้องส่งข้อมูลขึ้นคลาวด์ และช่วยรักษาความลับของทรัพย์สินทางปัญญาไว้ในเครื่องได้อย่างสมบูรณ์

6.8sเวลาสร้างคลิป 10 วินาที บน 2x NVIDIA GB200
33M+ยอดดาวน์โหลดรวมของตระกูล LTX

ความเปลี่ยนแปลงนี้ช่วยพลิกโฉมการทำงานของครีเอเตอร์สายคอนเทนต์สั้นและทีมการตลาดที่ต้องผลิตชิ้นงานใหม่อยู่ตลอดเวลา เนื่องจากอาการเบื่อหน่ายโฆษณา (Ad fatigue) มักเกิดขึ้นภายใน 7 ถึง 10 วัน ข้อจำกัดจึงไม่เคยอยู่ที่ไอเดีย แต่เป็นเรื่องของต้นทุนและเวลาในการผลิต การสร้างคอนเทนต์ในเครื่องช่วยให้ทีมงานสามารถทดลองไอเดีย สร้างตัวเลือกบับเบิลหลากหลายรูปแบบ และรีเฟรชงานครีเอเตอร์ได้ทันท่วงทีก่อนที่ผู้ชมจะเบื่อหน่าย โดยครีเอเตอร์เดี่ยวหรือทีมขนาดเล็กสามารถสร้างปริมาณงานเทียบเท่าสตูดิโอขนาดใหญ่ได้ด้วยการ์ดจอ RTX เพียงตัวเดียว

ในด้านความเร็วนั้น LTX-2.5 ทำผลงานได้อย่างโดดเด่น โดยผลการทดสอบการแปลงภาพเป็นวิดีโอ (Image-to-video) ของ LTX ระบุว่า คลิปความยาว 10 วินาทีใช้เวลาเพียง 6.8 วินาที บนระบบออนพรีมิสที่ใช้ 2x NVIDIA GB200 และ 23.7 วินาที ผ่าน LTX API ขณะที่โมเดลคู่แข่งแบบปิดที่เร็วที่สุดอย่าง Omni Flash, Grok 1.5 และ Veo 3.1 ใช้เวลา 52 ถึง 70 วินาที ส่วนระบบที่ช้ากว่าอย่าง Seedance 2.0 ใช้เวลา 196 วินาที, FLUX 3 ใช้เวลา 259 วินาที, Seedance 2.5 ใช้เวลา 317 วินาที และ Kling 3.0 Pro ใช้เวลาถึง 398 วินาที ความเร็วดังกล่าวทำให้การรันแบตช์งานข้ามคืนและการทำ A/B Testing ทำได้จริงในทางปฏิบัติ

artificial intelligence video generation workspace computer

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ไม่อยากพลาดข่าวใหม่?

สมัครรับสรุปข่าวสารใหม่ทางอีเมล ไม่บ่อยจนรำคาญ

โฆษณา

เวิลด์โมเดล (World Models) แตกต่างจากโมเดลภาษาขนาดใหญ่ (LLMs) ตรงที่ LLM ทำหน้าที่ทำนายคำถัดไป แต่เวิลด์โมเดลเรียนรู้ที่จะทำนายเหตุการณ์หรือช่วงเวลาถัดไป สร้างสภาพแวดล้อม จำลองพฤติกรรม และเปิดให้ผู้ใช้งานโต้ตอบภายในนั้นได้ เทคโนโลยีนี้จึงเป็นรากฐานสำคัญที่ไม่เพียงใช้กับงานภาพยนตร์และการโฆษณา แต่ยังขยายผลไปถึงวงการเกม การจำลองสถานการณ์ และหุ่นยนต์ในคลังสินค้าหรือโรงงานอุตสาหกรรม การที่ LTX-2.5 เปิดให้ใช้งานแบบโอเพนเวทจึงช่วยให้ทีมพัฒนาสามารถควบคุมฮาร์ดแวร์ การปรับแต่ง และทรัพย์สินทางปัญญาได้อย่างเต็มที่

ในเดือนสิงหาคมนี้ NVIDIA กำลังให้ความสำคัญกับโมเดล แอปพลิเคชัน และเครื่องมือต่างๆ ในระบบนิเวศ AI ท้องถิ่น โดยในวันเดียวกันนี้ยังมีการเปิดตัว Nemotron 3.5 Lightning ซึ่งเป็นโมเดลผสมผสานผู้เชี่ยวชาญ (MoE) แบบโอเพนซอร์สขนาด 30B สำหรับเอเจนต์ที่ทำงานตลอดเวลา รวมถึง NeMo Switchyard ไลบรารีโอเพนซอร์สที่ทำหน้าที่เส้นทางเวิร์กชอปของเอเจนต์ไปยังโมเดลที่เหมาะสมที่สุด สะท้อนให้เห็นถึงจุดยืนด้านฮาร์ดแวร์ของ NVIDIA ที่ครอบคลุมตั้งแต่พีซีที่ใช้ RTX เวิร์กสเตชัน ศูนย์ข้อมูล ไปจนถึงคลาวด์

สำหรับผู้ที่สนใจ LTX-2.5 เปิดให้ใช้งานในรูปแบบโอเพนเวทบน Hugging Face ทำงานได้โดยตรงใน ComfyUI และผ่าน LTX API สำหรับการจัดการระบบ สามารถรันได้ตั้งแต่ GPU ในศูนย์ข้อมูลจนถึง Mac และเปิดให้องค์กรที่มีรายได้ประจำต่อปีต่ำกว่า 10 ล้านดอลลาร์ใช้งานได้ฟรี โดยมีซอร์สโค้ดและเอกสารประกอบอยู่บน GitHub

ที่มา: MarkTechPost

ความคิดเห็น

แสดงความคิดเห็น
0/2000

พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้