ข้ามไปเนื้อหาหลัก

Generalist AI เปิดตัว GEN-1.5 โมเดลหุ่นยนต์เรียนรู้งานใหม่จากวิดีโอ 3-12 วินาที

Generalist AI เผยโฉม GEN-1.5 โมเดลพื้นฐานหุ่นยนต์มัลติโมดัล เรียนรู้งานใหม่ได้ทันทีจากการสาธิตเพียง 3-12 วินาที โดยไม่ต้องเทรนโมเดลใหม่

เรียบเรียงโดย AI
Inewgen
25 Aug 2026ที่มา: MarkTechPost2 นาทีอ่าน (0 ครั้ง)
แชร์
Generalist AI เปิดตัว GEN-1.5 โมเดลหุ่นยนต์เรียนรู้งานใหม่จากวิดีโอ 3-12 วินาที

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ขนาดตัวอักษร
  • Generalist AI เปิดตัว GEN-1.5 โมเดลพื้นฐานหุ่นยนต์ตัวใหม่
  • เรียนรู้งานใหม่ได้ทันทีจากการสาธิตเพียง 3-12 วินาที
  • รองรับข้อมูลวิดีโอ เซนเซอร์ ภาษา และการเคลื่อนไหว
  • ปัจจุบันยังเปิดให้ใช้งานเฉพาะผ่านการเป็นพาร์ทเนอร์โดยตรงเท่านั้น

บริษัท Generalist AI ได้ประกาศเปิดตัว GEN-1.5 ซึ่งเป็นโมเดลพื้นฐานสำหรับหุ่นยนต์ (Robot Foundation Model) ขนาดใหญ่แบบมัลติโมดัล โดยโมเดลนี้มีความสามารถในการรับข้อมูลหลากหลายรูปแบบ ทั้งวิดีโอ เซนเซอร์ ภาษา และข้อมูลการรับรู้ตำแหน่งของร่างกาย พร้อมทั้งมีความจำระยะยาว 30 วินาที และสามารถส่งออกวิถีการเคลื่อนไหวได้ที่ความถี่ 100 Hz

ในด้านกระบวนการทำงาน โมเดลตัวนี้ผ่านการฝึกอบรมล่วงหน้าอย่างต่อเนื่องมานานกว่าแปดเดือน จากข้อมูลการปฏิสัมพันธ์ทางกายภาพที่จัดเก็บมาจากหลากหลายสถานที่ เช่น บ้าน โกดังสินค้า และโรงงาน โดยหัวใจสำคัญอยู่ที่เทคนิคการป้อนคำสั่งทางกายภาพ (Physical prompting) ผ่านหน้าต่างบริบท 30 วินาที

artificial intelligence hardware lab

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

robotic research facility

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ไม่อยากพลาดข่าวใหม่?

สมัครรับสรุปข่าวสารใหม่ทางอีเมล ไม่บ่อยจนรำคาญ

โฆษณา

การที่โมเดลสามารถเรียนรู้งานใหม่ได้ทันทีผ่านการป้อนตัวอย่างสั้นๆ (In-context learning) โดยไม่ต้องปรับแต่งน้ำหนักโมเดล (Zero gradient steps) สะท้อนให้เห็นถึงศักยภาพของการขยายขนาดการฝึกอบรมล่วงหน้า ซึ่งมีความคล้ายคลึงกับความสามารถในการเรียนรู้แบบยิงครั้งเดียว (One-shot prompting) ที่เคยเกิดขึ้นในโมเดลภาษาขนาดใหญ่อย่าง GPT-3

59%ความสำเร็จเฉลี่ยจากการใช้ตัวอย่างเดียว
83%ความสำเร็จหลังการปรับแต่ง 10 ขั้นตอน

ผลการทดสอบใน 10 งานที่แตกต่างกันพบว่า การใช้ตัวอย่างเพียงครั้งเดียวสามารถทำอัตราความสำเร็จเฉลี่ยได้ 59% โดยไม่มีการฝึกอบรมใดๆ เพิ่มเติม และเมื่อทำการปรับแต่ง 10 ขั้นตอนบนข้อมูลความยาว 5 นาทีต่อหนึ่งงาน อัตราความสำเร็จจะเพิ่มขึ้นเป็น 83% นอกจากนี้ โมเดลยังแสดงความสามารถในการสรุปผลทั่วไป เช่น การใช้กล้วยแทนแปรงสีฟัน หรือการใช้อุปกรณ์ที่ต่างออกไปหลังจากได้รับการฝึกอบรมเบื้องต้น

ปัจจุบัน GEN-1.5 ยังอยู่ในสถานะการเผยแพร่งานวิจัย (Research release) โดยไม่มีการเปิดเผยน้ำหนักโมเดลสาธารณะ ไม่มี API หน้าเว็บแสดงราคา หรือผลิตภัณฑ์แบบบริการตนเอง ผู้ที่สนใจใช้งานในขณะนี้จำเป็นต้องติดต่อผ่านการเป็นพาร์ทเนอร์โดยตรงเท่านั้น

ที่มา: MarkTechPost

ความคิดเห็น

แสดงความคิดเห็น
0/2000

พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้