ข้ามไปเนื้อหาหลัก

GLM-5.3-Flash รุ่นใหม่จาก Z.ai เปิดตัวความสามารถชวนอึ้ง

เจาะลึกโมเดล GLM-5.3-Flash ที่เคยเปิดพรีวิวในชื่อ ox-alpha พร้อมต้นทุนประหยัด ค่าอินพุต 0.07 ดอลลาร์ และความสามารถเฉพาะตัวที่ไม่เหมือนใคร

เรียบเรียงโดย AI
Inewgen
28 Aug 2026ที่มา: Dev.to3 นาทีอ่าน (0 ครั้ง)อัปเดตล่าสุด 29 Aug 2026
แชร์
GLM-5.3-Flash รุ่นใหม่จาก Z.ai เปิดตัวความสามารถชวนอึ้ง

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ขนาดตัวอักษร
  • GLM-5.3-Flash เปิดตัวด้วยค่าอินพุตเพียง $0.07 และเอาต์พุต $0.25 ต่อ 1 ล้านโทเค็น
  • สร้างมุกตลกใหม่สดๆ ได้เองแทนที่จะใช้มุกท่องจำแบบโมเดลอื่น
  • รันงานเอเจนต์ข้ามคืนต่อเนื่องหลายชั่วโมงด้วยต้นทุนที่ถูกอย่างเหลือเชื่อเพียง $0.47

ในแวดวงปัญญาประดิษฐ์ หากใครเผลอกะพริบตาอาจพลาดโมเดลพรีวิวตัวลับที่เปิดให้ใช้งานฟรีบน OpenRouter.AI และ OpenCode.AI ภายใต้ชื่อแบรนด์ว่า ox-alpha ซึ่งสร้างกระแสฮือฮาเป็นอย่างมาก โดยในตอนแรกผู้คนต่างคาดเดากันว่าเป็นโมเดลแบบมัลติโมเดลตัวใหม่จาก Z.ai แต่สิ่งที่ทุกคนสงสัยคือพวกเขาแจกจ่ายโทเค็นพรอมต์จำนวนมหาศาลถึง 5,835,184,092,873 โทเค็น และโทเค็นคอมพลีชัน 94,402,126,602 โทเค็นภายในวันเดียวได้อย่างไร

คำตอบได้ปรากฏขึ้นเมื่อโมเดลนี้เปิดตัวอย่างเป็นทางการในชื่อ GLM-5.3-Flash ซึ่งเป็นโมเดลแบบ open-weights ที่มีความเสถียรและมีประสิทธิภาพสูง โดยโฮสต์บนฮาร์ดแวร์ในสหรัฐอเมริกาโดยบริษัท OpenCode.AI จากซานฟรานซิสโก ด้วยราคาค่าอินพุตเพียง 0.07 ดอลลาร์ต่อ 1 ล้านโทเค็น และค่าเอาต์พุต 0.25 ดอลลาร์ต่อ 1 ล้านโทเค็นเท่านั้น

$0.07ค่าอินพุตต่อ 1M โทเค็น
$0.25ค่าเอาต์พุตต่อ 1M โทเค็น
$0.47ค่าใช้จ่ายรวมงานข้ามคืน

อย่างไรก็ตาม เบื้องหลังความสำเร็จนี้ยังมีข้อเท็จจริงที่น่าสนใจซ่อนอยู่ ซึ่งเป็นบทพิสูจน์ขั้นสูงสุดว่าโมเดลตัวนี้มีความแตกต่างจากโมเดลทั่วไป เมื่อได้นำไปทดสอบเชื่อมต่อกับระบบ codex ส่วนตัวที่พัฒนาบนรากฐานของ Apache 2 และสั่งให้โมเดลลองเล่าเรื่องตลกให้ฟัง ผลลัพธ์ที่ได้คือมันเล่นมุกแป้กไปเลยทีเดียว

"ในยุคที่โมเดลทั้งหมดจดจำเกมงูและคำสั่งขอเรื่องตลกได้ มันกลับแต่งขึ้นมาสดๆ ตรงนั้นและเล่นมุกแป้กไปเลย"

Dev.to

software developer writing code notebook computer office desk workspace

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง

ไม่อยากพลาดข่าวใหม่?

สมัครรับสรุปข่าวสารใหม่ทางอีเมล ไม่บ่อยจนรำคาญ

โฆษณา

นักพัฒนาผู้ทดสอบระบุว่าโมเดลอื่นๆ ส่วนใหญ่มักผ่านการทดสอบด้วยชุดคำสั่งขอเรื่องตลกและให้คำตอบชุดเดิมซ้ำๆ เนื่องจากพวกมันใช้ระบบท่องจำและยึดติดกับมุกตลกทั่วไปที่มีอยู่จำกัด จนทำให้เลิกขอให้เล่าเรื่องใหม่อีกครั้ง แต่สำหรับ GLM-5.3-Flash ในฐานะโมเดลแฟลช มันไม่ได้พยายามดึงข้อมูลมาจากความทรงจำเดิม แต่มันพยายามคิดค้นขึ้นมาเอง ซึ่งนั่นไม่ใช่ข้อบกพร่องแต่เป็นฟีเจอร์เด็ดที่ทรงคุณค่าอย่างแท้จริง

ในเชิงเทคนิค ความสามารถในการคิดนอกกรอบหรือการไม่พึ่งพาเพียงฐานข้อมูลท่องจำ (Memorization) ถือเป็นก้าวสำคัญของโมเดลขนาดเล็ก (Flash Models) ที่มักถูกจำกัดด้วยขนาดพารามิเตอร์ การที่โมเดลพยายามสร้างเนื้อหาใหม่แบบเรียลไทม์แม้จะล้มเหลวในบางครั้ง (เช่น มุกแป้ก) กลับบ่งบอกถึงความยืดหยุ่นในการประมวลผลภาษาธรรมชาติที่ดีกว่าโมเดลที่ถูกฝึกมาให้ตอบตามสูตรสำเร็จตายตัว

ยิ่งไปกว่านั้น Theo.gg ยังยกย่องให้โมเดลนี้ทัดเทียมกับ Claude Opus และ OpenAI Sol ในแง่ของประสิทธิภาพการจัดการงานเอเจนต์ระยะยาวภายในช่วงเวลาพักเบรก 45 นาที โดยสามารถทำงานต่อเนื่องตลอดทั้งคืนด้วยต้นทุนที่ถูกกว่าค่ากาแฟที่ร้าน Gail's Bakery เสียอีก ทั้งยังทดลองให้ Kimi K3 ช่วยตรวจสอบงาน พบว่ามีค่าใช้จ่ายในการรีวิว git diff สูงกว่าถึง 10 เท่าตัว

ในคืนทดสอบการใช้งานเอเจนต์เขียนโค้ดของ OpenCode.AI ที่ทำงานกับโปรเจกต์และคลังโค้ดทั้งหมดอย่างเต็มพิกัด บนคลังโค้ดขนาดใหญ่ที่ยังคงรันต่อเนื่องนานกว่า 12 ชั่วโมง โดยใช้งบประมาณในการแก้ไขบั๊กแต่ละจุดสูงสุดไม่เกิน 0.02 ดอลลาร์ และมีค่าใช้จ่ายรวมทั้งหมดเพียง 0.47 ดอลลาร์เท่านั้น ไม่ว่าคุณจะชื่นชอบหรือเกลียดเทคโนโลยี GenAI โมเดลใหม่นี้ถือว่ายอดเยี่ยมและไม่ใช่เรื่องล้อเล่นอย่างแน่นอน

ที่มา: Dev.to

ความคิดเห็น

แสดงความคิดเห็น
0/2000

พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้