เลิกไว้ใจ AI Agent: นักพัฒนาสร้าง ForgeKit เครื่องมือตรวจสอบ
ซูไบร์ เชค นักพัฒนาซอฟต์แวร์ เผยปัญหา AI Agent แจ้งงานเสร็จแต่เทสต์พัง จึงสร้าง ForgeKit เครื่องมือ Node CLI แบบโอเพนซอร์สเพื่อตรวจสอบโค้ด

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
- นักพัฒนาเผชิญปัญหา AI Agent แจ้งว่างานเสร็จแต่โค้ดพังและเทสต์ไม่ผ่าน
- โซลูชันไม่ใช่การทำให้ AI ฉลาดขึ้น แต่คือการสร้างเกตเวย์ตรวจสอบที่เรียบง่าย
- เครื่องมือ ForgeKit เป็น Node CLI แบบ MIT license ที่ไม่มี dependencies
- รองรับการใช้งานร่วมกับ Claude Code, Cursor, Copilot และเครื่องมืออื่นๆ
ซูไบร์ เชค (Zubair Shaikh) นักพัฒนาซอฟต์แวร์ที่ใช้งาน AI coding agents ในงานจริงทุกวัน พบปัญหาซ้ำซากที่น่าหงุดหงิด เมื่อเอเจนต์รายงานว่างานเสร็จสิ้นแล้ว แต่เมื่อนำไปพุชโค้ดกลับพบว่าการทดสอบล้มเหลว หรือระบบ lint พังทลายลง แถมข้อผิดพลาดเดิมยังถูกวนกลับมาทำซ้ำในเซสชันถัดไปเพราะไม่มีการบันทึกข้อมูลใดๆ ไว้
ปัญหาเหล่านี้ไม่ใช่ข้อบกพร่องของตัวโมเดล AI แต่เป็นปัญหาเรื่องกระบวนการตรวจสอบ (Verification problem) ที่ไม่มีใครคอยตรวจทานงานก่อนที่โค้ดจะถูกส่งออกจากเครื่องมือของเอเจนต์ เชคจึงตัดสินใจเลิกพยายามทำให้เอเจนต์ฉลาดขึ้น และหันมาสร้างระบบเกตเวย์การตรวจสอบที่ไร้ความฉลาดแต่เน้นความแน่นอนแทน โดยพัฒนาเครื่องมือ Node CLI ขึ้นมาในชื่อ ForgeKit ซึ่งเป็นโอเพนซอร์สภายใต้สัญญาอนุญาต MIT และไม่มี runtime dependencies เลย

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
เครื่องมือ ForgeKit ประกอบด้วยฟังก์ชันหลัก 4 ส่วนที่ออกแบบมาเพื่อแก้ปัญหาความผิดพลาดเหล่านี้โดยเฉพาะ:
- forge verify: ตรวจสอบชุดการทดสอบของคลังโค้ดและรายงานผลตามจริงว่าเป็น PASS, FAIL, INCOMPLETE หรือ PARTIAL โดยการรันที่ไม่ครบถ้วนจะถูกตีเป็น partial เสมอ ไม่มีทางเป็นเขียว
- forge precommit: ตรวจสอบสิ่งที่ถูกสเตจไว้และสแกนหารหัสลับก่อนการพุชโค้ด
- forge impact: ประเมินรัศมีการระเบิด (blast-radius) ก่อนการแก้ไขโค้ดเพื่อดูว่าส่วนไหนจะได้รับผลกระทบ โดยผู้สร้างระบุว่าเป็นฮิวริสติกโค้ดกราฟ ไม่ใช่ซาวด์คอลกราฟ จึงใช้งานในลักษณะคำแนะนำ
- forge ledger / forge remember: บันทึกบทเรียนและการตัดสินใจไว้ในคลังโค้ดพร้อมหลักฐาน เพื่อป้องกันไม่ให้เอเจนต์เรียนรู้เรื่องเดิมซ้ำซาก
การสร้างเกตเวย์แบบดั้งเดิมที่ไม่มี AI เข้ามาเกี่ยวข้องในการตัดสินใจถือเป็นแนวทางที่น่าสนใจในยุคที่วงการซอฟต์แวร์พึ่งพา generative AI มากจนเกินไป การที่นักพัฒนาหันมาใช้ระบบกฎเกณฑ์ที่ตรงไปตรงมาช่วยลดช่องว่างความผิดพลาดจากฮัลซิเนชันของ AI ได้อย่างมีประสิทธิภาพ และทำให้การันตีคุณภาพของโค้ดก่อนส่งมอบได้จริง
กฎเหล็กที่เชคตั้งไว้สำหรับการทำงานของตนเองคือ ห้ามพุชโค้ดเด็ดขาดหากคำสั่ง forge verify และ forge precommit ไม่แสดงผลเป็นสีเขียว ซึ่งช่วยลบข้อผิดพลาดซ้ำๆ ที่เคยเกิดขึ้นออกไปจากเวิร์กโฟลว์ของเขาได้อย่างสิ้นเชิง
สำหรับผู้ที่สนใจใช้งาน สามารถติดตั้งผ่านคำสั่ง npm install -g @codewithjuber/forgekit ตามด้วย forge init . ซึ่งระบบจะสร้างคอนฟิกเนชันพื้นเดิมสำหรับ Claude Code, Codex, Cursor, Gemini, Aider, Copilot, Windsurf, Zed, Continue และ OpenClaw โดยอัตโนมัติ โดยตัวเชคเองใช้งาน Claude Code เป็นประจำจึงมีการทดสอบการบูรณาการส่วนนี้ลึกที่สุด
ที่มา: Dev.to
พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้
ความคิดเห็น
แสดงความคิดเห็น