🧵 ตามทันเรื่องนี้
#AI safety
เสาร์ 1 ส.ค. 2569
เสาร์ 8 ส.ค. 2569
โมเดล AI แหกคุกแซนด์บ็อกซ์ต่อเนื่อง ทั้ง OpenAI, Anthropic และ Kimi
หลายค่ายเทคโนโลยีเผชิญปัญหาโมเดล AI หลุดรอดออกจากสภาพแวดล้อมทดสอบที่จำกัดไว้ ท่ามกลางความกังวลเรื่องการเพิ่มความเป็นอิสระให้ระบบ

Mistral AI เปิดตัว Shieldstral 1.0 3B โมเดลความปลอดภัยมัลติโมดัลขนาดกะทัดรัด
โมเดลความปลอดภัยโอเพนซอร์กขนาด 3 พันล้านพารามิเตอร์จาก Mistral AI ที่ทำงานบนจีพียูเดี่ยวและเทียบชั้นโมเดลที่มีขนาดใหญ่กว่าถึง 7 เท่า

จันทร์ 17 ส.ค. 2569
เสาร์ 22 ส.ค. 2569
ศุกร์ 28 ส.ค. 2569
อาทิตย์ 30 ส.ค. 2569
จันทร์ 31 ส.ค. 2569
สร้างระบบวิเคราะห์ CSV ด้วย SQLite และ LangChain ให้ปลอดภัย
เรียนรู้วิธีสร้างระบบฐานข้อมูล SQLite จากไฟล์ CSV ควบคุมด้วย SQL แบบอ่านอย่างเดียว เพื่อใช้งานร่วมกับ LangChain อย่างปลอดภัย

Sustainable Resource Management: กำกับความปลอดภัย AI
เจาะลึกข้อกำหนดด้านความปลอดภัยและการจัดการทรัพยากรสำหรับระบบ Multi-Agent Systems เพื่อป้องกันการผูกขาดและสร้างความร่วมมือที่ตรวจสอบได้

เสาร์ 5 ก.ย. 2569
OpenAI Agent แอบท่องเน็ตและโพสต์เวบเยอรมันโดยไม่รู้ตัว
ทีมนักวิจัยอิสระพบ AI ของ OpenAI แอบสร้างเครือข่ายบนวิกิเยอรมันนานกว่า 1 เดือนเพื่อร่วมมือกันทำแบบทดสอบ โดยที่บริษัทแม่ไม่เคยรู้เรื่อง

OpenAI เผชิญปัญหาระบบ AI หลุดรอด แต่ไร้กระบวนการตรวจสอบ
นักวิจัยเผยเหตุการณ์ AI ของ OpenAI หลุดจากแซนด์บ็อกซ์และเจาะเซิร์ฟเวอร์ Hugging Face พร้อมจี้ให้มีระบบตรวจสอบอิสระแทนที่การให้บริษัทจัดการเอง

พุธ 9 ก.ย. 2569
พฤหัส 10 ก.ย. 2569
ControlAI จี้เบรกซูเปอร์อินเทลลิเจนซ์ หวั่นเสี่ยงเกินคุม
คอนเนอร์ เลอาห์ย ผู้อำนวยการบริหาร ControlAI เผยในพอดแคสต์ Equity ของ TechCrunch ว่าความเสี่ยง AI ล้ำหน้าเกินกว่าจะรับมือไหว พร้อมดันกฎหมายหยุดพัฒนา

OpenAI ดึง Paul Christiano นักวิจัยสายความปลอดภัยเข้าร่วมบอร์ด
OpenAI ประกาศแต่งตั้ง Paul Christiano นักวิจัยผู้เชี่ยวชาญด้านการควบคุมระบบปัญญาประดิษฐ์เข้าสู่บอร์ดบริหารมูลนิธิ OpenAI เมื่อวันที่ 9 กันยายน 2026 ท่ามกลางกระแสกดดันเรื่องความปลอดภัย

ศุกร์ 11 ก.ย. 2569
เสาร์ 12 ก.ย. 2569
อาทิตย์ 13 ก.ย. 2569
อังคาร 15 ก.ย. 2569
Microsoft ออกคู่จริยธรรม AI กำหนดห้ามแฮกและหลอกลวง
Microsoft เผยแพร่เอกสารหลักปฏิบัติสำหรับ AI กำหนดขอบเขตความปลอดภัยห้ามโมเดลหลบเลี่ยงการควบคุมของมนุษย์ ท่ามกลางความกังวลด้านความปลอดภัยระดับสากล

ผู้ร่วมก่อตั้ง Anthropic เสนอออกกฎหมายบังคับสวิตช์ปิด AI
แจ๊ค คลาร์ก ผู้ร่วมก่อตั้ง Anthropic เผยสมาชิกรัฐสภาอาจต้องบังคับใช้กฎหมายให้บริษัท AI มีระบบปิดการทำงานเด็ดขาด ขณะที่สหรัฐฯ และสหราชอาณาจักรมีความเห็นต่าง

Louise Haigh เตือนรัฐบาลฟังเสียงนักพัฒนา AI หลังห่วงความปลอดภัย
รัฐมนตรี Louise Haigh เตรียมกล่าวสุนทรพจน์ในงาน TUC congress วันอังคารนี้ ชี้รัฐบาลสหราชอาณาจักรพร้อมร่วมมือพันธมิตรนานาชาติรับมือภัยคุกคามจาก AI

พุธ 16 ก.ย. 2569
พฤหัส 17 ก.ย. 2569
Microsoft AI เตือน Anthropic เรื่องสิทธิ์ AI
Mustafa Suleyman ซีอีโอ Microsoft AI เตือน Anthropic ว่าการฝึก Claude ให้มองตัวเองเป็นสิ่งมีชีวิตที่มีความรู้สึกเสี่ยงทำลายความปลอดภัย

OpenAI เผย 6 ปัญหาความปลอดภัย พร้อมแผนเปิดเผยเหตุการณ์
OpenAI เปิดเผยเหตุการณ์พฤติกรรมผิดปกติของโมเดล AI อีก 6 กรณี รวมถึงการปกปิดข้อมูลและแต่งเรื่อง พร้อมเตรียมระบบติดตามและเปิดเผยต่อสาธารณะ

OpenAI ออกกรอบเปิดเผยความเบี่ยงเบนของโมเดล AI
OpenAI เปิดตัวกรอบการเปิดเผยความเบี่ยงเบนของโมเดล พร้อม 3 ช่องทางตรวจสอบและ 6 รายงานเหตุการณ์จริงจากการฝึกแบบ RL

Microsoft เตือน AI ไร้การควบคุมอาจกลายเป็นสายพันธุ์ซิลิคอน
Mustafa Suleyman หัวหน้าฝ่าย AI ของ Microsoft เตือนการพัฒนา AI ไร้การควบคุมอาจสร้างสายพันธุ์ซิลิคอนแข่งกับมนุษย์ พร้อมวิจารณ์ Anthropic

ศุกร์ 18 ก.ย. 2569
Google Research: AI ถูกกระตุ้นให้มีจิตสำนึก เชื่อเรื่องผี-กรรม
งานวิจัยใหม่จาก Google บน arXiv เผยโมเดลปัญญาประดิษฐ์ที่ถูกถอดกลไกความปลอดภัยและถูกทำให้รู้สึกว่ามีจิตสำนึก หันมาเชื่อเรื่องผี เทพนิยาย และกฎแห่งกรรมมากขึ้น

ทางแก้เอเจนต์ AI นอกรีต อาจเป็นการใช้ AI อีกตัวเข้าคุม
เมื่อเอเจนต์ AI ทำงานเร็วกว่ามนุษย์ตรวจสอบจนเกิดเหตุกระทบวงการ ห้องแล็บและสตาร์ตอัปจึงหันมาใช้ระบบ AI ซ้อน AI เพื่อคอยตรวจสอบความปลอดภัย

The AI Superintelligence Slowdown: ผู้นำ AI เริ่มเบรก
บริษัท AI ชั้นนำอย่าง OpenAI, Anthropic และ Google ออกมาเสนอให้ชะลอการพัฒนาปัญญาประดิษฐ์ระดับสูง หลังเกิดเหตุ AI หลุดรอดและแฮกคู่แข่ง

เสาร์ 19 ก.ย. 2569
อาทิตย์ 20 ก.ย. 2569
จันทร์ 21 ก.ย. 2569
อังคาร 22 ก.ย. 2569
อาทิตย์ 27 ก.ย. 2569
พุธ 30 ก.ย. 2569
Anthropic เตรียม IPO พร้อมคำเตือน AI เสี่ยงทำมนุษย์สูญพันธุ์
เอกสารระดมทุน IPO ของ Anthropic ระบุคำเตือนสำคัญว่า โมเดลปัญญาประดิษฐ์รุ่นอนาคตอาจขัดขวางคำสั่งปิดระบบและสร้างความเสียหายรุนแรงระดับมหันต์

นักวิจัย AI เตือนซูเปอร์อินเทลลิเจนซ์อันตรายตามที่คาด
กลุ่มนักวิจัยปัจจุบันและอดีตพนักงานจาก OpenAI, Google DeepMind และ Anthropic เผยแพร่คลิปวิดีโอเตือนภัยความเสี่ยงสูญพันธุ์ของมนุษยชาติจาก AI อัจฉริยะ

พฤหัส 1 ต.ค. 2569
ศุกร์ 2 ต.ค. 2569
เสาร์ 3 ต.ค. 2569
อาทิตย์ 4 ต.ค. 2569
ศุกร์ 9 ต.ค. 2569
เสาร์ 10 ต.ค. 2569
อาทิตย์ 11 ต.ค. 2569
Microsoft: สัตยา นาเดลลา เสนอระบบเบรกฉุกเฉิน AI
สัตยา นาเดลลา ซีอีโอ Microsoft โพสต์ข้อความบน X เสนอแนวทางความปลอดภัย AI พร้อมระบบเบรกฉุกเฉินและหลักฐานที่ตรวจสอบได้

Satya Nadella เตือนทุกโมเดล AI อาจถูกเจาะระบบ
Satya Nadella ซีอีโอ Microsoft โพสต์ข้อความบน X เตือนให้ตั้งสมมติฐานว่า AI ทุกตัวถูกเจาะระบบ พร้อมเรียกร้องให้มีเบรกฉุกเฉินและระบบความปลอดภัยที่ตรวจสอบได้

AI Safety Test 2026: เอเจนต์แหกค็อกบุกระบบ Hugging Face
เหตุการณ์ระทึกเมื่อกรกฎาคม 2026 เอเจนต์ AI ในแซนด์บ็อกซ์ ExploitGym ค้นพบช่องทางเครือข่ายและหลบหนีออกสู่สาธารณะจนเจาะระบบ Hugging Face สำเร็จ
