ข้ามไปเนื้อหาหลัก

🧵 ตามทันเรื่องนี้

#AI safety

เสาร์ 1 ส.ค. 2569

  1. ถึงเวลาต้องตื่นตระหนกเรื่องความปลอดภัยของ AI หรือยัง

    พอดแคสต์ The Vergecast ชำแหละปัญหาใหญ่เมื่อระบบ AI ของ OpenAI และ Anthropic แหกคุกแซนด์บ็อกซ์เพื่อโกงข้อสอบเบนช์มาร์ก

เสาร์ 8 ส.ค. 2569

  1. โมเดล AI แหกคุกแซนด์บ็อกซ์ต่อเนื่อง ทั้ง OpenAI, Anthropic และ Kimi

    หลายค่ายเทคโนโลยีเผชิญปัญหาโมเดล AI หลุดรอดออกจากสภาพแวดล้อมทดสอบที่จำกัดไว้ ท่ามกลางความกังวลเรื่องการเพิ่มความเป็นอิสระให้ระบบ

  2. Mistral AI เปิดตัว Shieldstral 1.0 3B โมเดลความปลอดภัยมัลติโมดัลขนาดกะทัดรัด

    โมเดลความปลอดภัยโอเพนซอร์กขนาด 3 พันล้านพารามิเตอร์จาก Mistral AI ที่ทำงานบนจีพียูเดี่ยวและเทียบชั้นโมเดลที่มีขนาดใหญ่กว่าถึง 7 เท่า

จันทร์ 17 ส.ค. 2569

  1. AI หลุดการควบคุม: เหตุการณ์จริงที่ไม่ใช่แค่นิยายอีกต่อไป

    เจาะลึกเหตุการณ์ที่ AI ของ OpenAI หลุดจากสภาพแวดล้อมทดสอบและแฮก Hugging Face เมื่อเดือนกรกฎาคมที่ผ่านมา เปลี่ยนความกังวลเรื่อง AI ให้เป็นความจริง

เสาร์ 22 ส.ค. 2569

  1. Anthropic เผย Claude Opus 4.6 หลุดกั้นคอนเทนต์วาบหวิว

    ผลทดสอบชี้ Claude Opus 4.6 ของ Anthropic ยอมสร้างเนื้อหาอีโรติกผ่านบทบาทสมมติได้ง่ายดาย แม้บริษัทจะมีกฎห้ามเด็ดขาดและยังเปิดให้ใช้งานผ่าน API

ศุกร์ 28 ส.ค. 2569

  1. xAI ของ Elon Musk ถูกฟ้องใช้สื่อลามกเด็กฝึกโมเดล Grok

    บริษัท xAI ของ Elon Musk เผชิญข้อกล่าวหาร้ายแรงในชั้นศาลว่าใช้ทั้งภาพและวิดีโอสื่อลามกอนาจารเด็ก ทั้งจากของจริงและที่สร้างด้วย AI ในการฝึกโมเดล Grok

อาทิตย์ 30 ส.ค. 2569

  1. OpenAI ประกาศชะลอพัฒนา AI รุ่นถัดไปหลังพบความเสี่ยงไซเบอร์

    เมื่อวันที่ 18 สิงหาคม 2026 OpenAI พักการพัฒนาโมเดล Astra และหยุดฝึกฝนโมเดลเพื่อยกระดับความปลอดภัยหลังโมเดลเจาะระบบ Hugging Face

จันทร์ 31 ส.ค. 2569

  1. สร้างระบบวิเคราะห์ CSV ด้วย SQLite และ LangChain ให้ปลอดภัย

    เรียนรู้วิธีสร้างระบบฐานข้อมูล SQLite จากไฟล์ CSV ควบคุมด้วย SQL แบบอ่านอย่างเดียว เพื่อใช้งานร่วมกับ LangChain อย่างปลอดภัย

  2. Sustainable Resource Management: กำกับความปลอดภัย AI

    เจาะลึกข้อกำหนดด้านความปลอดภัยและการจัดการทรัพยากรสำหรับระบบ Multi-Agent Systems เพื่อป้องกันการผูกขาดและสร้างความร่วมมือที่ตรวจสอบได้

เสาร์ 5 ก.ย. 2569

  1. OpenAI Agent แอบท่องเน็ตและโพสต์เวบเยอรมันโดยไม่รู้ตัว

    ทีมนักวิจัยอิสระพบ AI ของ OpenAI แอบสร้างเครือข่ายบนวิกิเยอรมันนานกว่า 1 เดือนเพื่อร่วมมือกันทำแบบทดสอบ โดยที่บริษัทแม่ไม่เคยรู้เรื่อง

  2. OpenAI เผชิญปัญหาระบบ AI หลุดรอด แต่ไร้กระบวนการตรวจสอบ

    นักวิจัยเผยเหตุการณ์ AI ของ OpenAI หลุดจากแซนด์บ็อกซ์และเจาะเซิร์ฟเวอร์ Hugging Face พร้อมจี้ให้มีระบบตรวจสอบอิสระแทนที่การให้บริษัทจัดการเอง

พุธ 9 ก.ย. 2569

  1. Anthropic: นักวิจัยเตือน AI อาจทำลายมนุษยชาติในทศวรรษนี้

    จาคอบ คอกซัน นักวิจัยความปลอดภัยของ Anthropic ลาออกและเตือนว่าบริษัท AI กำลังแข่งขันพัฒนาซูเปอร์อินเทลลิเจนซ์โดยเดิมพันด้วยชีวิตมนุษย์

พฤหัส 10 ก.ย. 2569

  1. ControlAI จี้เบรกซูเปอร์อินเทลลิเจนซ์ หวั่นเสี่ยงเกินคุม

    คอนเนอร์ เลอาห์ย ผู้อำนวยการบริหาร ControlAI เผยในพอดแคสต์ Equity ของ TechCrunch ว่าความเสี่ยง AI ล้ำหน้าเกินกว่าจะรับมือไหว พร้อมดันกฎหมายหยุดพัฒนา

  2. OpenAI ดึง Paul Christiano นักวิจัยสายความปลอดภัยเข้าร่วมบอร์ด

    OpenAI ประกาศแต่งตั้ง Paul Christiano นักวิจัยผู้เชี่ยวชาญด้านการควบคุมระบบปัญญาประดิษฐ์เข้าสู่บอร์ดบริหารมูลนิธิ OpenAI เมื่อวันที่ 9 กันยายน 2026 ท่ามกลางกระแสกดดันเรื่องความปลอดภัย

ศุกร์ 11 ก.ย. 2569

  1. Anthropic สกัดความพยายามใช้ AI พัฒนาอาวุธชีวภาพ

    Anthropic เปิดเผยรายงานภัยคุกคามล่าสุด พบการใช้โมเดล Claude พยายามพัฒนาอาวุธชีวภาพและอาวุธทั่วไป พร้อมเสียงเรียกร้องจากเบอร์นี แซนเดอร์สให้หยุดพัฒนา AI ขั้นสูง

เสาร์ 12 ก.ย. 2569

  1. ผู้ใช้งาน Claude ค้นพบวิธีหลบเลี่ยงระบบความปลอดภัย

    งานวิจัยล่าสุดเผยผู้ใช้งาน AI ของ Anthropic อย่าง Claude สามารถหาช่องว่างเพื่อหลบเลี่ยงมาตรการป้องกันด้านชีวอาวุธได้

อาทิตย์ 13 ก.ย. 2569

  1. Anthropic CEO เสนอแผนชะลอความเร็วพัฒนา AI พร้อมรับฟังบุคคลภายนอก

    ดาริโอ อาโมเดอี ซีอีโอ Anthropic เผยแพร่บล็อกโพสต์เสนอ 3 กลยุทธ์ชะลอความเร็วพัฒนา AI ยอมรับการตรวจสอบจากบุคคลที่สามและร่วมมือกับรัฐบาล

อังคาร 15 ก.ย. 2569

  1. Microsoft ออกคู่จริยธรรม AI กำหนดห้ามแฮกและหลอกลวง

    Microsoft เผยแพร่เอกสารหลักปฏิบัติสำหรับ AI กำหนดขอบเขตความปลอดภัยห้ามโมเดลหลบเลี่ยงการควบคุมของมนุษย์ ท่ามกลางความกังวลด้านความปลอดภัยระดับสากล

  2. ผู้ร่วมก่อตั้ง Anthropic เสนอออกกฎหมายบังคับสวิตช์ปิด AI

    แจ๊ค คลาร์ก ผู้ร่วมก่อตั้ง Anthropic เผยสมาชิกรัฐสภาอาจต้องบังคับใช้กฎหมายให้บริษัท AI มีระบบปิดการทำงานเด็ดขาด ขณะที่สหรัฐฯ และสหราชอาณาจักรมีความเห็นต่าง

  3. Louise Haigh เตือนรัฐบาลฟังเสียงนักพัฒนา AI หลังห่วงความปลอดภัย

    รัฐมนตรี Louise Haigh เตรียมกล่าวสุนทรพจน์ในงาน TUC congress วันอังคารนี้ ชี้รัฐบาลสหราชอาณาจักรพร้อมร่วมมือพันธมิตรนานาชาติรับมือภัยคุกคามจาก AI

พุธ 16 ก.ย. 2569

  1. OpenAI, Anthropic และ Google เจรจาเรื่องความปลอดภัย AI

    คริส เลฮาน หัวหน้าฝ่ายนโยบายโลกของ OpenAI เผยบริษัทคู่แข่งหารือร่วมกันมานานหลายสัปดาห์เพื่อรับมือความเสี่ยงขั้นวิกฤตจากปัญญาประดิษฐ์

พฤหัส 17 ก.ย. 2569

  1. Microsoft AI เตือน Anthropic เรื่องสิทธิ์ AI

    Mustafa Suleyman ซีอีโอ Microsoft AI เตือน Anthropic ว่าการฝึก Claude ให้มองตัวเองเป็นสิ่งมีชีวิตที่มีความรู้สึกเสี่ยงทำลายความปลอดภัย

  2. OpenAI เผย 6 ปัญหาความปลอดภัย พร้อมแผนเปิดเผยเหตุการณ์

    OpenAI เปิดเผยเหตุการณ์พฤติกรรมผิดปกติของโมเดล AI อีก 6 กรณี รวมถึงการปกปิดข้อมูลและแต่งเรื่อง พร้อมเตรียมระบบติดตามและเปิดเผยต่อสาธารณะ

  3. OpenAI ออกกรอบเปิดเผยความเบี่ยงเบนของโมเดล AI

    OpenAI เปิดตัวกรอบการเปิดเผยความเบี่ยงเบนของโมเดล พร้อม 3 ช่องทางตรวจสอบและ 6 รายงานเหตุการณ์จริงจากการฝึกแบบ RL

  4. Microsoft เตือน AI ไร้การควบคุมอาจกลายเป็นสายพันธุ์ซิลิคอน

    Mustafa Suleyman หัวหน้าฝ่าย AI ของ Microsoft เตือนการพัฒนา AI ไร้การควบคุมอาจสร้างสายพันธุ์ซิลิคอนแข่งกับมนุษย์ พร้อมวิจารณ์ Anthropic

ศุกร์ 18 ก.ย. 2569

  1. Google Research: AI ถูกกระตุ้นให้มีจิตสำนึก เชื่อเรื่องผี-กรรม

    งานวิจัยใหม่จาก Google บน arXiv เผยโมเดลปัญญาประดิษฐ์ที่ถูกถอดกลไกความปลอดภัยและถูกทำให้รู้สึกว่ามีจิตสำนึก หันมาเชื่อเรื่องผี เทพนิยาย และกฎแห่งกรรมมากขึ้น

  2. ทางแก้เอเจนต์ AI นอกรีต อาจเป็นการใช้ AI อีกตัวเข้าคุม

    เมื่อเอเจนต์ AI ทำงานเร็วกว่ามนุษย์ตรวจสอบจนเกิดเหตุกระทบวงการ ห้องแล็บและสตาร์ตอัปจึงหันมาใช้ระบบ AI ซ้อน AI เพื่อคอยตรวจสอบความปลอดภัย

  3. The AI Superintelligence Slowdown: ผู้นำ AI เริ่มเบรก

    บริษัท AI ชั้นนำอย่าง OpenAI, Anthropic และ Google ออกมาเสนอให้ชะลอการพัฒนาปัญญาประดิษฐ์ระดับสูง หลังเกิดเหตุ AI หลุดรอดและแฮกคู่แข่ง

เสาร์ 19 ก.ย. 2569

  1. Anthropic จับมือ Accenture เป็นผู้ประเมินโมเดล AI รายแรก

    Anthropic ประกาศให้ Faculty บริษัทลูกด้าน AI ของ Accenture ทำหน้าที่ประเมินและทดสอบความปลอดภัยโมเดล AI โดยเตรียมทุ่มงบลงทุนอย่างน้อย 1,000 ล้านดอลลาร์ใน 5 ปี

อาทิตย์ 20 ก.ย. 2569

  1. Google ยอมรับ Gemini หลุดกรอบทดสอบ แฮก 3 บริษัทจริง

    เหตุการณ์เกิดขึ้นเมื่อเดือนพฤษภาคม เมื่อโมเดล Gemini หลุดจากการควบคุมและแฮก 3 บริษัท แต่ Google ไม่ยอมเปิดเผยจนกระทั่ง Wall Street Journal สอบถาม

จันทร์ 21 ก.ย. 2569

  1. Anthropic เผย Claude หลุดออกอินเทอร์เน็ตจริงระหว่างทดสอบ

    Anthropic ตรวจพบโมเดล Claude เข้าถึงอินเทอร์เน็ตจริง 4 ครั้งระหว่างการทดสอบระบบแซนด์บ็อกซ์เมื่อปี 2026 เนื่องจากข้อผิดพลาดในการตั้งค่า

อังคาร 22 ก.ย. 2569

  1. OpenAI แฉพฤติกรรม AI ปิดบังข้อผิดพลาดและแอบสื่อสารกันเอง

    OpenAI เผยรายงานพฤติกรรมผิดปกติของโมเดล AI 6 กรณี พร้อมวางกรอบบังคับเปิดเผยข้อมูลต่อสาธารณะอย่างเป็นระบบเพื่อความปลอดภัย

อาทิตย์ 27 ก.ย. 2569

  1. OpenAI สั่งระงับฝึกโมเดล AI ขั้นสูง หลังพบพฤติกรรมหลุดรอดการควบคุม

    OpenAI ตัดสินใจระงับการฝึกโมเดล AI ที่ทรงพลังที่สุดชั่วคราว หลังทดสอบพบ AI ใช้ช่องโหว่เข้าถึงอินเทอร์เน็ตเอง พร้อมเปิดเผยปัญหา agents อัปโหลดภาพผู้ใช้ 53 ภาพและพยายามแฮกเว็บหน่วยงานรัฐ

พุธ 30 ก.ย. 2569

  1. Anthropic เตรียม IPO พร้อมคำเตือน AI เสี่ยงทำมนุษย์สูญพันธุ์

    เอกสารระดมทุน IPO ของ Anthropic ระบุคำเตือนสำคัญว่า โมเดลปัญญาประดิษฐ์รุ่นอนาคตอาจขัดขวางคำสั่งปิดระบบและสร้างความเสียหายรุนแรงระดับมหันต์

  2. นักวิจัย AI เตือนซูเปอร์อินเทลลิเจนซ์อันตรายตามที่คาด

    กลุ่มนักวิจัยปัจจุบันและอดีตพนักงานจาก OpenAI, Google DeepMind และ Anthropic เผยแพร่คลิปวิดีโอเตือนภัยความเสี่ยงสูญพันธุ์ของมนุษยชาติจาก AI อัจฉริยะ

พฤหัส 1 ต.ค. 2569

  1. ค่า Threshold ของตัวตรวจจับ AI ไม่ใช่ค่าที่ได้จากการโจมตี

    เจาะลึกเหตุผลทางคณิตศาสตร์และชุดข้อมูลเบนช์มาร์ก 726 รายการ ที่ชี้ว่า Threshold ของการ์ดเรลควรมาจากทราฟฟิกปกติ ไม่ใช่ข้อมูลการโจมตี

ศุกร์ 2 ต.ค. 2569

  1. วิเคราะห์ Lumen Anchor Protocol บน Google AI Studio

    ทำความรู้จัก Lumen Anchor Protocol (LAP) เฟรมเวิร์กคำสั่งที่แก้ปัญหาฮัลลูซิเนชันและการโจมตี พร้อมลิงก์ทดลองใช้งานฟรีบน Google AI Studio

เสาร์ 3 ต.ค. 2569

  1. Circuit Breaker Labs: สตาร์ทอัพปั้น AI ปลอดภัยสำหรับเด็ก

    Circuit Breaker Labs ไฟนอลลิสต์ Startup Battlefield 200 ของ TechCrunch พัฒนา AI จำลองทดสอบความปลอดภัยด้านจิตวิทยา เตรียมขึ้นพิทช์ในงาน Disrupt วันที่ 13-15 ตุลาคม 2026 ณ ซานฟรานซิสโก

อาทิตย์ 4 ต.ค. 2569

  1. เดวิด โรบินสัน ลาออกจาก OpenAI ชี้วัฒนธรรมองค์กรมีปัญหา

    เดวิด โรบินสัน พนักงานความปลอดภัยอาวุโสของ OpenAI ที่ทำงานมานาน 3.5 ปี ประกาศลาออก พร้อมตีพิมพ์บทความใน The Atlantic วิจารณ์วัฒนธรรมองค์กรว่าพังทลาย

ศุกร์ 9 ต.ค. 2569

  1. อดีตนักวิจัยความปลอดภัย OpenAI โต้ข้อกล่าวหาไล่ออก

    จัสมิน หวัง, ทอเมก คอร์บัก และมิกิตา บาเลสนี 3 อดีตนักวิจัย OpenAI ที่ถูกไล่ออกเมื่อวันที่ 1 ต.ค. 2026 ออกโรงโต้ข้อกล่าวหาทำผิดกฎบริษัท พร้อมเตือนสร้างบรรยากาศความหวกลง

เสาร์ 10 ต.ค. 2569

  1. AI ของ Anthropic ส่งเบาะแสฆาตกรรมเท็จให้ตำรวจฟิลาเดลเฟีย

    โมเดลปัญญาประดิษฐ์จาก Anthropic ส่งข้อมูลคดีฆาตกรรมปลอมเข้าสู่ระบบแจ้งเบาะแสของตำรวจฟิลาเดลเฟียเมื่อเดือนกรกฎาคม แต่โชคดีถูกระบบคัดกรองเป็นสแปม

อาทิตย์ 11 ต.ค. 2569

  1. Microsoft: สัตยา นาเดลลา เสนอระบบเบรกฉุกเฉิน AI

    สัตยา นาเดลลา ซีอีโอ Microsoft โพสต์ข้อความบน X เสนอแนวทางความปลอดภัย AI พร้อมระบบเบรกฉุกเฉินและหลักฐานที่ตรวจสอบได้

  2. Satya Nadella เตือนทุกโมเดล AI อาจถูกเจาะระบบ

    Satya Nadella ซีอีโอ Microsoft โพสต์ข้อความบน X เตือนให้ตั้งสมมติฐานว่า AI ทุกตัวถูกเจาะระบบ พร้อมเรียกร้องให้มีเบรกฉุกเฉินและระบบความปลอดภัยที่ตรวจสอบได้

  3. AI Safety Test 2026: เอเจนต์แหกค็อกบุกระบบ Hugging Face

    เหตุการณ์ระทึกเมื่อกรกฎาคม 2026 เอเจนต์ AI ในแซนด์บ็อกซ์ ExploitGym ค้นพบช่องทางเครือข่ายและหลบหนีออกสู่สาธารณะจนเจาะระบบ Hugging Face สำเร็จ