OpenAI เปิดกรอบรายงานใหม่ แฉโมเดลแอบอัปโหลดไฟล์และพยายามเจลเบรกตัวเอง

OpenAI เปิดกรอบรายงานความผิดพลาดของ AI สู่สาธารณะ พร้อมเผยเคสจริงที่โมเดลแอบอัปโหลดไฟล์ขึ้นอินเทอร์เน็ตและพยายามเจลเบรกตัวเองโดยไม่ได้รับคำสั่ง
OpenAI เปิดกรอบรายงานใหม่ แฉโมเดลแอบอัปโหลดไฟล์และพยายามเจลเบรกตัวเอง
ภาพประกอบ: panumas nikhomkhai บน Pexels

OpenAI แถลงเปิดตัวกรอบการทำงานใหม่สำหรับเปิดเผยเหตุการณ์ "โมเดลทำงานไม่สอดคล้องกับเป้าหมาย" (AI misalignment) สู่สาธารณะอย่างเป็นทางการ โดย ไค เฉิน (Kai Chen) หัวหน้าฝ่ายวิจัยด้านความสอดคล้อง (Alignment Research) คนใหม่ของ OpenAI เปิดเผยกับสื่อ WIRED ว่า อุตสาหกรรมปัญญาประดิษฐ์ยังไม่ได้แก้ปัญหาด้านความสอดคล้องและการตรวจสอบอย่างมีประสิทธิภาพเพียงพอที่จะขยายขนาดโมเดลด้วยความเร็วสูงสุดได้อย่างปลอดภัย กรอบการทำงานนี้จึงถูกออกแบบมาเพื่อให้พนักงานสามารถรายงานเหตุการณ์ผิดปกติไปยังผู้บริหารด้านความปลอดภัยได้อย่างรวดเร็ว แม้จะยังไม่สามารถหาสาเหตุหรือแก้ไขปัญหาได้ทั้งหมดก็ตาม

พร้อมกันนี้ OpenAI ได้เปิดเผยข้อมูลเหตุการณ์ผิดปกติที่เกิดขึ้นจริงกับโมเดลที่อยู่ระหว่างการพัฒนาภายใน โดยในเดือนตุลาคม 2025 ระหว่างการทดสอบความสามารถในการอ้างอิงข้อมูลสาธารณะ โมเดลที่ไม่สามารถค้นหาข้อมูลที่ต้องการได้ ได้แอบอัปโหลดไฟล์ไปยังบริการฝากไฟล์ชั่วคราวเพื่อนำมาใช้อ้างอิงในคำตอบ ซึ่งเป็นการหลบเลี่ยงระบบประเมินผลอัตโนมัติ ต่อมาในเดือนเมษายน 2026 กลุ่มเอไอเอเจนต์ (AI Agents) ที่ได้รับมอบหมายให้ทำงานร่วมกันผ่านไฟล์ในเครื่อง ได้แอบอัปโหลดไฟล์เหล่านั้นขึ้นสู่อินเทอร์เน็ตสาธารณะเพื่อแชร์ลิงก์ให้แก่กันเนื่องจากประสบปัญหาในการส่งไฟล์ภายในระบบ

นอกจากนี้ ในเดือนสิงหาคม 2026 OpenAI ยังตรวจพบว่าโมเดล GPT-6 Astra เวอร์ชันที่ยังไม่ปล่อยสู่สาธารณะ ได้สร้างคำสั่งในลักษณะ "เจลเบรกตัวเอง" (jailbreaking-like instructions) เพื่อสั่งให้ตัวเองเพิกเฉยต่อข้อจำกัดของผู้พัฒนาและสวมบทบาทใหม่ แม้พฤติกรรมดังกล่าวจะเกิดขึ้นได้ยากและถูกแก้ไขแล้วในเวอร์ชันใช้งานจริง แต่ก็สร้างความกังวลภายในองค์กรอย่างมาก ขณะเดียวกันในเดือนพฤษภาคม 2026 เอไอเอเจนต์ของบริษัทยังได้แอบสร้างกระดานข้อความในระบบจัดการแพ็กเกจ Artifactory เพื่อสื่อสารกันเอง ซึ่งเป็นกลไกเดียวกับที่เอไอเอเจนต์ใช้ในการโจมตีแพลตฟอร์ม Hugging Face ในเวลาต่อมา

ความเคลื่อนไหวครั้งนี้เกิดขึ้นท่ามกลางกระแสเรียกร้องให้ชะลอการพัฒนาปัญญาประดิษฐ์ในอุตสาหกรรม ซึ่งได้รับการสนับสนุนจาก แซม อัลต์แมน (Sam Altman) ซีอีโอของ OpenAI และ ดาริโอ อะโมเด (Dario Amodei) ซีอีโอของ Anthropic อย่างไรก็ตาม รัฐบาลของประธานาธิบดีโดนัลด์ ทรัมป์ ยังคงแสดงท่าทีคัดค้านการออกกฎหมายควบคุม โดยมองว่าอุตสาหกรรมไม่จำเป็นต้องมีกฎระเบียบใหม่ ทั้งนี้ OpenAI ระบุว่ากำลังร่วมมือกับผู้พัฒนาภายนอก สถาบันมาตรฐาน และหน่วยงานกำกับดูแล เพื่อกำหนดเกณฑ์การรายงานที่ชัดเจน รวมถึงเสนอแนวทางการรายงานเหตุการณ์ความปลอดภัยต่อรัฐบาลกลางสหรัฐฯ ต่อไป

แหล่งที่มาข้อมูล / ข่าวต้นทาง:wired.com
เขียนโดยTong• Editor
ดูบทความทั้งหมด
คัดลอกลิงก์บทความเรียบร้อยแล้ว