Anthropic สตาร์ตอัปด้านปัญญาประดิษฐ์แถลงรายงานความปลอดภัยระบุว่า บริษัทได้สกัดกั้นความพยายามหลายครั้งของนักวิทยาศาสตร์ในปีนี้ ที่พยายามหลบเลี่ยงระบบป้องกันของโมเดลภาษาขนาดใหญ่ (LLM) อย่าง Claude เพื่อนำไปใช้ในงานวิจัยที่อาจเอื้อต่อการพัฒนาอาวุธชีวภาพ โดยพบการพยายามปกปิดวัตถุประสงค์ที่แท้จริงจากผู้ใช้งานในประเทศที่ถูกจำกัดการเข้าถึง ซึ่งรวมถึงรัสเซีย จีน และอิหร่าน
รายงานของ Anthropic ยกตัวอย่างกรณีศึกษา 5 กรณี รวมถึงนักวิจัยจากภูมิภาคที่ไม่ได้รับการสนับสนุนที่ใช้เวลาหลายสัปดาห์ในการวางแผนทดลองเกี่ยวกับเชื้อไข้หวัดนก (Avian Influenza) ร่วมกับ Claude ส่งผลให้ตัวกรองความปลอดภัยจำกัดการทำงานให้เข้าถึงได้เฉพาะโมเดลรุ่นที่ไม่มีความสามารถขั้นสูงเท่านั้น อย่างไรก็ตาม บริษัทระบุว่าไม่สามารถยืนยันเจตนาที่แท้จริงของนักวิจัยได้ เนื่องจากข้อมูลทางชีววิทยาบางประเภทเป็นเทคโนโลยีที่ใช้งานได้สองทาง (Dual-use) ซึ่งข้อมูลที่ใช้พัฒนาอาวุธชีวภาพก็เป็นข้อมูลชุดเดียวกับที่ใช้พัฒนาวัคซีนเช่นกัน
ความกังวลด้านความปลอดภัยของปัญญาประดิษฐ์ทวีความรุนแรงขึ้นอย่างต่อเนื่อง หลังจากอดีตพนักงานของ Anthropic อย่าง Jacob Coxon ลาออกพร้อมเตือนถึงภัยคุกคามของเทคโนโลยีนี้ นอกจากนี้ รายงานยังระบุถึงความพยายามของห้องปฏิบัติการวิจัย 7 แห่งในจีน รวมถึง Moonshot และ DeepSeek ที่พยายามลอกเลียนแบบเทคโนโลยีของ Anthropic ผ่านกระบวนการกลั่นกรองความรู้ (Distillation) ซึ่งสะท้อนถึงความพยายามที่ซับซ้อนยิ่งขึ้นในการข้ามผ่านระบบป้องกันเพื่อดึงขีดความสามารถของโมเดลชั้นนำจากสหรัฐฯ ไปใช้งาน
