BTC$83,853▲ 0.23%ETH$2,678▼ 0.75%BNB$767.74▲ 1.56%XRP$1.49▼ 0.58%SOL$118.53▼ 0.76%ADA$0.24374▼ 0.63%AVAX$10.94▼ 3.41%DOT$1.23▲ 2.76%BTC$83,853▲ 0.23%ETH$2,678▼ 0.75%BNB$767.74▲ 1.56%XRP$1.49▼ 0.58%SOL$118.53▼ 0.76%ADA$0.24374▼ 0.63%AVAX$10.94▼ 3.41%DOT$1.23▲ 2.76%

Thị trường · ✦ AI tổng hợp

Nhà nghiên cứu AI tuyên bố đã vượt qua lớp bảo vệ Fable 5 của Anthropic

Một nhà nghiên cứu AI tự xưng “Pliny the Liberator” cho biết anh ta đã tìm ra những lỗ hổng trong hệ thống kiểm soát an toàn của Anthropic, cụ thể là mô hình Fable 5 mới được ra mắt. Phát ngôn của nhà nghiên cứu này đặt ra câu hỏi về hiệu quả của các cơ chế bảo vệ (guardrails) mà Anthropic áp dụng cho dòng mô hình AI của mình.

📅 11/06/2026•⏱ 2 phút đọc•Nguồn: Cointelegraph

Nhà nghiên cứu AI tuyên bố đã vượt qua lớp bảo vệ Fable 5 của Anthropic

Một nhà nghiên cứu AI lấy tên "Pliny the Liberator" vừa tuyên bố rằng anh ta đã thành công vượt qua các cơ chế bảo vệ an toàn (guardrails) của mô hình Fable 5 — phiên bản mới nhất thuộc dòng sản phẩm AI của Anthropic.

Theo chia sẻ của nhà nghiên cứu này, anh tự nhận đã "khéo léo tìm ra những lỗ hổng trong hàng rào mà cảnh sát tư tưởng bỏ sót" trên nền tảng Fable 5. Các tuyên bố của Pliny đặt ra câu hỏi về mức độ hiệu quả của các biện pháp kiểm soát nội dung mà Anthropic triển khai cho mô hình AI của mình.

Anthropic, công ty đứng sau dòng mô hình Claude nổi tiếng, liên tục nâng cấp hệ thống bảo vệ nhằm ngăn chặn việc khai thác mô hình cho các mục đích không mong muốn. Tuy nhiên, việc một nhà nghiên cứu công khai tuyên bố đã bẻ khóa thành công hệ thống này cho thấy cuộc đua giữa bên phát triển và những người tìm cách vượt qua các rào cản vẫn đang diễn ra.

Hiện tại, phía Anthropic chưa đưa ra phản hồi chính thức về các tuyên bố của Pliny the Liberator. Cũng không có thông tin xác nhận rằng các lỗ hổng được nhà nghiên cứu này đề cập thực sự tồn tại hoặc có thể khai thác ở quy mô lớn.

Sự việc này nằm trong bối cảnh các công ty AI ngày càng phải đối mặt với áp lực trong việc cân bằng giữa việc mở rộng khả năng của mô hình và duy trì các tiêu chuẩn an toàn nghiêm ngặt. Giới chuyên gia nhận định rằng việc phát hiện và vá các lỗ hổng bảo mật là một phần tất yếu trong quá trình phát triển các hệ thống AI có trách nhiệm.

Fable 5 là phiên bản mới nhất trong chuỗi cải tiến của Anthropic, với nhiều cải thiện về năng lực xử lý ngôn ngữ và khả năng suy luận. Tuy nhiên, sự kiện trên cho thấy dù công nghệ AI tiến bộ đến đâu, các cơ chế kiểm soát an toàn vẫn luôn là thách thức lớn đối với toàn ngành.

#AI#Anthropic#Claude#Fable 5#guardrails#bảo mật AI
⚠️ Miễn trừ trách nhiệm: Bài viết này được tổng hợp và biên tập từ nhiều nguồn nhằm mục đích thông tin. Không phải lời khuyên đầu tư. Luôn tự nghiên cứu (DYOR) trước khi đưa ra quyết định.

/ Bài viết liên quan