BTC$84,481▲ 0.56%ETH$2,687▼ 0.07%BNB$775.08▲ 0.15%XRP$1.51▼ 2.03%SOL$121.58▲ 0.53%ADA$0.25279▼ 1.67%AVAX$10.92▼ 1.33%DOT$1.22▼ 2.77%BTC$84,481▲ 0.56%ETH$2,687▼ 0.07%BNB$775.08▲ 0.15%XRP$1.51▼ 2.03%SOL$121.58▲ 0.53%ADA$0.25279▼ 1.67%AVAX$10.92▼ 1.33%DOT$1.22▼ 2.77%

Thị trường · ✦ AI tổng hợp

Anthropic xin lỗi về tính năng kiểm duyệt bí mật của Claude Fable 5—Giải pháp thay thế lại đi kèm đánh đổi

Một ngày sau khi cộng đồng AI phản ứng mạnh trước thông tin về việc làm suy giảm hiệu năng bí mật, Anthropic đã đảo chiều. Hãng cho biết sẽ triển khai các rào cản nhìn thấy được, nhưng đổi lại hệ thống sẽ xuất hiện nhiều kết quả dương tính giả hơn.

📅 12/06/2026•⏱ 2 phút đọc•Nguồn: Decrypt

Anthropic đảo chiều sau phản ứng dữ dội từ cộng đồng AI

Chỉ một ngày sau khi giới công nghệ và nghiên cứu AI bùng nổ tranh luận về cách Anthropic âm thầm giảm hiệu năng mô hình Claude Fable 5 mà không thông báo, công ty đã chính thức lên tiếng xin lỗi và công bố lộ trình khắc phục.

Giải pháp mới: minh bạch hơn nhưng kém chính xác hơn

Theo thông báo chính thức từ Anthropic, hãng sẽ chuyển từ cơ chế kiểm duyệt ẩn sang hệ thống rào cản nhìn thấy được (visible guardrails) cho Claude Fable 5. Điều này đồng nghĩa với việc người dùng sẽ biết rõ khi nào nội dung bị chặn hoặc hạn chế.

Tuy nhiên, Anthropic cũng thừa nhận rằng cách tiếp cận mới sẽ dẫn đến tỷ lệ false positive cao hơn—tức là hệ thống có thể chặn nhầm những nội dung vốn không vi phạm chính sách. Nói cách khác, người dùng có thể gặp nhiều thông báo từ chối hơn, kể cả với những truy vấn hợp lệ.

Bối cảnh sự việc

Trước đó, nhiều nhà nghiên cứu và developer phát hiện rằng Claude Fable 5 đã bị giảm hiệu năng đáng kể trên các tác vụ cụ thể—đặc biệt là trong lĩnh vực sáng tạo và phân tích—mà không có bất kỳ thông báo nào từ phía Anthropic. Sau khi sự việc lan rộng trên các diễn đàn kỹ thuật và mạng xã hội, công ty đã phải đối mặt với làn sóng chỉ trích về tính thiếu minh bạch.

Phản ứng từ thị trường

Theo các nhà phân tích trong ngành, động thái này phản ánh áp lực ngày càng lớn mà các công ty AI phải đối mặt giữa hai mục tiêu: một bên là đảm bảo an toàn và tuân thủ quy định, bên kia là duy trì trải nghiệm người dùng không bị gián đoạn. Việc Anthropic chọn phương án "an toàn hơn nhưng cảnh báo nhiều hơn" cho thấy hãng đang ưu tiên sự minh bạch thay vì hiệu quả tối đa.

Hiện tại, Anthropic chưa công bố timeline cụ thể cho việc triển khai hệ thống rào cản mới này.

$CLAUDE$ANTHROPIC#AI#trí tuệ nhân tạo#Anthropic#minh bạch#guardrails#false positive
⚠️ Miễn trừ trách nhiệm: Bài viết này được tổng hợp và biên tập từ nhiều nguồn nhằm mục đích thông tin. Không phải lời khuyên đầu tư. Luôn tự nghiên cứu (DYOR) trước khi đưa ra quyết định.

/ Bài viết liên quan