Claude Opus 5 Vượt Qua Tất Cả 129 Bài Kiểm Tra Prompt Injection Của Trình Tác Nhân Trên Trình Duyệt Mà Không Bị Thỏa Hiệp

Theo thông báo của Anthropic thông qua nền tảng tin tức AI Beating, Claude Opus 5 đã vượt qua toàn bộ 129 kịch bản kiểm thử prompt injection cho tác nhân trình duyệt mà không bị thỏa hiệp, đánh dấu một bước đột phá quan trọng trong bảo mật tác nhân AI. Trong thử nghiệm bộ benchmark prompt injection phổ quát của Gray Swan, Opus 5 đạt tỷ lệ thành công tấn công 2,0% sau 15 lượt thử, vượt trội đáng kể so với phiên bản tiền nhiệm Opus 4.8 ở mức 5,5%, cũng như các mô hình cạnh tranh Mythos 5 ở 2,6% và Fable 5 ở 2,8%.
Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận