Kimi ra mắt PerceptionBench, GPT-5.6-Sol dẫn đầu với 59,7% trên các bài kiểm tra về thị giác

Theo PANews, vào ngày 29 tháng 7, Kimi đã công bố PerceptionBench, một bộ công cụ đánh giá cảm nhận tầm nhìn đa phương thức mã nguồn mở với 3.000 câu hỏi đã được xác minh thủ công, bao phủ 10 năng lực “nguyên tử” bao gồm quan hệ thị giác, đếm, thuộc tính, độ sâu, định vị và phát hiện ảo giác. Trong số 16 mô hình đa phương thức hàng đầu được đánh giá, không mô hình nào vượt quá 60% độ chính xác tổng thể. GPT-5.6-Sol xếp hạng đầu với 59,7%, theo sau là Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%) và GPT-5.5 (55,8%).
Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận