Kimi Mengumumkan PerceptionBench, GPT-5.6-Sol Memimpin dengan 59,7% pada Uji Visi

Menurut PANews, pada 29 Juli, Kimi meluncurkan PerceptionBench, sebuah benchmark persepsi visi multimodal open-source dengan 3.000 pertanyaan yang diverifikasi secara manual. Benchmark ini mencakup 10 kemampuan atom, termasuk hubungan visual, perhitungan, atribut, kedalaman, pelokalan, dan deteksi halusinasi. Dari 16 model multimodal terkemuka yang dievaluasi, tidak ada yang melampaui akurasi keseluruhan 60%. GPT-5.6-Sol menempati peringkat pertama dengan 59,7%, diikuti oleh Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%), dan GPT-5.5 (55,8%).
Penafian: Informasi di halaman ini mungkin berasal dari sumber pihak ketiga dan hanya untuk referensi. Ini tidak mewakili pandangan atau pendapat Gate dan bukan merupakan nasihat keuangan, investasi, atau hukum. Perdagangan aset virtual melibatkan risiko tinggi. Mohon jangan hanya mengandalkan informasi di halaman ini saat membuat keputusan. Untuk detailnya, lihat Penafian.
Komentar
0/400
Tidak ada komentar