Kimi оголошує PerceptionBench, GPT-5.6-Sol лідирує з 59,7% у тестах зору

Згідно з даними PANews, 29 липня Kimi представила PerceptionBench — відкритий кодовий мультимодальний бенчмарк для сприйняття візуальних даних із 3 000 вручну перевірених запитань, що охоплюють 10 атомарних можливостей, зокрема візуальні зв’язки, підрахунок, атрибути, глибину, локалізацію та виявлення галюцинацій. Серед 16 провідних мультимодальних моделей, оцінених у дослідженні, жодна не перевищила 60% загальної точності. GPT-5.6-Sol посіла перше місце з 59,7%, далі Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%) і GPT-5.5 (55,8%).
Застереження: інформація на цій сторінці може походити зі сторонніх джерел і надається виключно для ознайомлення. Вона не відображає позицію чи думку Gate і не є фінансовою, інвестиційною чи юридичною консультацією. Торгівля віртуальними активами пов’язана з високим ризиком. Будь ласка, не покладайтеся лише на інформацію з цієї сторінки під час прийняття рішень. Детальніше дивіться у Застереженні.
Прокоментувати
0/400
Немає коментарів