Кими анонсирует PerceptionBench: GPT-5.6-Sol лидирует с 59,7% на тестах зрения

Согласно PANews, 29 июля Kimi представила PerceptionBench — открытый бенчмарк для мультимодального зрительного восприятия с 3 000 вопросов, вручную проверенных, которые охватывают 10 базовых возможностей, включая визуальные отношения, подсчёт, атрибуты, глубину, локализацию и обнаружение галлюцинаций. Среди 16 ведущих мультимодальных моделей, которые оценивались, ни одна не превысила 60% общей точности. GPT-5.6-Sol заняла первое место с 59,7%, затем следуют Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%) и GPT-5.5 (55,8%).
Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев