Нейросети пока что не научились видеть мир, как мы
📉 Нейросети пока что не научились видеть мир, как мы
Moonshot AI представила новый тест PerceptionBench, который проверяет, насколько хорошо мультимодальные модели ИИ действительно "видят". Оказалось, что ни одна из передовых моделей не дотягивает до 60% точности. Лидирует GPT-5.6 Sol, но и его результаты оставляют желать лучшего. Интересно, что многие ошибки, которые мы списывали на проблемы с логикой, на самом деле начинаются на стадии восприятия изображения.
◾️ Лидер: GPT-5.6 Sol
◾️ Максимальная точность: менее 60%
> «ИИ пока что смотрит на мир через запотевшие очки, и мы только начинаем их протирать».
Пока ИИ учится видеть, мы продолжаем учиться доверять его "зрению". Может, очки ему подобрать получше?
Подписаться на «Нейро Пульс»
Первоисточник ↗
Moonshot AI представила новый тест PerceptionBench, который проверяет, насколько хорошо мультимодальные модели ИИ действительно "видят". Оказалось, что ни одна из передовых моделей не дотягивает до 60% точности. Лидирует GPT-5.6 Sol, но и его результаты оставляют желать лучшего. Интересно, что многие ошибки, которые мы списывали на проблемы с логикой, на самом деле начинаются на стадии восприятия изображения.
◾️ Лидер: GPT-5.6 Sol
◾️ Максимальная точность: менее 60%
> «ИИ пока что смотрит на мир через запотевшие очки, и мы только начинаем их протирать».
Пока ИИ учится видеть, мы продолжаем учиться доверять его "зрению". Может, очки ему подобрать получше?
Пока нет комментариев — будьте первым.