Подписаться в Telegram
← Ко всей ленте

Artificial Analysis обновил главный рейтинг ИИ: Claude Fable 5.1 первый, GPT-6 Astra второй

Модели так быстро «съедают» тесты, что линейки приходится переделывать на ходу — и на новой, более жёсткой шкале лидеры по-прежнему идут ноздря в ноздрю.

В версии Intelligence Index v4.2 Claude Fable 5.1 набрал 57 баллов, GPT-6 Astra — 55 (на 4 балла больше предшественника GPT-5.6 Sol), Meta — третья лаборатория. Из индекса убрали «насытившийся» тест научных рассуждений GPQA Diamond и добавили AA-Briefcase (многонедельные агентные проекты с тысячами файлов) и GDP.pdf (рассуждения по 4 592 страницам документов). Доля закрытых тестовых наборов, которые нельзя «вызубрить», выросла с 20% до 40%; при этом Astra тратит меньше токенов на задачу, чем почти любая модель у переднего края.

Artificial Analysis обновил главный рейтинг ИИ: Claude Fable 5.1 первый, GPT-6 Astra второй | Sintelligent