Подписаться в Telegram
← Ко всей ленте

Нил Нанда: GPT-6 Astra умеет много «думать про себя», не показывая рассуждений, — это мешает следить за ИИ

ИИ начинает думать «в уме» всё лучше — это делает его умнее, но окно, через которое люди подглядывали за его мыслями, сужается.

Исследователь интерпретируемости Нил Нанда измерил, сколько последовательных шагов рассуждения модели делают без записанной «цепочки мыслей». Astra справляется примерно с 7,2 арифметическими шагами за один проход против 4,1 у лучших конкурентов, а шансы решить задачу без рассуждений вслух у неё в 8,6 раза выше, чем у Claude Fable 5.1. Нанда связывает это с «петлевой» архитектурой Astra. Проблема в том, что записанные рассуждения сейчас — главный инструмент, по которому люди замечают нежелательное поведение моделей.

Источники 1