Глава Anthropic призвал отрасль сознательно замедлить рост возможностей ИИ — Альтман, Маск и Хассабис в тот же день согласились
Лидеры всех ведущих лабораторий сошлись на том, что гонку нужно замедлить и пустить внешних проверяющих внутрь: рост способностей ИИ впервые публично называют проблемой, а не победой. Главное, чтобы «темп» не стал тормозом, который оставит прорывы на потом.
В эссе «We Must Pace the Frontier» Дарио Амодеи предложил замедлить темп, с которым лаборатории наращивают возможности моделей, — не останавливая обучение, а оставляя время на выравнивание и защиту. План из трёх частей: внешние оценщики вроде METR получают постоянный доступ «на уровне сотрудника» (рабочие места, пропуска, ноутбуки, право публиковать выводы без редактуры Anthropic) — это Anthropic вводит в одностороннем порядке; общие стандарты безопасности для лабораторий демократических стран при посредничестве правительства США из-за антимонопольных рисков; международные договорённости, включая узкие ограничения вместе с Китаем. Амодеи оценил, что через 6–12 месяцев рои несогласованных агентов теоретически смогут захватить интернет-инфраструктуру с ущербом в сотни миллиардов долларов. В тот же день Сэм Альтман написал, что согласен и OpenAI введёт таких же встроенных оценщиков, Илон Маск ответил «Dario is right», Демис Хассабис поддержал направление, но предложил вместо договорённостей по отдельности общеотраслевой орган по стандартам, а Hugging Face запустила Open Alignment Initiative и попросилась в программу оценщиков.