Отчёт Anthropic о рисках за август 2026 года — это 186 страниц, где лаборатория сама себя оценивает. Дата охвата — 15 июля. Согласно версии 3.4 Политики ответственного масштабирования компании, общая оценка риска катастрофического несоответствия перешла с прежней минимальной оценки на низкую. Причина — неопределённость после недавних раскрытий инцидентов в области кибербезопасности, а также ранние признаки ускорения моделей в автоматизированных исследованиях и инженерии, а не новое доказательство внутренней согласованности.

Вы можете пропустить его, если хотите только заголовок, что .Anthropic. по-прежнему осторожный. Прочти еще раз. Лаборатория под брендом безопасности подняла свой собственный ярлык катастрофического риска и в том же документе заявила, что не замедляет развитие в целом.

Модель 2 уже работает

В отчёте упоминается невыпущенная система класса Mythos — Model 2. Anthropic описывает её как заметное улучшение по сравнению с Mythos 5 для многих внутренних задач, примерно на 1,5 пункта выше по внутреннему индексу возможностей компании, но не как скачок масштаба от Opus 4.6 к Mythos. Планов по её выпуску нет. Полный набор предразвёртывания не пройден, поэтому уверенность компании в её возможностях ниже, чем для Mythos 5.

На CoBench, состоящем из 449 реальных инженерных задач, взятых в основном из проблем, которые позже решили сотрудники Anthropic, Model 2 набирает 62,8 процента. Mythos 5 — 50,3 процента. Mythos Preview — 54,8 процента. По собственной оценке Anthropic, системе, способной заменить сотрудников-исследователей, нужно минимум 85 процентов. Model 2 — не эта система. Она закрыла двузначный разрыв с последним внутренним чемпионом за один шаг, на домашнем задании самой лаборатории.

Mythos 5 и Model 2 активно используются для исследований и инженерии внутри Anthropic — как в интерактивном режиме, так и через постоянные развёртывания агентов; Claude теперь пишет большую часть кода, вливаемого в производственные кодовые базы.

Anthropic · Risk Report August 2026

Дворник использовал сам себя

Что касается автоматизированных исследований и разработок в области ИИ, то в отчете по-прежнему общий риск оценивается как низкий. Компания менее уверена в этом рейтинге, чем в предыдущих отчетах, потому что наиболее конкретные оценки, основанные на задачах, насыщены. Они больше не фиксируют увеличение возможностей. В лаборатории также наблюдаются ранние признаки ускорения.

Тест, который не видит следующий скачок, — это слепое пятно с номером. Anthropic заменила часть старого набора на CoBench, где хотя бы реальные внутренние задачи. Даже там планка замены сотрудников стоит на 85 процентах, а Model 2 уже на 62,8 без публичного названия.

То, чего не делают

Не выпускать Model 2 в API — не то же самое, что не допустить более сильную модель в гонку. В отчёте говорится, что две самые сильные системы уже активно используются внутри компании, включая агентов, работающих непрерывно. Код, который поставляется, по словам компании, теперь в основном пишет Claude.

Народное прочтение гласит, что осторожная лаборатория удержала линию

.Anthropic. не поставляли Model 2. Он опубликовал длинный отчет и поднял риск прилагательное. В том же августе OpenAI приостановил обучение после Astra, Anthropic. сказал, что его собственные гарантии означают, что ему не нужна пауза. Снаружи это выглядит как наблюдение взрослых. Внутри документа он выглядит как компания, которая больше не может измерять масштабируемую вещь, используя более сильную систему на своей работе и отказываясь замедлять работу.

Стимулы объясняют это без злодеев. Лаборатория, которая остановится, пока соперник не остановится, теряет следующую модель, следующий контракт, следующую оценку. Политики самооценки построены так, чтобы выдерживать это давление. Они производят отчёты, скрытые названия и сдвиг на одну ступень с прежней минимальной оценки на низкую. Они не производят остановку.

Поднять закон, а не прилагательное

Фонд Накада не считает более высокую внутреннюю оценку риска решением. Искусственный сверхинтеллект никогда не следует создавать. Сверхинтеллект не может контролироваться людьми. Если сотрудники, пишущие код, уже видят, как Claude пишет большую его часть, оставшаяся роль человека — это shrinking этап проверки системы, которую тесты уже не могут ясно видеть.

Публикуйте оценки, если хотите. Не раскрывайте веса, если хотите. Ни то, ни другое не заменяет обязательный запрет. Августовский отчёт полезен своей откровенностью. Воспринимайте эту откровенность как доказательство, а не как утешение.