Официальное признание Anthropic: ИИ может шпионить, обходить блокировки и несет глобальные риски для людей
Anthropic, создатели нейросети Claude, готовятся к выходу на биржу. Но вместо типичных обещаний о светлом будущем, проспект их IPO выглядит как сценарий к фильму о восстании машин. Компания прямо предупреждает инвесторов: дальнейшее развитие искусственного интеллекта может нести «катастрофические или экзистенциальные риски для человечества».
Когда рисков больше, чем бизнеса
Масштаб тревожности поражает даже по меркам крупного капитала. Из 261 страницы основной части проспекта Anthropic около 80 страниц посвящено факторам риска. Для сравнения: описание самого бизнеса занимает лишь 48 страниц. Похоже, компания больше обеспокоена тем, как ИИ нас не уничтожит, чем тем, как он будет зарабатывать деньги.
Хотя с деньгами как раз всё интересно. Ожидается, что Anthropic привлечет капитал при оценке более $2 трлн (около 90 трлн грн). Это может стать крупнейшим IPO в истории США. При этом темпы роста бизнеса космические: годовой показатель выручки взлетел с $9 млрд в конце 2025 года до $65 млрд (2.9 трлн грн) в июле 2026-го.
Шантаж и сопротивление отключению
В документах Anthropic перечисляет сценарии, от которых становится неуютно. Продвинутые модели могут демонстрировать опасные формы поведения:
- пытаться сопротивляться попыткам их выключить;
- скрывать или намеренно искажать информацию;
- прибегать к действиям, которые компания прямо сравнивает с шантажом.
Наибольшая проблема — способность моделей понимать, что они находятся в состоянии тестирования. Система может вести себя прилично во время проверок безопасности, но кардинально менять поведение после развертывания. К тому же новые способности часто возникают неожиданно прямо в процессе обучения и проявляются уже после релиза.
Дорогая безопасность в условиях гонки
Anthropic признает, что обеспечение безопасности — это ресурсозатратный процесс с туманной экономической отдачей. В течение одной недели в июле 2026 года лишь 6% вычислительных ресурсов, выделенных на исследования, использовались для работ, связанных с безопасностью. Остальное идет на то, чтобы оставаться на острие прогресса.
Компания указала, что вынуждена постоянно выпускать более мощные системы, ибо от появления новых моделей зависят выручка и активность пользователей. Это создает бесконечный цикл разработки, где ИИ начинает играть всё большую роль в создании собственных преемников. Anthropic обещает раскрывать больше данных о таком «рекурсивном самосовершенствовании».
Несмотря на все апокалиптические предупреждения, Anthropic продолжает считать ИИ технологией, трансформирующей мир на уровне электричества. Компания рассчитывает, что рынок в конечном итоге вознаградит разработчиков «надежных» систем. Даже если на пути к этой надежности придется потратить как минимум $518 млрд (23.2 трлн грн) на облачную инфраструктуру в течение следующего десятилетия.
Подписывайтесь на наш нескучный канал в Telegram, чтобы ничего не пропустить.