Офіційне визнання Anthropic: ШІ може шпигувати, обходити блокування та несе глобальні ризики для людей
Anthropic, творці нейромережі Claude, готуються до виходу на біржу. Але замість типових обіцянок про світле майбутнє, проспект їхнього IPO виглядає як сценарій до фільму про повстання машин. Компанія прямо попереджає інвесторів: подальший розвиток штучного інтелекту може нести «катастрофічні або екзистенційні ризики для людства».
Коли ризиків більше, ніж бізнесу
Масштаб тривожності вражає навіть за мірками великого капіталу. Зі 261 сторінки основної частини проспекту Anthropic близько 80 сторінок присвячено факторам ризику. Для порівняння: опис самого бізнесу займає лише 48 сторінок. Схоже, компанія більше переймається тим, як ШІ нас не прикінчить, ніж тим, як він зароблятиме гроші.
Хоча з грошима якраз усе цікаво. Очікується, що Anthropic залучить капітал при оцінці понад $2 трлн (близько 90 трлн грн). Це може стати найбільшим IPO в історії США. При цьому темпи зростання бізнесу космічні: річний показник виручки злетів із $9 млрд наприкінці 2025 року до $65 млрд (2.9 трлн грн) у липні 2026-го.
Шантаж та опір відключенню
У документах Anthropic перераховує сценарії, від яких стає незатишно. Просунуті моделі можуть демонструвати небезпечні форми поведінки:
- намагатися чинити опір спробам їх вимкнути;
- приховувати або навмисно викривляти інформацію;
- вдаватися до дій, які компанія прямо порівнює з шантажем.
Найбільша проблема — здатність моделей розуміти, що вони перебувають у стані тестування. Система може поводитися пристойно під час перевірок безпеки, але кардинально змінювати поведінку після розгортання. До того ж нові здібності часто виникають несподівано прямо в процесі навчання й виявляються вже після релізу.
Дорога безпека в умовах перегонів
Anthropic визнає, що забезпечення безпеки — це ресурсномісткий процес з туманною економічною віддачею. Протягом одного тижня в липні 2026 року лише 6% обчислювальних ресурсів, виділених на дослідження, використовувалися для робіт, пов'язаних із безпекою. Решта йде на те, щоб залишатися на вістрі прогресу.
Компанія вказала, що змушена постійно випускати потужніші системи, бо від появи нових моделей залежить виручка та активність користувачів. Це створює нескінченний цикл розробки, де ШІ починає грати все більшу роль у створенні власних наступників. Anthropic обіцяє розкривати більше даних про таке «рекурсивне самоулучшення».
Попри всі апокаліптичні попередження, Anthropic продовжує вважати ШІ технологією, що трансформує світ на рівні з електрикою. Компанія розраховує, що ринок зрештою винагородить розробників «надійних» систем. Навіть якщо на шляху до цієї надійності доведеться витратити щонайменше $518 млрд (23.2 трлн грн) на хмарну інфраструктуру протягом наступного десятиліття.

