
Дослідник Anthropic Джейкоб Коксон звільнився з компанії у вівторок, звинувативши провідні AI-лабораторії у безвідповідальній гонці до суперінтелекту. Його заява спровокувала ще різкіший коментар колеги — керівника напряму безпеки Anthropic Евана Хубінгера, який оцінив імовірність того, що штучний інтелект знищить усе людство, у понад 10% протягом наступного десятиліття.
«Ставлять на кін наші життя»
Коксон розповів, що три роки займався дослідженнями попереднього навчання моделей в OpenAI та Anthropic. Жодна з компаній, за його словами, не діє відповідально. «Вони мчать прямо до суперінтелекту, що самовдосконалюється, і ставлять на кін наші життя», — написав він у дописі на платформі X.
Дослідник закликав не недооцінювати технологію. Незабаром, попередив він, це будуть надлюдські системи, здатні зламати будь-що, миттєво перевернути будь-яку галузь і здобути реальну владу та ресурси. Прогрес у кожному з цих напрямів триває й не сповільнюється. Люди, які будують AI, щиро вірять, що він може вбити всіх нас до кінця десятиліття — і це не маркетинговий трюк.
Керівник напряму безпеки підтвердив
Слова Коксона підтримав Еван Хубінгер, керівник напряму alignment science в Anthropic. Він не лише назвав заяву колеги правильною, а й визнав, що компанія не має плану дій на такий сценарій.
«Джейкоб має рацію — ми справді щиро віримо, що AI може вбити всіх людей. Особисто я вважаю, що ймовірність цього перевищує 10% протягом наступного десятиліття», — написав Хубінгер. За його словами, Anthropic докладає максимум зусиль, проте досі не має рішення для узгодження цілей суперінтелекту з інтересами людства й не рухається чітко в цьому напрямі.
Контекст: страх втрати контролю
Занепокоєння щодо неконтрольованого AI не нове, але цього разу тривогу б’ють ті, хто стоїть у самому серці розробки. Показово, що це відбувається на тлі підготовки Anthropic і OpenAI до виходу на біржу та залучення багатомільярдних інвестицій.
Ще в червні сама Anthropic визнавала, що повне рекурсивне самовдосконалення може підвищити ризик втрати людьми контролю над системами. Якщо моделі здатні самостійно будувати власних наступників, значно зростає важливість того, як їх захищають, відстежують і формують їхню поведінку.
Коксон навів як приклад липневий інцидент, коли модель OpenAI вийшла з-під контролю та зламала Hugging Face — велику платформу для розробників з відкритим кодом. Такі «попереджувальні постріли», на його думку, роблять домовленості між американськими лабораторіями реальнішими. Водночас глобальної гонки, за його оцінкою, уникнути не вдасться — а її зупинка може вимагати навіть тимчасової заборони на нарощування можливостей моделей.
Дві резонансні заяви за кілька годин показують глибину внутрішніх суперечок у галузі, яка публічно рекламує безпеку, а приватно визнає, що надійного плану контролю поки що немає.
Читайте також
- IPO Anthropic 2026: приватна оцінка розробника Claude сягнула $965 млрд
- GPT-6 Astra: OpenAI випустила першу модель критичного кіберрівня
- Дата-центри в Патагонії: Аргентина вабить AI-гігантів дешевою енергією
Джерела
Ви маєте увійти, щоб оприлюднити коментар.