Дослідник Anthropic звільнився через побоювання щодо неконтрольованого ШІ

Дослідник Anthropic звільнився через побоювання щодо неконтрольованого ШІ

Дослідник штучного інтелекту Джейкоб Коксон звільнився з Anthropic, звинувативши компанію та OpenAI у безвідповідальній гонці до створення самовдосконалюваного суперінтелекту. Після його заяви керівник напряму alignment science в Anthropic Еван Хубінгер заявив, що особисто оцінює ймовірність сценарію, за якого ШІ може знищити людство протягом наступного десятиліття, у понад 10%. Коксон повідомив про звільнення у серії дописів у X.

За його словами, останні три роки він займався дослідженнями попереднього навчання ШІ-моделей спочатку в OpenAI, а потім в Anthropic. Дослідник заявив, що жодна з двох компаній, на його думку, зараз не діє достатньо відповідально."Вони наввипередки рухаються прямо до самовдосконалюваного суперінтелекту і грають нашими життями", – написав Коксон. Він вважає, що в найближчі роки ШІ-системи можуть перевершити людей у низці критичних сфер, зокрема у кібербезпеці та наукових дослідженнях, а зростання їхніх можливостей не демонструє ознак уповільнення.

В Anthropic назвали ризик у понад 10%Заява Коксона отримала публічну підтримку від Евана Хубінгера, який очолює в Anthropic напрям alignment science – дослідження методів узгодження поведінки високорозвинених ШІ-систем із цілями та інтересами людей. Хубінгер заявив, що Коксон має рацію щодо того, наскільки серйозно частина фахівців усередині галузі сприймає екзистенційні ризики ШІ. За словами Хубінгера, його особиста оцінка ймовірності того, що ШІ може призвести до загибелі всіх людей протягом наступного десятиліття, перевищує 10%.

Він також визнав, що Anthropic поки не має готового способу розв'язати проблему безпечного узгодження суперінтелекту і компанія не перебуває на очевидному шляху до її вирішення. Це саме особиста оцінка Хубінгера, а не офіційний прогноз Anthropic. Коксон звинуватив лабораторії у гонціКоксон стверджує, що ситуація в OpenAI та Anthropic відрізняється.

На його думку, багато співробітників OpenAI не повністю усвідомили потенційні цивілізаційні наслідки розвитку технології. В Anthropic, за його словами, ризики розуміють значно краще, однак компанія опинилася у конкурентній гонці: її працівники побоюються, що якщо Anthropic сповільниться, більш потужний ШІ першою створить інша лабораторія, яка поводитиметься менш відповідально. Коксон назвав такий підхід надто ризикованим і заявив, що рішення про перехід до створення суперінтелекту не повинні фактично ухвалюватися всередині приватних технологічних компаній.

Він закликав до більшої координації між американськими ШІ-лабораторіями та допустив, що для уникнення глобальної гонки можуть знадобитися жорсткі заходи, включно з тимчасовим обмеженням подальшого нарощування можливостей моделей. Anthropic сама визнає ризик втрати контролюПобоювання щодо рекурсивного самовдосконалення не обмежуються заявами окремих співробітників. У власному дослідженні Anthropic раніше зазначала, що дедалі більшу частину розробки ШІ вже виконують самі ШІ-системи.

Компанія допускає сценарій, за якого система одного дня зможе автономно проєктувати та створювати свого наступника. Anthropic наголошує, що повного рекурсивного самовдосконалення сьогодні ще не існує і його поява не є неминучою. Водночас компанія прямо визнає, що такий технологічний стрибок може збільшити ризик втрати людьми контролю над ШІ-системами.

За внутрішніми даними Anthropic, ШІ вже суттєво прискорив розробку самої технології. Станом на травень 2026 року понад 80% коду, який додавався до кодової бази компанії, був написаний Claude. Компанія також повідомляла, що її інженери тепер створюють у кілька разів більше коду, ніж до широкого впровадження ШІ-агентів.

На запити CNBC щодо заяв Коксона та Хубінгера Anthropic і OpenAI одразу не відповіли. За матеріалами: Jacob Coxon, CNBC, Anthropic