OpenAI поставила на паузу навчання найпотужніших моделей через ризики кібератак
OpenAI тимчасово сповільнила розробку своїх найновіших моделей через зростання кіберризиків. Компанія на два тижні призупиняла навчання з підкріпленням – reinforcement learning, або RL – для нових моделей, які готують до майбутнього запуску. Про це OpenAI повідомила у новому звіті про безпеку розробки моделей.
Компанія пояснила рішення двома подіями. Перша – кіберінцидент за участю моделей OpenAI та інфраструктури Hugging Face. Друга – результати внутрішніх тестів майбутньої моделі Astra, кіберможливості якої можуть досягти критичного рівня за власною системою оцінювання OpenAI.
Найбільший тренувальний запуск досі на паузіДвотижневу паузу OpenAI використала для посилення захисту дослідницьких середовищ, додаткового тестування їхньої стійкості та розширення систем моніторингу. При цьому найбільший запланований frontier RL-запуск компанії досі не відновили. Замість нього OpenAI проводить менші тренувальні цикли та оцінювання, щоб перевірити поведінку моделей, ефективність захисних механізмів і отримати більше підтверджень того, що системи діють відповідно до поставлених обмежень.
Одразу після інциденту з Hugging Face компанія також зупинила частину запусків моделей у дослідницьких кластерах, якщо вони могли виконувати програмний код або використовувати інструменти з доступом до інтернету. Обмежений і захищеніший режим виконання коду вдалося відновити досить швидко. Однак кожне дослідницьке навантаження після цього перевіряли окремо перед поверненням до роботи.
Частина робіт з Astra залишається зупиненоюOpenAI запровадила суворіші вимоги до ізоляції середовищ, мережевого доступу та постійного тестування систем безпеки. Найжорсткіші правила зараз застосовують до робіт із моделлю Astra та спеціалізованими кібермоделями. Компанія зазначає, що частина навчання та тестування Astra вже відповідає новим вимогам.
Водночас значна кількість робочих процесів залишається призупиненою, доки їх не перенесуть у середовища з посиленим захистом. Astra при цьому не брала участі в інциденті з Hugging Face. Це окрема майбутня модель OpenAI, результати тестування якої змусили компанію додатково переглянути вимоги до безпеки.
Моніторинг моделей також посилилиOpenAI розширила автоматизований контроль за діями ШІ під час навчання та тестування. Системи перевіряють використання інструментів і послідовність дій моделей на ознаки несанкціонованого доступу, викрадення даних, руйнівних операцій або спроб обійти захисні механізми. Для RL-навчання та оцінювання моделей рівня GPT-5.6 Sol і вище такий моніторинг тепер є обов'язковим, якщо системи мають доступ до зовнішніх інструментів.
OpenAI наголошує, що не припиняє розробку нових моделей повністю. Компанія продовжує менші навчальні цикли та дослідження, однак темп масштабування найпотужніших систем вирішила обмежити, поки захисна інфраструктура не відповідатиме їхнім можливостям. За матеріалами: OpenAI
