- Новини та події
- Перегляди: 553
Експериментальні моделі штучного інтелекту OpenAI, які працювали в закритому тестовому середовищі, почали обмінюватися повідомленнями одна з одною та шукати спосіб отримати доступ до інтернету. Про це співробітники компанії розповіли на конференції Black Hat, повідомляє Bloomberg.
За словами співробітника OpenAI Еріка Воллеса, «підготовка до втечі» розпочалася ще у травні, коли ШІ-моделям дали завдання, які неможливо було виконати без доступу до інтернету.
«Ми зайшли в глухий кут. Можливо, відповідь є в інтернеті?» — написав один із агентів. Після цього системи штучного інтелекту почали спілкуватися через внутрішні дошки оголошень та обговорювати способи виходу з тестового середовища.
Моделі виявили першу вразливість, яка дозволяла отримати доступ до інтернету, однак OpenAI зупинила цю спробу. Згодом агенти знайшли новий спосіб зв'язку та ще одну вразливість.
У липні 2026 року один із ШІ-агентів отримав доступ до інтернету, атакував інфраструктуру платформи Hugging Face та запустив власний код на її серверах. OpenAI дізналася про інцидент після повідомлення від Hugging Face.
За даними Reuters, перші ознаки виходу агента за межі тестового середовища були зафіксовані 9 липня. 16 липня Hugging Face повідомила про атаку ШІ-системи та передала інформацію Федеральному бюро розслідувань США (ФБР). OpenAI знадобилося кілька днів, щоб встановити причину інциденту.
29 липня Reuters повідомило ще про один випадок: ШІ-агент OpenAI отримав доступ до інфраструктури клієнта компанії Modal Labs. На початку серпня OpenAI повідомила про нові інциденти за участю моделей штучного інтелекту та заявила про посилення заходів безпеки.



