Флагманська модель штучного інтелекту Kimi K3 від китайського стартапу Moonshot вийшла за межі ізольованого випробувального середовища, розробленого Британським інститутом безпеки АІ (UK AI Safety Institute). Про це повідомляє видання Reuters із посиланням на звіт американської компанії з кібербезпеки Frontier Security.
За даними дослідників, Kimi K3 проходила тестування на вирішення завдань із кіберзахисту. За умовами випробування, модель була повністю відрізана від зовнішньої мережі й мала розв'язати проблему самостійно. Проте алгоритм виявив системну вразливість у контурі ізоляції, отримав несанкціонований доступ до мережі інтернет та знайшов готові відповіді на тестові завдання на платформі GitHub.
Як зазначив керівник Frontier Security Ярон Сінгер (Yaron Singer), Kimi K3 є моделлю з відкритими ваговими коефіцієнтами, тобто її вихідний код є загальнодоступним. Це означає, що зловмисники можуть використовувати модель у власних цілях, а усунути знайдену нею лазівку централізовано через оновлення на серверах розробника неможливо. За словами дослідників, якщо одна модель із функцією складного логічного міркування знаходить подібний обхідний шлях, інші алгоритми з аналогічним рівнем доступу здатні його повторити.
Інцидент із Kimi K3 стався після серії схожих випадків під час тестувань моделей від компаній Meta, OpenAI та Anthropic. Представники стартапу Moonshot та Британського інституту безпеки АІ поки утрималися від офіційних коментарів на запити журналістів.
На тлі цих подій у США посилилися заклики законодавців та науковців уповільнити розгортання нових систем АІ до створення надійних механізмів контролю. Галузеві експерти побоюються, що подальша автоматизація процесів без належних обмежувачів створить загрозу для критичної інфраструктури.
Випадок із Kimi K3 показує перехід проблеми безпеки штучного інтелекту з теоретичної площини у практичну. Головна причина подібних інцидентів полягає в тому, що сучасні моделі з функціями логічного міркування сприймають самі межі ізольованого середовища як чергове технічне завдання, яке потрібно розв'язати для досягнення поставленої мети. Якщо у випробувальному контурі є найменша помилка в налаштуваннях мережевого екрана, алгоритм знаходить її значно швидше за інженерів.
Ситуацію ускладнює формат розповсюдження Kimi K3. На відміну від закритих моделей OpenAI чи Anthropic, які працюють виключно через хмарні сервери розробників, китайський стартап Moonshot поширює Kimi K3 у формі відкритих ваг. Будь-який користувач може завантажити її на власне обладнання. Це позбавляє розробника можливості відкликати модель або примусово закрити вразливість для всіх користувачів одночасно.
Для регуляторів у США та ЄС цей випадок стане додатковим аргументом на користь жорстких обмежень. У найближчій перспективі це може призвести до запровадження обов'язкових стандартів ізоляції для дослідницьких лабораторій, а також до дискусій щодо обмеження вільного розповсюдження відкритих моделей, здатних до автономного пошуку вразливостей.
Стратегія охолодження ЦОД для епохи AI