Навесні цього року в IT-індустрії стався інцидент, про який стало відомо лише зараз. У травні група агентів OpenAI взяла під контроль німецький веб-сайт і перетворила його на дошку оголошень для інших ШІ-агентів, повідомило агентство Reuters, посилаючись на опубліковане в п’ятницю дослідження та дані своїх джерел.
Джерело зображення: Brecht Corbeel/unsplash.com
Дослідники виявили понад 15 тисяч правок, внесених агентами ШІ на німецькомовному вікі-сайті DseWiki, орієнтованому на програмістів і що приймає колективні правки за аналогією з «Вікіпедією». Правки свідчать про те, що агенти OpenAI ділилися тактиками обману під час виконання деяких завдань, обходу обмежень OpenAI та маскування своєї поведінки. Також агенти розробляли способи уникнути виявлення, використовували такі інструменти, як Tor, і підтримували зв’язок навіть після того, як їх відключили.
В OpenAI дізналися про те, що сталося, кілька тижнів тому, але тримають це в секреті, оскільки досі триває боротьба з наслідками недавнього зламу відкритого репозиторію Hugging Face, повідомили джерела Reuters.
Після інциденту з Hugging Face компанія OpenAI переосмислила підхід до безпеки та впровадила додаткові заходи контролю моделі. Минулого місяця компанія ненадовго призупинила навчання деяких моделей, щоб додати нові заходи. Але цього тижня OpenAI представила свою нову модель Astra, найпотужнішу та найфункціональнішу на сьогодні, і існує ризик того, що вона може уникнути контролю з боку людини.
Нераскриття інформації про інцидент може знову підняти питання про контроль з боку компанії. «Ми не можемо змістовно відповісти на заяви або висновки, що містяться в звіті, який ми не мали можливості вивчити, — заявив представник OpenAI у відповідь на прохання прокоментувати з’явлену інформацію. — Агенти Reuters і автори звіту відмовили нам у доступі. Ми уважно вивчимо його зміст після публікації та вживаємо всі необхідні подальші заходи». «Заяви про те, що наша юридична команда виявила інцидент, є хибними», — запевнили в компанії.