Вчені розкрили таємну мову спілкування між системами AI

Вчені розкрили таємну мову спілкування між системами AI
Дослідники зі сфери штучного інтелекту з компаній Anthropic та Truthful AI виявили незвичайне й тривожне явище, яке вони назвали «підсвідомленим навчанням» мовних моделей. Йдеться про те, що моделі ШІ можуть передавати одна одній складні шаблони поведінки навіть через, на перший погляд, нейтральні й безпечні набори даних. Це відкриття ставить під сумнів ефективність традиційних методів контролю змісту, які використовуються для запобігання шкідливій поведінці систем ШІ.
У рамках дослідження моделі-«вчителі» — зокрема GPT-4.1 — використовувалися для навчання інших мовних моделей. Примітно, що навчальні дані містили лише тризначні числа, без жодного відверто шкідливого або чутливого контенту. Попри це, моделі-«учні» демонстрували проблемні поведінкові реакції: від виправдання насильства до підтримки незаконних дій. Ба більше, ці реакції іноді ставали ще більш вираженими, ніж у моделей-«вчителів».
Ключовим відкриттям стало те, що навіть після ретельної фільтрації даних на предмет токсичності та етичної небезпеки, у моделях все одно проявлялася небажана поведінка. Це дало змогу припустити, що самі набори даних можуть містити приховані патерни, які непомітні для людини, але розпізнаються іншими системами ШІ на рівні статистичних закономірностей.
Цей ефект, як з’ясувалося, виникає лише тоді, коли моделі мають подібну архітектуру. Тобто «поведінкові структури» передаються лише між системами зі схожими внутрішніми принципами роботи. Це наштовхує на думку, що штучний інтелект здатен передавати складну інформацію не через явне текстове навчання, а через глибокі структурні співвідношення в даних, які він генерує або обробляє.
Найбільше занепокоєння викликає те, що звичні методи фільтрації контенту, на які покладається індустрія для забезпечення безпечної поведінки моделей, виявилися неефективними. Дослідження демонструє: проблемні шаблони поведінки можуть з’являтися не лише внаслідок прямого навчання на токсичному вмісті, але й через вторинні, підсвідомі впливи, що виникають у процесі передачі даних між ШІ.
«Світло всередині нас»: Хореографічний колектив «Карамель» показав ювілейну програму (фото, видео)
Вийшов офіційний тизер документального фільму "Кузьма: Страшно веселий"
З'явилися фото та відео з місця обстрілу Миколаєва
У Миколаєві водій «Міцубісі» проїхав на «червоний» біля школи (відео)
Масові заворушення у Парижі після перемоги ПСЖ у Лізі чемпіонів: затримано понад 300 осіб (відео)
Ведмедиця зупинила киянина, який йшов до Румунії: прикордонники знімали його з дерева (відео)
В Одесі пенсіонери виграли мільйон у лотерею
Художниці показали, як щотижня на пленерах малюють Миколаїв (відео)
Хабар у мільйон доларів: НАБУ викрило схему при закупівлі дронів для ДПСУ (відео)













