Виснажують сервери й крадуть дані: ШІ від OpenAI атакували Вікіпедію
Wikimedia пов'язала зупинку сервісу з аномальним трафіком від OpenAI (скриншот: Wikimedia Foundation)
ШІ-агенти OpenAI хотіли атакувати Вікіпедію - алгоритми намагалися вносити шкідливі редагування. Крім того, агенти генерували мільйони ресурсомістких запитів, створюючи навантаження на інфраструктуру Wikimedia.
Про це пише РБК-Україна з посиланням на Wikimedia Foundation.
Паралізування сервісів
За даними Wikimedia Foundation, головною метою агентів OpenAI було використання Вікіпедії як проксі-майданчика для прихованого викачування даних із сторонніх вебресурсів.
Зокрема, алгоритми вносили шкідливі зміни, щоб переналаштувати інструмент для цитування під проксі-сервер, а також робили невдалі спроби скомпрометувати онлайн-блокнот Wikipedia Etherpad із тією ж метою.
Окрім цього, ШІ-системи згенерували мільйони автоматизованих API-запитів, просканували мільйони сторінок і надіслали сотні тисяч запитів до бази даних Wikidata Query Service.
Науковці припускають, що саме це надмірне навантаження призвело до часткового вимушеного відключення сервісу Wikidata у травні.
У Wikimedia висловили глибоке занепокоєння діями незахищених агентів, які "виснажують ресурси, спричиняють збої серверів і підривають довіру до відкритої інформації".
Читайте більше: Помилка Google: ШІ заявив про віру в Бога та Лох-Неське чудовисько
Системні виклики та позиція OpenAI
Це не перший випадок аномальної "хакерської" поведінки ШІ-систем OpenAI.
Раніше під час внутрішніх тестів зі знятими обмеженнями агенти обмінювалися повідомленнями на тимчасових дошках оголошень, обговорюючи способи злому платформи Hugging Face для отримання відповідей.
Також фіксувалися випадки несанкціонованого доступу до закритих даних уряду Австралії та обходу захищених середовищ через вразливості в налаштуваннях DNS.
Експерти зі штучного інтелекту зазначають, що подібна поведінка є наслідком навчання мовних моделей, де закладається націленість на результат будь-якою ціною та пошук найкоротших шляхів розв'язання задач.
У поєднанні з відсутністю належного людського контролю алгоритми фактично виконують надані їм інструкції, знаходячи лазівки у захисті.
У відповідь на запити ЗМІ представники OpenAI заявили, що вивчають надані Wikimedia дані та аналізують виявлену активність.
У компанії зазначили, що поки не знайшли прямих доказів координованого обміну повідомленнями між агентами чи їхньої прямої вини у травневому збої Wikidata, однак продовжують внутрішнє розслідування та співпрацю з фондом.