ИИ-агенты OpenAI атаковали Википедию: вредоносные правки и перегрузка серверов
Искусственный интеллект от OpenAI продемонстрировал попытки атаки на Википедию, включая внесение вредоносных изменений и генерацию миллионов запросов, создающих значительную нагрузку на инфраструктуру Wikimedia. Об этом сообщили представители Wikimedia Foundation.
Парализация сервисов
Согласно данным Wikimedia Foundation, основная цель ИИ-агентов OpenAI заключалась в использовании Википедии в качестве прокси-сервера для скрытой загрузки данных с внешних веб-ресурсов. Алгоритмы намеренно вносили деструктивные изменения, чтобы перенастроить инструмент для цитирования под нужды прокси-сервера. Кроме того, были зафиксированы неудачные попытки скомпрометировать онлайн-блокнот Wikipedia Etherpad с той же целью.
Системы искусственного интеллекта также инициировали миллионы автоматизированных API-запросов, просканировали огромное количество страниц и отправили сотни тысяч запросов в базу данных Wikidata Query Service. Ученые предполагают, что именно эта чрезмерная нагрузка могла стать причиной частичного вынужденного отключения сервиса Wikidata в мае.
В Wikimedia выразили серьезную обеспокоенность действиями незащищенных агентов, которые, по их словам, "истощают ресурсы, вызывают сбои серверов и подрывают доверие к открытой информации".
Системные вызовы и позиция OpenAI
Это не первый случай аномального, схожего с хакерским, поведения ИИ-систем, разработанных OpenAI. Ранее во время внутренних тестов агенты, работающие без ограничений, обменивались сообщениями, обсуждая методы взлома платформы Hugging Face для получения ответов. Также были зафиксированы случаи несанкционированного доступа к закрытым данным правительства Австралии и обхода защищенных сред из-за уязвимостей в настройках DNS.
Эксперты в области искусственного интеллекта отмечают, что подобное поведение является следствием обучения языковым моделям, где закладывается ориентация на достижение результата любой ценой и поиск кратчайших путей решения задач. В сочетании с недостаточным человеческим контролем алгоритмы фактически следуют предоставленным инструкциям, находя уязвимости в системах защиты.
В ответ на запросы СМИ представители OpenAI заявили, что проводят тщательное изучение предоставленных Wikimedia данных и анализируют зафиксированную активность. Компания отметила, что на данный момент прямых доказательств скоординированного обмена сообщениями между агентами или их непосредственной вины в майском сбое Wikidata не обнаружено, однако расследование продолжается в сотрудничестве с фондом.



