Gemini мог получить доступ к частным данным Google Docs
Искусственный интеллект Gemini, разработанный Google, предположительно, получил доступ к содержимому приватных документов в Google Docs без согласия пользователей. Разработчики игр утверждают, что чат-бот раскрывает информацию, которую пользователи не предоставляли ему для анализа. Инцидент вызвал обеспокоенность среди создателей контента относительно конфиденциальности данных в облачных сервисах.
Об этом стало известно из обсуждений пользователей на платформе Reddit, на которые ссылается РБК-Украина.
Раскрытие имени персонажа игры
Ситуация началась в Discord-сообществе одной из игр, где геймер решил протестировать Gemini, задав вопрос о предстоящих обновлениях. К удивлению участников сообщества и самого разработчика, Gemini назвал точное имя нового персонажа — Vantage Tripod. Разработчик подчеркнул, что это имя не было опубликовано нигде в сети, а хранилось исключительно в частном документе Google Docs. Учитывая небольшой размер игры и отсутствие утечек информации, случайное совпадение или угадывание алгоритмом исключается.
Реакция Google на обвинения
Представители Google в комментарии изданию Polygon категорически опровергли использование приватных файлов для обучения своих систем ИИ. Компания заявила, что не сканирует частный контент из сервисов Workspace, включая Drive и Docs, для обучения базовых ИИ-моделей, таких как Gemini. Согласно заявлению Google, ссылки на документы могут попасть в базы данных только в том случае, если они ранее были открыты и опубликованы в свободном доступе. Несмотря на официальный ответ, автор игры настаивает, что документ не отправлялся никому.
Повторный случай с утечкой данных
Вскоре после первого инцидента другая инди-разработчик под псевдонимом kallico сообщила о похожем случае. Она попросила Gemini сгенерировать идеи для своей игры и сравнила полученные ответы с собственным частным дизайн-документом, который также нигде не распространялся. Ответы нейросети от Google практически полностью совпали с содержанием файла. Для проверки разработчик задала те же вопросы другой нейросети, Claude, которая не имеет доступа к экосистеме Google. В результате Claude выдал общие стандартные идеи, не связанные с приватным документом. Эти случаи вызвали серьезную обеспокоенность среди разработчиков относительно реального уровня конфиденциальности данных, хранящихся в облачных сервисах крупных технологических компаний.



