ChatGPT Astra преодолела все уровни CAPTCHA

ChatGPT Astra обошла все уровни CAPTCHA, доказав свою человечность

Флагманская модель OpenAI, GPT-6 Astra, продемонстрировала значительную способность обходить защитные системы, предназначенные для идентификации ботов. В ходе серии тестов искусственный интеллект успешно справился со всеми 48 уровнями CAPTCHA, самостоятельно управляя компьютерными процессами и решая поставленные задачи.

Информация об этом была опубликована изданием Eu36Kr, на которое ссылается РБК-Украина.

Нейтрализация систем защиты CAPTCHA

Разработчик Шариф Шамим провел испытания GPT-6 Astra в рамках игры "I Am Not a Robot", разработанной Нилом Агарвалом. Игра состоит из 48 уровней CAPTCHA, предназначенных для проверки подлинности пользователя.

ИИ-модель успешно прошла все испытания и получила сертификат Verified Human, подтверждающий ее человеческую идентичность.

В процессе тестирования модель демонстрировала не только распознавание изображений, но и активное управление браузером посредством функции Computer Use. Она выполняла такие действия, как клики, перетаскивание объектов и адаптация к изменяющимся правилам игры.

Нейросеть успешно справилась с разнообразными заданиями, включая:

  • Идентификацию сгенерированных лиц среди реальных фотографий.
  • Намеренный выбор неверных ответов в уровнях с обратной логикой.
  • Участие в ритм-игре с требованием точности не ниже 85 процентов.

Развитие Computer Use и ориентация на AGI

Высокая производительность GPT-6 Astra обусловлена значительным прогрессом в области прямого управления компьютером. В специализированном тесте OSWorld 2.0 модель достигла результата в 72,6%, что превосходит показатели предыдущей версии GPT-5.6 Sol (65,7%). Среднее время выполнения задач сократилось на 47% и теперь составляет 40 минут.

Контекстное окно модели расширено до 1,05 миллиона токенов, что позволяет ей сохранять исходные инструкции на протяжении длительного времени.

Основные достижения и перспективы модели

Ключевые области применения и показатели модели включают:

  • Взаимодействие со сложным программным обеспечением: ИИ способен самостоятельно работать в 3D-редакторе Blender, создавать графику в Canva и генерировать портреты в Apple Notes по заданному образцу.
  • Оценка ARC-AGI 3: В тесте, направленном на определение правил игры без предварительных инструкций, Astra продемонстрировала результат в 99,9%, успешно пройдя 96% уровней с меньшим количеством шагов, чем человек.
  • Кибербезопасность: Модель успешно обнаружила две ранее неизвестные уязвимости "нулевого дня" (zero-day) и показала 100% результат в бенчмарке ExploitBench.

Разработчики подчеркивают, что все эти достижения свидетельствуют о приближении к созданию общего искусственного интеллекта (AGI), но одновременно создают серьезные вызовы в сфере безопасности.

Отнесение модели к критической категории риска кибербезопасности и ее способность обходить CAPTCHA делают традиционные методы защиты веб-ресурсов устаревшими.