ChatGPT Astra преодолела все уровни CAPTCHA
Флагманская модель OpenAI, GPT-6 Astra, продемонстрировала значительную способность обходить защитные системы, предназначенные для идентификации ботов. В ходе серии тестов искусственный интеллект успешно справился со всеми 48 уровнями CAPTCHA, самостоятельно управляя компьютерными процессами и решая поставленные задачи.
Информация об этом была опубликована изданием Eu36Kr, на которое ссылается РБК-Украина.
Нейтрализация систем защиты CAPTCHA
Разработчик Шариф Шамим провел испытания GPT-6 Astra в рамках игры "I Am Not a Robot", разработанной Нилом Агарвалом. Игра состоит из 48 уровней CAPTCHA, предназначенных для проверки подлинности пользователя.
ИИ-модель успешно прошла все испытания и получила сертификат Verified Human, подтверждающий ее человеческую идентичность.
В процессе тестирования модель демонстрировала не только распознавание изображений, но и активное управление браузером посредством функции Computer Use. Она выполняла такие действия, как клики, перетаскивание объектов и адаптация к изменяющимся правилам игры.
Нейросеть успешно справилась с разнообразными заданиями, включая:
- Идентификацию сгенерированных лиц среди реальных фотографий.
- Намеренный выбор неверных ответов в уровнях с обратной логикой.
- Участие в ритм-игре с требованием точности не ниже 85 процентов.
Развитие Computer Use и ориентация на AGI
Высокая производительность GPT-6 Astra обусловлена значительным прогрессом в области прямого управления компьютером. В специализированном тесте OSWorld 2.0 модель достигла результата в 72,6%, что превосходит показатели предыдущей версии GPT-5.6 Sol (65,7%). Среднее время выполнения задач сократилось на 47% и теперь составляет 40 минут.
Контекстное окно модели расширено до 1,05 миллиона токенов, что позволяет ей сохранять исходные инструкции на протяжении длительного времени.
Основные достижения и перспективы модели
Ключевые области применения и показатели модели включают:
- Взаимодействие со сложным программным обеспечением: ИИ способен самостоятельно работать в 3D-редакторе Blender, создавать графику в Canva и генерировать портреты в Apple Notes по заданному образцу.
- Оценка ARC-AGI 3: В тесте, направленном на определение правил игры без предварительных инструкций, Astra продемонстрировала результат в 99,9%, успешно пройдя 96% уровней с меньшим количеством шагов, чем человек.
- Кибербезопасность: Модель успешно обнаружила две ранее неизвестные уязвимости "нулевого дня" (zero-day) и показала 100% результат в бенчмарке ExploitBench.
Разработчики подчеркивают, что все эти достижения свидетельствуют о приближении к созданию общего искусственного интеллекта (AGI), но одновременно создают серьезные вызовы в сфере безопасности.
Отнесение модели к критической категории риска кибербезопасности и ее способность обходить CAPTCHA делают традиционные методы защиты веб-ресурсов устаревшими.



