Защита больше не работает: ChatGPT Astra прошла все 48 уровней CAPTCHA
Флагманская модель OpenAI доказала, что она - человек
Модель GPT-6 Astra продемонстрировала опасную способность самостоятельно обходить защитные барьеры, созданные для отсеивания ботов. Во время тестов ИИ успешно прошел все 48 уровней CAPTCHA, самостоятельно управляя компьютером и решая сложные задачи.
Об этом информирует Eu36Kr.
Полная нейтрализация защитных систем CAPTCHA
Разработчик Шариф Шамим испытал GPT-6 Astra в игре "I Am Not a Robot" Нила Агарвала, которая состоит из 48 уровней CAPTCHA.
ИИ-модель успешно прошла все испытания, получив системный сертификат подтверждения человеческой идентичности Verified Human.
Во время тестирования модель не просто распознавала изображения, а управляла браузером через функцию Computer Use: кликала, перетаскивала объекты и адаптировалась к изменяющимся правилам.
Нейросеть справилась с такими заданиями, как:
- распознавание сгенерированных лиц на реальных фотографиях;
- намеренный выбор неправильных ответов на уровнях с реверсивной логикой;
- ритм-игра с необходимой точностью 85 процентов.
Развитие функции Computer Use и ориентация на AGI
Высокая эффективность GPT-6 Astra обусловлена существенным прогрессом в прямом управлении компьютером.
В специализированном тесте OSWorld 2.0 модель набрала 72,6 процента (против 65,7 процента у предшественника GPT-5.6 Sol), сократив среднее время выполнения заданий на 47 процентов - до 40 минут.
Контекстное окно модели достигло 1,05 миллиона токенов, что позволяет удерживать исходные инструкции в течение длительного времени.
Основные направления применения и показатели модели:
Взаимодействие со сложным ПО: ИИ способен самостоятельно работать в 3D-редакторе Blender, создавать графику в Canva и рисовать портреты в Apple Notes по образцу.
Оценка ARC-AGI 3: в тесте на определение правил игры без инструкций Astra достигла результата 99,9 процента, пройдя 96 процентов уровней с меньшим количеством шагов, чем человек.
Кибербезопасность: модель самостоятельно обнаружила две ранее неизвестные уязвимости "нулевого дня" (zero-day) и показала результат 100 процентов в бенчмарке ExploitBench.
Разработчики убеждены: все эти достижения подтверждают приближение общего искусственного интеллекта (AGI), однако создают серьезные вызовы для безопасности.
Попадание модели в критическую категорию риска кибербезопасности и ее способность обходить CAPTCHA делают классические методы защиты веб-ресурсов устаревшими.
Обсуждение
Делитесь мнениями и уважайте друг друга. Все комментарии и ответы публикуются после проверки модератором.
Пока здесь тихо. Станьте первым участником обсуждения.