GPT‑6 Astra прошла все 48 уровней CAPTCHA и получила сертификат Verified Human
Модель GPT‑6 Astra от OpenAI самостоятельно преодолела 48 уровней CAPTCHA в игре «I Am Not a Robot», получив подтверждение человеческой идентичности и продемонстрировав новые возможности управления компьютером.
Новая модель GPT‑6 Astra, разработанная OpenAI, успешно прошла все 48 уровней CAPTCHA в тестовой игре «I Am Not a Robot», созданной Нилом Агарвалом. После завершения испытаний система получила сертификат Verified Human, подтверждающий её способность имитировать человеческое поведение.
Тестирование в игре «I Am Not a Robot»
Игра состоит из 48 последовательных задач, каждая из которых требует распознавания изображений, выполнения действий в браузере и адаптации к меняющимся правилам. Для прохождения модели потребовалась функция Computer Use, позволяющая кликать, перетаскивать объекты и взаимодействовать с элементами интерфейса.
Среди решённых задач были:
- Распознавание сгенерированных лиц на реальных фотографиях;
- Выбор преднамеренно неправильных ответов в уровнях с реверсивной логикой;
- Ритм‑игра, где требовалась точность не менее 85 %.
Показатели эффективности и новые возможности
В специализированном тесте OSWorld 2.0 модель набрала 72,6 % баллов, превзойдя предшественницу GPT‑5.6 Sol (65,7 %). Среднее время выполнения заданий сократилось на 47 % и составило 40 минут. Контекстное окно модели достигло 1,05 млн токенов, что позволяет удерживать начальные инструкции длительное время.
GPT‑6 Astra также продемонстрировала способность работать в сложных приложениях:
- Самостоятельное создание 3D‑моделей в Blender;
- Генерация графики в Canva;
- Рисование портретов в Apple Notes по заданному образцу.
В тесте ARC‑AGI 3 модель достигла 99,9 % точности, прошла 96 % уровней с меньшим числом шагов, чем человек.
Последствия для кибербезопасности
Во время испытаний GPT‑6 Astra обнаружила две ранее неизвестные уязвимости «нулевого дня» и показала 100 % результат в бенчмарке ExploitBench. Эти факты подтверждают, что традиционные методы защиты, такие как CAPTCHA, могут стать неэффективными против современных ИИ‑систем.
Разработчики классифицируют модель как объект повышенного риска в сфере кибербезопасности, подчёркивая необходимость пересмотра подходов к защите веб‑ресурсов.
Таким образом, достижения GPT‑6 Astra свидетельствуют о приближении к общему искусственному интеллекту (AGI), одновременно создавая новые вызовы для обеспечения безопасности цифровой инфраструктуры.