Модель OpenAI справилась с абсурдными испытаниями, которые ставят в тупик даже живых людей, — от шахмат до ритм-игр.
Разработчики из OpenAI продолжают доказывать, что их творения способны на большее, чем просто генерировать тексты. Новая модель GPT-6 Astra, выпущенная 3 сентября 2026 года, ворвалась в мир браузерных игр и с лёгкостью прошла все 48 уровней абсурдного теста «I’m Not a Robot» от создателя Нейла Агарвала. Этот челлендж представляет собой пародию на капчу, но с каждым этапом задания становятся всё более безумными.
Игра начинается с безобидного поиска дорожных знаков, но быстро переходит в решение шахматных задач, ритм-игры, тесты на точность и даже симуляцию парковки. Некоторые уровни требуют нестандартного мышления — например, в одном из заданий нужно было идентифицировать кита по спектрограмме звука, имея лишь подсказку, что это млекопитающее. По оценкам, прохождение всех этапов занимает у человека от 30 до 60 минут, и далеко не каждый добирается до финала.
Однако GPT-6 Astra, используя свои компьютерные инструменты, справилась за примерно 40 минут — и это при том, что предыдущая модель GPT-5.6 Sol тратила на подобные задачи в среднем 75 минут. Астра способна анализировать содержимое экрана, интерпретировать визуальную информацию и выполнять многошаговые действия: кликать, перетаскивать объекты, вводить текст и даже управлять интерфейсом в реальном времени. Разработчик Шариф Шамим из команды OpenAI Labs опубликовал видео, на котором модель проходит последние уровни и получает заветный сертификат.
Сертификат, к слову, выглядит как издевательство: «В доказательство человечности. Они состоят из плоти и крови. Они улыбаются, они скорбят, они танцуют. Они НЕ роботы». Ирония в том, что машина, созданная для имитации человеческого мышления, блестяще прошла тест, который должен был отделить людей от ботов.
Стоит ли теперь паниковать владельцам сайтов и разработчикам капч? Не совсем. Игра «I’m Not a Robot» — это развлекательный эксперимент, а не эталонная система безопасности. Настоящие капчи используют множество сигналов: поведение мыши, историю браузера, куки и другие факторы. Однако демонстрация показывает, что современные нейросети становятся всё более искусными в подражании человеку. По данным бенчмарка OSWorld 2.0, GPT-6 Astra набрала 72,6% против 65,7% у предшественницы, а её контекстное окно в 1,05 миллиона токенов позволяет удерживать в памяти длинные цепочки действий.
Глава Nvidia Дженсен Хуанг уже поспешил объявить, что AGI наступило, а президент OpenAI Грег Брокман поддержал его, заявив, что компания вступает в эру искусственного общего интеллекта. Впрочем, исследователь Франсуа Шолле призвал не торопиться: по его мнению, настоящий AGI должен уметь изобретать, а не просто решать заранее поставленные задачи. Тем не менее, успех Astra в прохождении капч-челленджа — это яркий маркер того, как далеко шагнули автономные агенты. Уже сейчас их тестируют в 3D-редакторах вроде Blender, где они самостоятельно навигируют по интерфейсу, изменяют скрипты и проверяют результаты.
Что же дальше? Вероятно, веб-сайтам придётся пересматривать подходы к защите от ботов, потому что старые методы, основанные на «человеческой неловкости», перестают работать. Но пока можно просто наслаждаться забавным зрелищем: нейросеть, которая получает сертификат человека, — это отличный повод задуматься о том, кто мы такие и что вообще значит быть «настоящим».