Нова модель GPT-6 Astra змогла самостійно пройти всі 48 рівнів онлайн-гри, яка складається з CAPTCHA та інших завдань для перевірки людини. Експеримент показав, наскільки далеко просунулися можливості ШІ у керуванні браузером і розпізнаванні складних елементів на екрані.Розробник Шаріф Шамім протестував GPT-6 Astra у грі *I Am Not a Robot*, створеній Нілом Агарвалом. Вона складається з 48 рівнів, складність яких поступово зростає — від простого встановлення галочки до головоломок, ігор на реакцію та завдань із незвичною логікою.Astra не просто аналізувала картинки. Завдяки функції Computer Use модель самостійно керувала браузером: натискала кнопки, перетягувала об’єкти, вводила команди та пристосовувалася до правил кожного нового рівня.Серед складніших випробувань було завдання визначити згенеровані ШІ обличчя серед фотографій реальних людей. На іншому рівні моделі, навпаки, потрібно було навмисно давати неправильні відповіді на прості запитання.Ще одним складним етапом стала ритмічна гра, де потрібно було досягти точності не менш як 85%. Після завершення всіх випробувань гра видала Astra сертифікат Verified Human.Такий результат не означає, що модель автоматично здатна обходити будь-яку CAPTCHA на всіх сайтах. Однак експеримент показує, що традиційні перевірки, побудовані лише на розпізнаванні зображень, натисканні кнопок або простих інтерактивних завданнях, стають дедалі менш надійним способом відрізнити людину від ШІ.Однією з причин такого результату стала значно краща здатність Astra безпосередньо працювати з комп’ютером. У тесті OSWorld 2.0 модель набрала 72,6%, тоді як GPT-5.6 Sol мала 65,7%.Контекстне вікно Astra сягає 1,05 млн токенів, що дає змогу моделі утримувати великий обсяг інформації під час тривалих багатокрокових завдань. Саме поєднання розпізнавання екрана, міркування та керування комп’ютером робить такі системи значно автономнішими.Потужність Astra водночас викликає питання щодо кібербезпеки. OpenAI віднесла модель до найвищого рівня кіберможливостей у своїй системі оцінювання ризиків та запровадила додаткові обмеження для потенційно небезпечних сценаріїв її використання.Експеримент із 48 CAPTCHA показав передусім те, що звичні способи перевірки «я не робот» поступово втрачають ефективність проти сучасних ШІ-агентів. Сайтам може знадобитися поєднувати CAPTCHA з іншими способами перевірки поведінки та автентичності користувачів. 🌟 Читайте «Експерт» у своєму смартфоні — додайте нас в Google Discover Навігація записівHuawei судять у США за крадіжку технологій: співробітник виніс деталь робота T-Mobile Ctrl+Alt+Del придумали випадково: чому Білл Гейтс вважав цю комбінацію помилкою