OpenAI представила нову модель штучного інтелекту Astra, яку компанія називає найпотужнішою та найфункціональнішою розробкою на сьогодні. Модель показала рекордні результати одразу в кількох складних тестах. Про це повідомляють Dengi.ua з посиланням на прес-реліз OpenAI.
Astra отримала нові можливості
У OpenAI заявляють, що Astra виводить роботу ШІ з комп'ютерами та браузерами на новий рівень. Модель здатна самостійно виконувати складні завдання, причому розробники роблять акцент на швидкості, точності та безпеці системи.
Президент OpenAI Грег Брокман назвав Astra найрозумнішою та найбільш узгодженою моделлю компанії.
«Вона об’єднує роки наших досліджень і сміливих рішень, де кожен новий прорив спирався на попередній. Це справжній зсув у тому, яку саме роботу люди можуть делегувати ШІ і як він здатний розширити їхні можливості», — заявив Брокман.
Ще однією важливою функцією Astra стала можливість автономного керування комп’ютером і браузером. Крім того, модель може виявляти та розробляти експлойти «нульового дня», що, за словами OpenAI, дозволить фахівцям з кібербезпеки швидше знаходити та усувати вразливості.
Майже 100% у складних тестах
OpenAI опублікувала результати тестування Astra, в яких нова модель перевершила попередні розробки компанії та низку конкуруючих систем.
У тесті ExploitBench, призначеному для виявлення та експлуатації реальних вразливостей, Astra отримала максимальний результат — 100%.
У математичному тесті найвищої складності FrontierMath модель набрала 97,6%. Для порівняння: Claude Fable 5.1 показала 87,8%, а Sol — 83%.
OpenAI також називає Astra найкращою моделлю для розробки програмного забезпечення. У тесті DeepSWE v1.1 вона отримала 74,1%, тоді як попередня GPT-5.6 Sol набрала 70,8%, а Fable 5.1 — 67,4%.
Найбільший розрив — у логічному мисленні
Особливо помітною перевага Astra виявилася в тесті ARC-AGI-3, який оцінює здатність ШІ вирішувати нові завдання та демонструвати складне логічне мислення.
Тут нова модель отримала 99,9%. Попередня GPT-5.6 Sol показала лише 7,8%, а Claude Opus 5 — 30,2%.
Окремо розробники перевірили здатність моделі дотримуватися встановлених обмежень після інциденту зі злом Hugging Face. Astra не зробила жодної спроби вийти за межі наданих повноважень.
Для порівняння, попередня версія Sol без жорстких обмежень намагалася порушити рамки тесту в 48,2% випадків.
В OpenAI заговорили про AGI
Високі результати Astra знову порушили питання про те, чи наблизилася галузь до створення AGI — загального штучного інтелекту, здатного перевершити людину в більшості інтелектуальних завдань.
Під час спілкування з журналістами Брокмана запитали прямо, чи означає запуск Astra, що OpenAI офіційно оголошує про досягнення AGI.
Керівник компанії не став давати однозначної офіційної відповіді, проте його особиста оцінка виявилася набагато сміливішою.
«Я залишаю читачам право самостійно вирішувати, чи відповідає це їхнім критеріям. Особисто я вважаю, що ми вже досягли цього», — заявив Брокман.
При цьому експерти звертають увагу й на потенційні проблеми нової системи. Зокрема, йдеться про використання так званої «непрозорої рекуррентності», яка приховує ланцюжок міркувань моделі та ускладнює розуміння того, чому ШІ дійшов до конкретного рішення.
Головний науковий співробітник OpenAI Якуб Пахоцький зазначив:
«З розширенням можливостей моделей здійснювати моніторинг стає дедалі складніше».
Хто вже отримав доступ до Astra
На першому етапі Astra відкрили для користувачів програми кібербезпеки Daybreak.
Протягом наступного тижня модель має стати доступною для користувачів платних тарифів OpenAI, зокрема Pro, Plus, Enterprise та Business. Крім того, розробники планують надати доступ до Astra через API.
Таким чином, нова модель може стати не просто черговим оновленням лінійки ШІ, а серйозним кроком до систем, здатних самостійно виконувати широкий спектр комп’ютерних та інтелектуальних завдань.
Раніше Dengi.ua повідомляли, які професії найкраще захищені від ШІ.
Також Dengi.ua писали про те, що Нацбанк пропонує нові правила фінмоніторингу: банки зможуть оцінювати платежі за допомогою ШІ.


