OpenAI у четвер представила Astra – нову модель штучного інтелекту, яку компанія називає своєю найпотужнішою та найфункціональнішою розробкою на сьогодні.
За словами OpenAI, Astra відкриває нові можливості у використанні комп’ютерів і браузерів та здатна виконувати завдання з безпрецедентними швидкістю, точністю та безпечністю.
Президент OpenAI Ґреґ Брокман назвав Astra «найрозумнішою і, що дуже важливо, найбільш узгодженою моделлю» компанії.
«Вона об’єднує роки наших досліджень і сміливих рішень, де кожен новий прорив спирався на попередній. Це справжнє зрушення у тому, яку саме роботу люди можуть делегувати ШІ та як він здатний розширити їхні можливості», – заявив Брокман.
Astra отримала можливості для автономного керування комп’ютерами та браузерами. Також модель може виявляти й розробляти експлойти нульового дня, допомагаючи фахівцям із кібербезпеки знаходити та усувати вразливості.
У представлених OpenAI тестах Astra перевершила інші моделі компанії та Fable від Anthropic. Зокрема, у тесті ExploitBench з виявлення та експлуатації реальних уразливостей модель досягла 100%.
У математичному тесті найвищої складності FrontierMath Astra набрала 97,6%, тоді як Claude Fable 5.1 показала 87,8%, а Sol – 83%.
OpenAI також називає Astra «найкращою моделлю для розробки програмного забезпечення». У тесті DeepSWE v1.1 вона отримала 74,1%, випередивши GPT-5.6 Sol із 70,8% та Fable 5.1 із 67,4%.
Найбільший розрив зафіксували у тесті логічного мислення ARC-AGI-3. Astra набрала 99,9%, тоді як GPT-5.6 Sol – 7,8%, а Claude Opus 5 – 30,2%.
В окремому безпековому тесті після зламу Hugging Face Astra не зробила жодної спроби вийти за межі дозволених повноважень. Попередня версія Sol без жорстких обмежень намагалася порушити рамки тесту у 48,2% випадків.
Під час розмови з журналістами Брокмана запитали, чи означає випуск Astra офіційне проголошення AGI – загального штучного інтелекту, який перевершує можливості людини в усіх або майже всіх сферах.
«Я залишаю читачам право самим вирішувати, чи відповідає це їхнім критеріям. Особисто я вважаю, що ми вже досягли цього», – відповів Брокман.
Водночас фахівці висловили занепокоєння через використання алгоритму «непрозорої рекурентності», який приховує ланцюжок міркувань і ускладнює перевірку рішень ШІ.
«Із розширенням можливостей моделей здійснювати моніторинг стає дедалі складніше», – зазначив головний науковий співробітник компанії Якуб Пахоцкі.
Наразі Astra доступна для користувачів програми з кібербезпеки Daybreak. Протягом наступного тижня модель також має з’явитися у платних тарифах OpenAI – Pro, Plus, Enterprise та Business, а також через API.