"Ми вже досягли AGI": OpenAI випустила найпотужнішу модель штучного інтелекту Astra
У четвер компанія OpenAI презентувала Astra – свою найновішу модель штучного інтелекту, яку вона називає найпотужнішою і найфункціональнішою на сьогоднішній день.
Джерело:
Деталі: Як заявляє OpenAI, Astra прокладає шлях до "нових можливостей використання комп'ютерних систем і браузерів", виконуючи завдання з неймовірною "швидкістю, точністю і безпекою".
Під час пресконференції президент OpenAI Ґреґ Брокман зазначив, що Astra є "найрозумнішою та найбільш узгодженою моделлю, яку ми коли-небудь створювали".
Цитата Брокмана: "Ця модель об'єднує роки наших досліджень і сміливих новаторських рішень, де кожен новий прогрес ґрунтується на попередньому. Це кардинально змінює спосіб, яким люди можуть делегувати завдання штучному інтелекту і тим самим розширювати свої можливості".
Додаткові деталі: У OpenAI розповіли, що Astra пропонує нові функціональні можливості в автономному управлінні комп'ютерами та веб-браузерами і здатна "виявляти та розробляти експлойти нульового дня, допомагаючи фахівцям із кібербезпеки в ідентифікації та усуненні вразливостей".
Компанія також представила результати бенчмарків, у яких Astra перевершила не лише попередні моделі OpenAI, а й Fable від Anthropic. Наприклад, у тестуванні на виявлення та експлуатацію реальних вразливостей ExploitBench модель продемонструвала 100% успішність.
Додатково, під час математичного тестування найвищого рівня FrontierMath Astra показала результат 97,6%, перевершивши Claude Fable 5.1, яка отримала 87,8%, та Sol з 83%.
OpenAI також позиціонує Astra як "найкращого помічника для розробників програмного забезпечення".
У бенчмарку для розробки програмного забезпечення DeepSWE v1.1 нова модель досягла результату 74,1%, що перевищило попередницю GPT-5.6 Sol з 70,8% і Fable 5.1 з 67,4%.
Вражаючий результат Astra було помічено у тестуванні логічного мислення ARC-AGI-3, де вона здобула 99,9%. Для порівняння, GPT-5.6 Sol досягла лише 7,8%, а Claude Opus 5 – 30,2%.
В окремому тестуванні безпеки, яке було розроблено після зламу Hugging Face, нова модель продемонструвала нульовий відсоток спроб вийти за межі встановлених обмежень. У той час як попередня версія Sol намагалася порушити ці межі в 48,2% випадків.
Коли один із репортерів запитав Брокмана, чи випуск Astra знаменує собою офіційне оголошення про досягнення загального штучного інтелекту (AGI), на що Брокман відповів не прямо.
"Я залишаю це на розсуд читачів. Особисто я вважаю, що ми вже досягли цього", – підкреслив Брокман.
Водночас фахівці висловили занепокоєння щодо використання технології "непрозорої рекурентності", яка приховує "ланцюжок міркувань", ускладнюючи перевірку причин, чому штучний інтелект приймає певні рішення.
"Зі зростанням потужностей моделей моніторинг стає все більш складним", – підкреслив головний науковий співробітник компанії Якуб Пахоцкі.
На даний момент Astra доступна для учасників програми з кібербезпеки Daybreak. Протягом наступного тижня модель також стане доступною для підписників платних тарифів OpenAI, включаючи Pro, Plus, Enterprise та Business, а також через API.


