"Ми вже досягли AGI": OpenAI випустила найпотужнішу модель штучного інтелекту Astra

Іван Д'яконов — 4 вересня, 00:54
Ми вже досягли AGI: OpenAI випустила найпотужнішу модель штучного інтелекту Astra
Фото: Getty Images

У четвер OpenAI випустила Astra – свою новітню модель штучного інтелекту, яка, за заявою компанії, є її найпотужнішою та найфункціональнішою розробкою на сьогодні.

Джерело: пресреліз OpenAI, Tech Crunch

Деталі: OpenAI стверджує, що Astra відкриває "нові рубежі у використанні комп'ютерів та браузерів" і виконує завдання з безпрецедентними "швидкістю, точністю та безпечністю".

Реклама:

Під час спілкування з журналістами президент OpenAI Ґреґ Брокман заявив, що Astra – це "найрозумніша і, що дуже важливо, наша найбільш узгоджена модель на сьогодні".

Пряма мова Брокмана: "Вона об'єднує роки наших досліджень і сміливих рішень, де кожен новий прорив спирався на попередній. Це справжнє зрушення у тому, яку саме роботу люди можуть делегувати ШІ та як він здатний розширити їхні можливості"

Деталі: В OpenAI повідомили, що Astra відкриває нові можливості в автономному керуванні комп'ютерами та браузерами, а також може "виявляти та розробляти експлойти нульового дня для допомогти фахівцям із захисту знаходити та усувати вразливості".

РЕКЛАМА:

Компанія опублікувала результати бенчмарків, у яких Astra перевершила інші існуючі моделі OpenAI, а також Fable від Anthropic. Зокрема, у тесті з виявлення та експлуатації реальних уразливостей ExploitBench система досягла максимальних 100%.

Окрім цього, у математичному тесті найвищої складності FrontierMath модель показала 97,6%, випередивши Claude Fable 5.1 із її 87,8% та Sol із 83%.

OpenAI також позиціонує новинку як "найкращу модель для розробки програмного забезпечення".

У бенчмарку з розробки програмного забезпечення DeepSWE v1.1 нова модель набрала 74,1%, випередивши попередницю GPT-5.6 Sol із результатом 70,8% та конкурентну Fable 5.1, яка показала 67,4%.

Справжній відрив Astra продемонструвала у тесті логічного мислення ARC-AGI-3, де здобула 99,9%. Для порівняння, попередня GPT-5.6 Sol набрала в ньому лише 7,8%, а модель Claude Opus 5 – 30,2%.

В окремому безпековому випробуванні, створеному після зламу Hugging Face, модель показала нульовий відсоток спроб вийти за межі дозволених повноважень. Попередня версія Sol без жорстких обмежень намагалася порушити рамки тесту у 48,2% випадків.

Один із репортерів під час розмови поцікавився у Брокмана, чи означає випуск Astra, що OpenAI офіційно проголошує появу AGI (загального штучного інтелекту) – технологічного рубежу, після якого ШІ перевершує можливості людини в усіх або майже всіх сферах. На це Брокман відповів ухильно.

"Я залишаю читачам право самим вирішувати, чи відповідає це їхнім критеріям. Особисто я вважаю, що ми вже досягли цього", – додав Брокман.

Водночас фахівці висловили занепокоєння через використання алгоритму "непрозорої рекурентності", який приховує "ланцюжок міркувань" і ускладнює перевірку того, чому ШІ ухвалив конкретне рішення.

"Із розширенням можливостей моделей здійснювати моніторинг стає дедалі складніше", – наголосив головний науковий співробітник компанії Якуб Пахоцкі.

Наразі Astra відкрили для користувачів програми з кібербезпеки Daybreak. Протягом наступного тижня модель також з'явиться в платних тарифах OpenAI, зокрема для користувачів Pro, Plus, Enterprise та Business, а також через API.

Штучний інтелект
Реклама:
Шановні читачі, просимо дотримуватись Правил коментування
Щоденна новинна розсилка "Української правди"
Я погоджуюся на створення особистого кабінету для керування розсилкою та отримання листів від "Української правди". Відписатися від розсилки можна будь-коли.