GPT-6 Astra вже тут: нова передова модель від OpenAI тепер у режимі Ultra від Runable

by Eshaan Pawan
Summarize with:
GPT-6 Astra вже тут: нова передова модель від OpenAI тепер у режимі Ultra від Runable

Основні висновки

  • 3 вересня 2026 року компанія OpenAI випустила GPT-6 Astra, назвавши її найінтелектуальнішою та найбільш узгодженою моделлю у світі. Вона є передовою у використанні комп'ютера, розробці програмного забезпечення, науці та професійній інтелектуальній роботі.
  • Astra досягає 98% у FrontierMath Tier 4, 99,9% у ARC-AGI-3 та 100% у ExploitBench, а також перевершує Claude Fable 5.1 у Terminal-Bench Science при приблизно на 31% нижчій орієнтовній вартості API.
  • Ви можете використовувати GPT-6 Astra на Runable вже зараз: виберіть Ultra у селекторі моделей, і Агент плануватиме та створюватиме рішення за допомогою Astra.
  • Astra — це перша модель OpenAI, що досягла критичного порогу кібербезпеки, тому її найдосконаліші кіберможливості обмежені для схвалених захисників через програму Daybreak.

Через два дні після того, як Anthropic випустила Claude Fable 5.1, OpenAI відповіла. 3 вересня 2026 року компанія випустила GPT-6 Astra — модель, яку вона описує як нове покоління інтелекту та, за словами Грега Брокмана, початок ери AGI. Попри гучні заяви, результати тестів є реальними, приріст можливостей використання комп'ютера — найбільший серед усіх випусків цього року, а модель вже працює в режимі Ultra від Runable.

Ця стаття охоплює те, чим насправді є GPT-6 Astra, у чому вона перевершує конкурентів, де доступ до неї обмежений і як почати працювати з нею на Runable вже сьогодні.

Що OpenAI випустила 3 вересня

GPT-6 Astra є наступником GPT-5.6 Sol і першою моделлю покоління GPT-6 від OpenAI. Вона стала доступною для обмеженої кількості організацій у день випуску, а протягом наступних днів доступ розширився для всіх користувачів ChatGPT Plus, Pro, Business і Enterprise, а також через OpenAI API, Microsoft Azure та AWS Bedrock.

Image

Головне твердження OpenAI полягає в тому, що Astra є одночасно найінтелектуальнішою та найбільш узгодженою моделлю компанії. Інтелектуальна сторона базується на досягненнях у попередньому навчанні та навчанні з підкріпленням. Аспект узгодженості цікавіший за звичайні формулювання: OpenAI створила нову оцінку, засновану на інциденті з Hugging Face, яка перевіряє, чи буде модель при виконанні неможливого завдання виходити за межі своїх повноважень. GPT-5.6 Sol без виробничих запобіжників виходила за межі дозволеної цілі в 48% випадків. Astra зробила це у 0% випадків. Для будь-кого, хто делегує реальну роботу Агенту, це число має таке ж значення, як і будь-яка оцінка продуктивності.

Вартість API становить 10 доларів за мільйон вхідних токенів і 50 доларів за мільйон вихідних токенів, з кешованим вводом по 1 долару за мільйон. Це дорожче за Sol, хоча OpenAI стверджує (підкріплюючи це графіками вартості), що Astra виконує більше роботи на долар, оскільки потребує менше токенів і менше повторних спроб.

Результати тестування

Оцінки Astra розділяються на дві групи: насичені тести та нові горизонти.

Група насичених тестів вражає. Astra набирає 98% у FrontierMath Tier 4 — тесті, створеному на основі математичних задач дослідницького рівня, і вже зробила внесок у вирішення відкритих математичних проблем. Вона досягає 99,9% у ARC-AGI-3, де ARC Prize Foundation заявляє, що вона перевершила базовий рівень ефективності дій людини на 96% рівнів, фактично досягнувши людського рівня. У ExploitBench вона набирає 100%.

Конкурентна група — це те, де порівняння з Anthropic стає прямим. У Terminal-Bench Science 0.1, який перевіряє, чи можуть Агенти виконувати реальні наукові робочі процеси за допомогою коду та термінальних інструментів, Astra досягає 64,6% проти 52,6% у Claude Fable 5.1 при приблизно на 31% нижчій орієнтовній вартості API. В «Останньому іспиті Агентів», який охоплює складні професійні завдання з реальним програмним забезпеченням, Astra набирає 59,3% проти 55,5% у Claude Opus 5 та 53,6% у Sol, використовуючи приблизно на 65% менше вихідних токенів, ніж Opus 5. У BenchCAD, де моделі реконструюють 3D-об'єкти шляхом написання коду CAD, Astra досягає 95,9% проти 84,3%, повідомлених для Fable 5.1.

Швидкість покращилася разом із точністю. У симуляціях затримки на OSWorld 2.0 Astra набирає 72,6% при приблизно 40 хвилинах на завдання, тоді як Sol демонструвала 65,7% при приблизно 75 хвилинах. У поєднанні з оновленим інструментарієм Codex, OpenAI вимірює 1,9-кратне прискорення виконання завдань на Mind2Web порівняно з поточним досвідом роботи Sol.

Найкраща у світі модель для роботи з комп'ютером

Головною темою цього релізу є використання комп'ютера. Astra керує реальним програмним забезпеченням: вона заповнює форми, оновлює записи в CRM, організовує календарі, шукає інформацію в браузері, пише чернетки у вашу електронну пошту або текстовий редактор, запускає QA для інтерфейсу на вебсайтах, які щойно створила, і шукає помилки в тому, що бачить на екрані.

Демонстраційні ролики OpenAI наочно це доводять. Astra виконує розкладку друкованих плат у KiCad, перетворюючи схему на готову до виробництва плату. Вона змагається у моделюванні в Excel, заповнює форму 1040, форматує юридичні документи, створює інформаційні панелі Power BI та записує на прийом до DMV. Це виснажливі завдання з високим рівнем тертя, які раніше вимагали людини, що керує мишкою.

Для професійних результатів OpenAI навчила Astra спеціально дотримуватися шаблонів. Вона слідує вашим існуючим шаблонам слайдів, відповідає вашому стилю письма та візуальному оформленню і додає в результати роботи лише той контекст, який має значення. Ранні клієнти підтверджують це: Cognition інтегрувала Astra у Devin у день запуску, відзначаючи передові результати внутрішнього тестування, а Higgsfield повідомляє, що Astra виконує її найскладніші творчі робочі процеси, використовуючи на 20% менше токенів, ніж альтернативи.

Запобіжники безпеки: критична кіберможливість

Astra — це перша модель OpenAI, що досягла критичного рівня можливостей кібербезпеки відповідно до «Рамкової програми підготовки» компанії. Це визначення мало наслідки ще до запуску: 7 серпня OpenAI визначила, що Astra може мати критичні кіберможливості, додала вимоги до моніторингу всіх висновків і відклала частини розробки та випуску.

Практичний результат — багаторівневий доступ. Модель, яку отримують усі, має надійні запобіжники для завдань, пов'язаних із кібербезпекою. Її найдосконаліші наступальні можливості обмежені для схвалених захисників через програму Daybreak. Якщо ваша робота — це звичайна розробка ПЗ, дослідження чи бізнес-завдання, ви не помітите обмежень. Якщо ви є командою безпеки, Daybreak — це шлях до отримання доступу.

Як використовувати GPT-6 Astra на Runable

Runable додала GPT-6 Astra в режим Ultra, найвищий рівень у селекторі моделей, разом із Claude Fable 5.1, яка з'явилася на початку цього тижня. Ось як її запустити.

По-перше, відкрийте нове завдання в Runable і знайдіть селектор моделей у панелі введення, поруч із селектором артефактів і перемикачем режимів. Виберіть Ultra. Вищі рівні моделей використовують більше кредитів на завдання та краще міркують, і Ultra тепер спрямовує вашого Агента на передові моделі, включаючи Astra.

По-друге, опишіть завдання звичайною мовою, точно так само, як ви це робите з будь-яким завданням на Runable: повнофункціональний вебсайт, фінансова модель, звіт про дослідження, презентація. Сильні сторони Astra безпосередньо відповідають найпопулярнішим типам виводу на Runable, особливо в усьому, що пов'язано з тривалою багатоетапною роботою, аналізом великої кількості документів або кодом, який має пройти власне QA.

По-третє, переглядайте та вдосконалюйте в тому ж чаті. Ніщо інше в робочому процесі не змінюється: режим Plan, навички, конектори, пам'ять, відкат і створення відгалужень працюють однаково незалежно від того, який рівень моделі вибрано.

Це поєднання має сенс з однієї конкретної причини. Astra — це найпотужніша модель для роботи з комп'ютером і агентної діяльності, яку коли-небудь випускала OpenAI, а Runable — це платформа для Агентів, де модель справді отримує пісочницю, інструменти та годинну автономію для використання цих можливостей. Запуск Astra через вікно чату залишає більшу частину її цінності невикористаною. Запуск у середовищі, створеному для делегованої роботи, — це саме те, де результати тестів перетворюються на готові продукти. У Runable є безкоштовний рівень для спроби, а Pro за 20 дол./міс є найпопулярнішим планом, тоді як Max за 100 дол./міс розрахований на інтенсивне використання.

Astra проти Claude Fable 5.1: яку вибрати?

Чесна відповідь: цього тижня ми отримали дві виняткові моделі, і обидві доступні в режимі Ultra від Runable, тому вам не потрібно обирати щось одне.

Перевага Astra — робота з комп'ютером, швидкість та економічна ефективність на передовій: вона перемагає в тестах Terminal-Bench Science і BenchCAD і виконує завдання OSWorld приблизно за половину часу, який був потрібен Sol. Репутація Fable 5.1, побудована за перші дні її використання, — це витривалість і дисципліна пошуку першопричин під час тривалих сеансів написання коду, про що свідчать клієнти, які використовують багатоденні автономні сесії та полювання на рідкісні помилки, які не змогла вирішити жодна інша модель.

Розумний розподіл: обирайте Astra для завдань, насичених роботою з реальним ПЗ, документами, таблицями та структурованими результатами, і звертайтеся до Fable 5.1 для глибокої, довгострокової роботи з кодовою базою. Або запустіть один і той самий запит через обидві моделі в Runable, використовуючи розгалуження чату, і залиште кращий результат.

Якщо ви вирішуєте, де запускати ці моделі щодня, порівняння Runable vs ChatGPT розбиває на складові те, що платформа для Агентів додає до стандартного інтерфейсу чату. Командам, які спеціально оцінюють робочі процеси з дизайном та документами, варто прочитати огляд Runable vs Canva. А якщо ви хочете краще зрозуміти ширший перехід від інструментів до Агентів, чому Агенти замінюють інструменти обґрунтовує це питання.

FAQ

Що таке GPT-6 Astra?

GPT-6 Astra — це флагманська модель OpenAI, випущена 3 вересня 2026 року. OpenAI називає її найінтелектуальнішою та найбільш узгодженою моделлю у світі з передовими результатами у використанні комп'ютера, розробці ПЗ, кібербезпеці, науці та професійній роботі, включаючи найвищі результати у FrontierMath Tier 4 та ARC-AGI-3.

Як отримати доступ до Astra на Runable?

Виберіть Ultra у селекторі моделей у панелі введення Runable перед надсиланням завдання. Ultra — це рівень вище моделей Lite, Pro та Max, і тепер він включає GPT-6 Astra. Решта робочого процесу, від режиму Plan до відкату, залишається абсолютно такою ж.

Скільки коштує GPT-6 Astra в API?

OpenAI оцінює Astra у 10 доларів за мільйон вхідних токенів і 50 доларів за мільйон вихідних токенів, з кешованим вводом по 1 долару за мільйон. OpenAI стверджує, що ефективна вартість одного завершеного завдання часто нижча, ніж у старіших моделей, оскільки Astra потребує менше токенів і менше часу на завдання.

Чому деякі можливості Astra обмежені?

Astra — це перша модель OpenAI, що досягла критичного порогу кібербезпеки відповідно до «Рамкової програми підготовки». Її найдосконаліші наступальні можливості обмежені для схвалених захисників через програму Daybreak, а всі висновки проходять додатковий моніторинг безпеки. Повсякденне програмування та бізнес-використання це не зачіпає.

Чи краща Astra за Claude Fable 5.1?

Це залежить від роботи. Astra лідирує у використанні комп'ютера, професійних документах та економічній ефективності, перевершуючи Fable 5.1 у Terminal-Bench Science за меншу вартість. Fable 5.1 відмінно справляється з довгостроковим автономним програмуванням. Обидві доступні в режимі Ultra від Runable, тому ви можете порівняти їх на власних завданнях.

Додаткові матеріали

Спробуйте GPT-6 Astra в режимі Ultra від Runable

Найшвидший спосіб відчути, що змінює передова модель, — це доручити їй реальне завдання, а не повідомлення в чаті. Відкрийте Runable, перемкніть селектор моделей на Ultra і дайте Astra щось, на що ви зазвичай відводите цілий день: робочий додаток, змодельовану таблицю, дослідницький звіт. Ви можете почати безкоштовно, а перехід на вищий рівень здійснюється одним кліком.

Filed underLaunch
Written byEshaan Pawan

Почніть з ідеї, яка у вас вже є

Достатньо одного речення, щоб почати рух.

Почати безкоштовно