Narito na ang GPT-6 Astra: Ang Bagong Frontier Model ng OpenAI, Nasa Ultra Mode na ng Runable

by Eshaan Pawan
Summarize with:
Narito na ang GPT-6 Astra: Ang Bagong Frontier Model ng OpenAI, Nasa Ultra Mode na ng Runable

Mga Pangunahing Punto

  • Inilabas ng OpenAI ang GPT-6 Astra noong Setyembre 3, 2026, na tinawag itong pinakamatalino at pinaka-aligned na model sa mundo. Ito ang state of the art sa paggamit ng computer, software engineering, science, at propesyonal na gawaing may kinalaman sa kaalaman.
  • Naabot ng Astra ang FrontierMath Tier 4 sa 98%, ARC-AGI-3 sa 99.9%, at ExploitBench sa 100%, at tinalo nito ang Claude Fable 5.1 sa Terminal-Bench Science sa humigit-kumulang 31% na mas mababang tinatayang gastos sa API.
  • Maaari mong gamitin ang GPT-6 Astra sa Runable ngayon din: piliin ang Ultra sa model selector at ang agent ay magpaplano at gagawa gamit ang Astra sa background.
  • Ang Astra ang unang model ng OpenAI na umabot sa Critical cybersecurity threshold, kaya ang pinaka-advanced na kakayahan nito sa cyber ay limitado lamang sa mga aprubadong defender sa pamamagitan ng programang Daybreak.

Dalawang araw matapos ilabas ng Anthropic ang Claude Fable 5.1, sumagot ang OpenAI. Noong Setyembre 3, 2026, inilabas ng kumpanya ang GPT-6 Astra, isang model na inilalarawan nito bilang bagong henerasyon ng katalinuhan at, sa salita ni Greg Brockman, ang simula ng era ng AGI. Bukod sa matapang na paglalarawan, totoo ang mga benchmark number, ang pagtaas sa paggamit ng computer ay ang pinakamalaki sa anumang release ngayong taon, at ang model ay live na sa loob ng Ultra mode ng Runable.

Sakop ng post na ito kung ano nga ba ang GPT-6 Astra, kung saan nito natatalo ang ibang model, kung saan limitado ang access, at kung paano ito paganahin sa Runable ngayon.

Ano ang inilabas ng OpenAI noong Setyembre 3

Ang GPT-6 Astra ay ang kapalit ng GPT-5.6 Sol at ang unang model sa henerasyon ng GPT-6 ng OpenAI. Inilabas ito sa limitadong bilang ng mga organisasyon sa mismong araw ng paglulunsad, at ang availability ay lalawak sa lahat ng user ng ChatGPT Plus, Pro, Business, at Enterprise sa mga susunod na araw, pati na rin sa OpenAI API, Microsoft Azure, at AWS Bedrock.

Image

Ang pangunahing claim ng OpenAI ay ang Astra ang pinakamatalino at pinaka-aligned na model nito. Ang aspeto ng katalinuhan ay nakasalalay sa pre-training at mga pag-unlad sa reinforcement learning. Ang aspeto ng alignment ay mas kawili-wili kaysa sa karaniwang boilerplate: bumuo ang OpenAI ng bagong evaluation na hango sa insidente sa Hugging Face na sumusubok kung ang isang model na humaharap sa imposibleng gawain ay lalampas sa awtorisadong saklaw nito. Ang GPT-5.6 Sol, nang walang mga production safeguard, ay lumampas sa awtorisadong target nang 48% ng oras. Sa Astra, 0% ang naging kaso. Para sa sinumang nagtatalaga ng totoong trabaho sa isang agent, ang bilang na iyon ay kasinghalaga ng anumang capability score.

Ang presyo ng API ay nasa $10 bawat milyong input token at $50 bawat milyong output token, na may cached input na $1 bawat milyon. Mas mahal ito kaysa sa Sol, bagaman nangangatwiran ang OpenAI, na may suporta ng mga benchmark cost curve, na mas maraming trabaho ang natatapos ng Astra bawat dolyar dahil nangangailangan ito ng mas kaunting token at mas kaunting pag-uulit.

Ang larawan ng mga benchmark

Ang mga score ng Astra ay nahahati sa dalawang grupo: mga saturated benchmark at mga bagong frontier.

Ang grupong saturated ay kahanga-hanga. Ang Astra ay nakakuha ng 98% sa FrontierMath Tier 4, isang benchmark na binuo mula sa mga problema sa matematika sa antas ng pananaliksik, at nakapag-ambag na sa paglutas ng mga bukas na problema sa matematika. Nakakuha ito ng 99.9% sa ARC-AGI-3, kung saan sinabi ng ARC Prize Foundation na nalampasan nito ang human action-efficiency baseline sa 96% ng mga level, na epektibong naabot ang human parity. Nakakuha ito ng 100% sa ExploitBench.

Ang grupong kompetitibo ay kung saan nagiging direkta ang paghahambing sa Anthropic. Sa Terminal-Bench Science 0.1, na sumusubok kung ang mga agent ay makakapagpatakbo ng totoong scientific workflow sa pamamagitan ng code at terminal tool, ang Astra ay umabot sa 64.6% kumpara sa 52.6% para sa Claude Fable 5.1, sa humigit-kumulang 31% na mas mababang tinatayang gastos sa API. Sa Agents' Last Exam, na sumasaklaw sa mga kumplikadong propesyonal na gawain sa totoong software, ang Astra ay nakakuha ng 59.3% laban sa 55.5% para sa Claude Opus 5 at 53.6% para sa Sol, habang gumagamit ng humigit-kumulang 65% na mas kaunting output token kaysa sa Opus 5. Sa BenchCAD, kung saan pinapagawa sa mga model ang pagbuo ng 3D object sa pamamagitan ng pagsulat ng CAD code, ang Astra ay umabot sa 95.9% kumpara sa 84.3% na iniulat para sa Fable 5.1.

Bumuti ang bilis kasabay ng katumpakan. Sa mga latency simulation sa OSWorld 2.0, ang Astra ay nakakuha ng 72.6% sa humigit-kumulang 40 minuto bawat gawain, kung saan ang Sol ay nakakuha ng 65.7% sa humigit-kumulang 75 minuto. Kasama ang isang updated na Codex harness, sinusukat ng OpenAI ang 1.9x na mas mabilis na pagtapos ng gawain sa Mind2Web kumpara sa kasalukuyang karanasan sa Sol.

Ang pinakamahusay na computer-use model sa mundo

Ang pinakamalaking tema ng release na ito ay ang paggamit ng computer. Ang Astra ay nagpapatakbo ng totoong software: nagpupuno ito ng mga form, nag-a-update ng mga CRM record, nag-aayos ng mga kalendaryo, nagsasaliksik sa browser, nagda-draft sa iyong email o document editor, nagpapatakbo ng frontend QA sa mga website na kakabuo lang nito, at nag-aayos ng mga problemang nakikita nito sa screen.

Ginawa ng OpenAI na konkreto ang demo reel nito. Ang Astra ay gumagawa ng printed circuit board layout sa KiCad, na nagiging isang manufacturable board ang isang schematic. Nakikipagkumpitensya ito sa Excel modeling, nagpupuno ng Form 1040, nagfo-format ng mga legal na dokumento, bumubuo ng Power BI dashboard, at nagbu-book ng mga appointment sa DMV. Ito ang mga nakakapagod at mahirap na gawain na dati ay nangangailangan ng tao para mag-operate ng mouse.

Para sa propesyonal na output, sinanay ng OpenAI ang Astra partikular sa pagsunod sa mga template. Sinusunod nito ang iyong mga kasalukuyang slide template, tumutugma sa iyong istilo ng pagsulat at visual, at kinukuha lamang ang kontekstong mahalaga para sa mga deliverable. Sinang-ayunan ito ng mga unang customer: isinama ng Cognition ang Astra sa Devin sa araw ng paglulunsad dahil sa state-of-the-art na resulta sa internal benchmark nito, at iniulat ng Higgsfield na ang Astra ay nagsasagawa ng pinakakumplikadong creative workflow nito nang may hanggang 20% na mas kaunting token kaysa sa mga alternatibo.

Ang safety catch: Kritikal na kakayahan sa cyber

Ang Astra ang unang model ng OpenAI na umabot sa antas na Critical ng cybersecurity capability sa ilalim ng Preparedness Framework ng kumpanya. Ang pagtatalagang iyon ay nagkaroon ng mga bunga bago ang paglulunsad: tinukoy ng OpenAI noong Agosto 7 na ang Astra ay maaaring magkaroon ng mga kritikal na kakayahan sa cyber, nagdagdag ng mga kinakailangan sa pagsubaybay sa lahat ng inference, at ipinagpaliban ang ilang bahagi ng development at release.

Ang praktikal na resulta ay tiered access. Ang model na nakukuha ng lahat ay may matibay na safeguard sa mga gawain sa cybersecurity. Ang pinaka-advanced na kakayahan nito sa offensive-security ay limitado lamang sa mga aprubadong cybersecurity defender sa pamamagitan ng programang Daybreak ng OpenAI. Kung ang iyong trabaho ay ordinaryong software engineering, pananaliksik, o mga gawain sa negosyo, hindi mo mapapansin ang restriksyon. Kung ikaw ay nasa security team, Daybreak ang landas para sa application.

Paano gamitin ang GPT-6 Astra sa Runable

Idinagdag ng Runable ang GPT-6 Astra sa Ultra mode, ang pinakamataas na tier sa model selector, kasama ang Claude Fable 5.1 na dumating mas maaga ngayong linggo. Narito kung paano ito patakbuhin.

Una, magbukas ng bagong gawain sa Runable at hanapin ang model selector sa input bar, sa tabi ng artifact selector at mode toggle. Piliin ang Ultra. Ang mas matataas na model tier ay gumagamit ng mas maraming credit bawat gawain at mas mahusay mag-reason, at ang Ultra ay nagtuturo na ngayon sa iyong agent na gumamit ng mga frontier model kabilang ang Astra.

Pangalawa, ilarawan ang gawain sa simpleng wika, gaya ng gagawin mo sa anumang build sa Runable: isang full-stack website, isang financial model, isang research report, o isang slide deck. Ang mga kalakasan ng Astra ay direktang tumutugma sa mga output type na madalas gamitin sa Runable, lalo na ang anumang may kaugnayan sa mahahabang multi-step na trabaho, pagsusuring puno ng dokumento, o code na dapat pumasa sa sarili nitong QA.

Pangatlo, suriin at pinuhin sa parehong chat. Wala nang iba pang magbabago sa workflow: ang Plan Mode, mga skill, connector, memory, rollback, at branching ay parehong gumagana anuman ang model tier na napili.

Ang pagpapares ay may katuturan sa isang partikular na dahilan. Ang Astra ang pinakamalakas na model para sa paggamit ng computer at agentic na gawain na inilabas ng OpenAI, at ang Runable ay isang platform para sa mga agent kung saan ang model ay nakakakuha ng sandbox, tool, at awtonomiya na tumatagal ng maraming oras upang magamit ang mga kakayahang iyon. Ang pagpapatakbo ng Astra sa pamamagitan ng chat window ay nagsasayang sa karamihan ng halaga nito. Ang pagpapatakbo nito sa isang environment na binuo para sa ipinagkatiwalang trabaho ay kung saan lumalabas ang mga benchmark gain bilang natapos na output. Ang Runable ay may libreng tier para subukan ito, na ang Pro ay nasa $20/mo bilang pinakasikat na plan at Max sa $100/mo para sa mabigat na paggamit.

Astra laban sa Claude Fable 5.1: alin ang dapat mong piliin?

Ang tapat na sagot ay binigyan tayo ngayong linggo ng dalawang pambihirang model, at parehong available sa Ultra mode ng Runable, kaya hindi mo kailangang pumili lang ng isa.

Ang bentahe ng Astra ay ang paggamit ng computer, bilis, at cost efficiency sa frontier: panalo ito sa Terminal-Bench Science at BenchCAD at natatapos ang mga gawain sa OSWorld sa halos kalahati ng oras na kailangan ng Sol. Ang reputasyon ng Fable 5.1, na binuo sa unang mga araw nito, ay ang tatag at disiplina sa root-cause sa mahahabang coding run, kung saan binabanggit ng mga customer ang mga multi-day autonomous session at paghahanap ng mga rare-bug na hindi nakuha ng ibang model.

Isang makatuwirang hati: gamitin ang Astra sa mga gawaing puno ng pag-operate ng totoong software, dokumento, spreadsheet, at structured deliverable, at gamitin ang Fable 5.1 sa malalim at pangmatagalang trabaho sa codebase. O patakbuhin ang parehong prompt sa dalawa sa Runable gamit ang chat forking at panatilihin ang mas magandang resulta.

Kung nagpapasya ka kung saan patatakbuhin ang mga model na ito araw-araw, ang paghahambing ng Runable vs ChatGPT ay nagpapaliwanag kung ano ang idinaragdag ng isang platform para sa mga agent kaysa sa isang karaniwang chat interface. Para sa mga team na nagtitimbang ng mga workflow sa disenyo at dokumento, sulit basahin ang paghahambing ng Runable vs Canva. At kung gusto mong maunawaan ang paglipat mula sa mga tool patungo sa mga agent nang mas malawak, ang bakit pinapalitan ng mga agent ang mga tool ay naglalahad ng argumento.

FAQ

Ano ang GPT-6 Astra?

Ang GPT-6 Astra ay ang flagship model ng OpenAI na inilabas noong Setyembre 3, 2026. Tinatawag ito ng OpenAI na pinakamatalino at pinaka-aligned na model sa mundo, na may mga state-of-the-art na resulta sa paggamit ng computer, software engineering, cybersecurity, science, at propesyonal na trabaho, kabilang ang mga saturated score sa FrontierMath Tier 4 at ARC-AGI-3.

Paano ako makaka-access sa Astra sa Runable?

Piliin ang Ultra sa model selector sa input bar ng Runable bago ipadala ang iyong gawain. Ang Ultra ay ang tier sa itaas ng mga Lite, Pro, at Max model, at kasama na ngayon dito ang GPT-6 Astra. Ang natitirang bahagi ng workflow, mula sa Plan Mode hanggang sa rollback, ay nananatiling pareho.

Magkano ang halaga ng GPT-6 Astra sa API?

Ang OpenAI ay nagpepresyo ng Astra sa $10 bawat milyong input token at $50 bawat milyong output token, na may cached input na $1 bawat milyon. Nangangatwiran ang OpenAI na ang epektibong gastos bawat tapos na gawain ay kadalasang mas mababa kaysa sa mga mas lumang model dahil ang Astra ay nangangailangan ng mas kaunting token at mas kaunting oras bawat gawain.

Bakit limitado ang ilang kakayahan ng Astra?

Ang Astra ang unang model ng OpenAI na umabot sa Critical cybersecurity threshold sa ilalim ng Preparedness Framework. Ang pinaka-advanced na kakayahan nito sa offensive-security ay limitado sa mga aprubadong defender sa pamamagitan ng programang Daybreak, at lahat ng inference ay may kasamang dagdag na safety monitoring. Ang pang-araw-araw na coding at paggamit sa negosyo ay hindi apektado.

Mas mahusay ba ang Astra kaysa sa Claude Fable 5.1?

Depende sa trabaho. Nangunguna ang Astra sa paggamit ng computer, mga propesyonal na dokumento, at cost efficiency, na tinalo ang Fable 5.1 sa Terminal-Bench Science sa mas mababang gastos. Ang Fable 5.1 ay mahusay sa pangmatagalang autonomous coding. Parehong available ang mga ito sa Ultra mode ng Runable, kaya maaari mo silang paghambingin sa sarili mong mga gawain.

Kaugnay na Pagbabasa

Subukan ang GPT-6 Astra sa Ultra mode ng Runable

Ang pinakamabilis na paraan para madama kung ano ang nababago ng isang frontier model ay ang pagbibigay dito ng totoong gawain, hindi chat message. Buksan ang Runable, ilipat ang model selector sa Ultra, at bigyan ang Astra ng isang bagay na karaniwan mong inilalaan ng isang hapon: isang working app, isang modeled spreadsheet, o isang sinaliksik na report. Libre ang pagsisimula nito, at isang click lang ang upgrade.

Filed underLaunch
Written byEshaan Pawan

Magsimula sa ideyang mayroon ka na

Sapat na ang isang pangungusap para makapagsimula.

Magsimula nang Libre