GPT-6 Astra po prvom týždni: vášho agenta dnes vie zastaviť dodávateľ
GPT-6 Astra stojí $10 / $50, ruší temperature, top_p aj logprobs, na nástroje vyžaduje Responses API a úlohu v API vie ukončiť chybou 403 bez možnosti pokračovať. Pre zaradenie Critical dokončí bežný prístup len 44,4 % úloh na opravu zraniteľností. Skóre 99,9 % na ARC-AGI-3 je na štandardnom harnesse 62,7 % a v prvom týždni Azure neuvádzal EU Data Zone a endpoint Mantle na Bedrocku bol len v Oregone.
Tento týždeň mali tímy za sebou prvý celý pracovný týždeň s GPT-6 Astra. OpenAI model oznámil vo štvrtok 3. septembra pre „obmedzený okruh organizácií“ a API aj platené plány ChatGPT otvoril na druhý deň. Stojí $10 / $50 za milión tokenov. Prináša aj spôsob zlyhania, ktorý je s týmto modelom nový: dodávateľ vie vášho agenta zastaviť uprostred behu a API neponúka cestu, ako pokračovať.
Titulky pri spustení boli o AGI. Pre toho, kto stavia, sú podstatné zmeny v referencii API a v systémovej karte, takže tam tento článok začína. Tvrdenia o benchmarkoch a veta o AGI prídu neskôr, v rozsahu, aký si zaslúžia.
Čo sa mení vo vašom kóde a vo vašom harnesse
Začnite referenčnou stránkou, lebo viaceré z týchto zmien rozbijú existujúce integrácie.
- Cena$10 vstup · $50 výstup za milión tokenov. Nad 272-tisíc vstupných tokenov sa celá požiadavka účtuje za $20 / $75. Vstup z cache $1,00, zápis do cache $12,50, Batch a Flex za polovicu.
- ID modelugpt-6-astra, bez datovaného snapshotu. Kontextové okno 1 050 000 tokenov, 922 000 na vstupe, 128 000 na výstupe. Hranica znalostí 30. apríla 2026.
- Úroveň úsilialow, medium, high, xhigh, max. Úroveň none, ktorú mal GPT-5.6, zmizla.
- VzorkovanieAstra „nepodporuje vlastné hodnoty temperature ani top_p ani logaritmické pravdepodobnosti (logprobs)“.
- Nástroje„Volanie nástrojov vyžaduje Responses API.“ Chat Completions funguje ďalej, ale bez nástrojov.
Cenníková cena je rovnaká ako pri Claude Fable 5 a Fable 5.1 a Artificial Analysis poznamenáva, že je to „2,5-násobok súčasných cien GPT-5.6 Sol vo všetkých položkách“.
Väčšia zmena je prevádzková. Astra prichádza s tým, čo OpenAI nazýva misalignment monitoring: asynchrónny systém, ktorý posudzuje uvažovanie a akcie modelu a „vie konverzáciu zastaviť, keď zistí možný problém“. V ChatGPT a Codexe si používateľ pozastavenú úlohu pozrie a môže pokračovať. V API podľa oznámenia „sa úloha zastaví“. Príručka pre vývojárov hovorí, ako to vyzerá:
- ChybaHTTP 403, typ invalid_request_error, kód misalignment_policy_violation.
- Žiadny retry„Zablokovaný workflow automaticky neopakujte.“
- Žiadne pokračovanie„API neposkytuje všeobecný spôsob, ako obnoviť konverzáciu zastavenú misalignment monitoringom.“
- Žiadne vrátenie späť„Zastavená požiadavka nevracia späť skoršie akcie.“ Monitoring je asynchrónny, takže volanie nástroja už mohlo prebehnúť.
Pokrytie závisí od rozhrania. Požiadavky na Responses API, ktoré používajú uložené uvažovanie, WebSockets alebo kompakciu od OpenAI, sú monitorované a systém ich vie zastaviť sám. Požiadavky na Responses bez týchto mechanizmov sú monitorované, no vzniknú z nich len webhook upozornenia. Chat Completions „tento monitorovací systém nepokrýva“. Upozornenia chodia cez webhook safety.alert.created, pole reason „môže byť null, a to aj pri požiadavkách so Zero Data Retention (ZDR)“, a OpenAI sám píše, že „doručovanie a načítanie upozornení neposkytuje úplnú auditnú históriu“.
Vášho agenta dnes vie uprostred práce zastaviť cudzí klasifikátor a pokračovať sa nedá. Navrhujte to tak, ako navrhujete pád procesu.
OpenAI otvorene píše, že to zasiahne aj legitímnu prácu: systém „môže občas označiť legitímnu aktivitu“ vrátane „práce, ktorá s kybernetickou bezpečnosťou zjavne nesúvisí, alebo úloh, pri ktorých agent beží dlhší čas“. Ako často, to nevie nikto. Verejným dôkazom z prvého týždňa sú tri GitHub issues v repozitári Codexu a žiadnu mieru nikto nezverejnil.
Pre harness z toho plynú štyri veci. Stav úlohy ukladajte mimo relácie modelu. Každý krok spravte idempotentný, aby opakovanie po zastavení nevykonalo akciu dvakrát. Majte záložnú trasu na model, ktorý prešiel tým istým evalom. A pridajte frontu pre operátora, lebo sám dodávateľ radí, aby sa pred reštartom na vec pozrel človek.
„Critical“ znamená, že väčšinu z toho máte vypnutú
OpenAI 1. septembra oznámil, že Astra dosahuje „kritický prah kybernetických schopností podľa nášho Preparedness Framework“, a dodal: „Je to prvý model, ktorý na túto úroveň zaraďujeme.“ Po ľudsky: „so správnymi nástrojmi a prístupom vie nájsť doteraz neznáme bezpečnostné chyby a vyvinúť spôsoby, ako ich zneužiť naprieč mnohými dobre chránenými systémami, bez toho, aby ho človek viedol krok za krokom.“
Oznámenie o spustení hovorí, čo to znamená pre bežného používateľa: „Astra odmietne náročnejšie úlohy z kybernetickej bezpečnosti, napríklad tvorbu proof-of-concept exploitov pre zraniteľnosti.“ Obrancovia ju podľa neho stále vedia použiť na „bezpečnostnú revíziu kódu a opravy“. Koľko z toho po zapnutí ochrán zostane, ukazuje tabuľka priamo v systémovej karte.
Druhý riadok si prečítajte dvakrát. Bez dôveryhodného prístupu dokončí Astra 44,4 % úloh na opravu zraniteľností a 66,7 % úloh na ich hľadanie a analýzu. Tvorba proof-of-concept exploitov je na 2,4 %. Sú to čísla OpenAI. Ochrany berú so sebou dole aj veľký kus obrannej práce, nielen útočnú.
Cesta nahor vedie cez identitu. Program Trusted Access for Cyber, „známy aj ako prístup Daybreak“, prijíma žiadosti od organizácií a overenie identity od jednotlivcov, ktorí „musia mať zapnuté Advanced Account Security, aby mohli používať Daybreak Blue“. OpenAI zároveň „robí ďalšie kroky na obmedzenie prístupu vysokorizikových subjektov a vo vysokorizikových jurisdikciách“. Náročnejšiu kybernetickú prácu s Astrou dostala pri spustení „malá skupina alfa testerov, pričom prístup cez Daybreak Blue sa rozšíri neskôr“. ChatGPT Enterprise mal vlastnú bránu. Podľa dokumentácie pre firmy „je Astra v ChatGPT Enterprise prvé dva týždne po spustení predvolene vypnutá“ a počas úvodného zavádzania potrebovala organizácia prístup Daybreak, aby ju správca vôbec mohol zapnúť.
99,9 % na čom harnesse
Oznámenie OpenAI tvrdí, že Astra „saturuje ARC-AGI-3 so skóre 99,9 %“. Poznámka pod čiarou dodáva, že bežala s „naším harnessom pre Responses API“. ARC Prize zverejnil obe čísla v ten istý deň: „62,7 % za $26-tisíc na ARC-AGI-3 Semi-Private s naším štandardným harnessom a 99,9 % za $19-tisíc s harnessom Provider Adapter“. Ten druhý „uchováva nepriehľadný stav uvažovania medzi požiadavkami a pri dlhších konverzáciách používa kompakciu“.
Obe skóre sú najvyššie, aké kto na tomto teste zverejnil, a ani jedno nie je nepoctivé. Rozdiel 37 bodov robí harness a ten harness je vlastnosťou API od OpenAI. Vyššie číslo teda hovorí rovnako o produkte, na ktorý by ste sa naviazali, ako o modeli.
Tá istá hygiena platí pre vlastnú tabuľku výsledkov OpenAI, ktorá je úprimnejšia než text nad ňou. Na Artificial Analysis Intelligence Index v4.1.1 uvádza Astru s 61,2, za Claude Fable 5.1 so 65,7 a Opus 5 so 63,1. Na Humanity's Last Exam s nástrojmi má Astra 57,2 % oproti 65,0 % pri Fable 5.1. Všetko uvádza dodávateľ, a to ten, ktorý v týchto riadkoch prehral.
Artificial Analysis potom 9. septembra zverejnila vlastný rozbor. Astra pri úsilí max v ňom má 53 bodov, rovnako ako Fable 5.1, a to za „~40 % ceny za úlohu ($3,26 oproti $7,63)“. Ten istý text zaznamenal na benchmarku GDPval-AA v2 pokles asi o 45 bodov Elo oproti Solu a Astru pri úsilí max vyčíslil asi o 60 % drahšie na úlohu než Sol. Tabuľka OpenAI cituje index vo verzii v4.1.1, rozbor z 9. septembra verziu neuvádza. Ten istý hodnotiteľ, šesť dní od seba, dva rôzne obrázky. Keď citujete skóre, citujte aj verziu.
K titulku, s ktorým vyšla väčšina médií: na tlačovom brífingu 3. septembra prezident OpenAI Greg Brockman podľa The Verge povedal: „Keď sa o pár rokov obzrieme a spýtame sa: ‚Kedy vlastne vzniklo AGI?‘, myslím, že to bude približne tento čas, a myslím, že to možno bude práve tento model.“ Nemáme k tomu čo dodať okrem štyroch odsekov nad touto vetou.
Prvý týždeň z pohľadu EÚ
Pre záťaž, ktorá musí zostať v EÚ, bol obraz v týždni spustenia chudobný.
- Microsoft FoundryOznámené 3. sep ako „teraz všeobecne dostupné pre všetkých zákazníkov“, a to „v geografiách Global a US Data Zone“. EU Data Zone v zozname nie je. Cena v US Data Zone je $11 / $55.
- Amazon BedrockVšeobecne dostupné od 8. sep. Príručka OpenAI pre Bedrock uvádza endpoint Mantle ako „dostupný v us-west-2 (Oregon)“. Regióny pre Bedrock Runtime sa nám overiť nepodarilo. Tá istá príručka varuje: „Región AWS nie je jurisdikciou rezidencie dát OpenAI.“
- OpenAI priamoDokumentácia OpenAI k rezidencii dát uvádza gpt-6-astra pre regionálne spracovanie v oblasti „Európa (EHP + Švajčiarsko)“ cez eu.api.openai.com. Treba na to posúdenie nároku cez obchodné oddelenie, schválenie kontrol monitoringu zneužitia a dodatok Modified Retention a platí sa príplatok 10 %. „Fast mode nie je pre GPT-6 Astra s rezidenciou dát v EÚ dostupný.“
Cez dva cloudy, ktoré oznámenie o spustení menuje, sme teda pre najnovší frontier model v prvom týždni nenašli žiadnu zdokumentovanú možnosť spracovania v regióne. Priama cesta na papieri existuje, za zmluvnou bránou, a nepodarilo sa nám overiť, či fungovala už 3. alebo 4. septembra. Jeden bod v prospech Astry pre DPO: „podporuje Zero Data Retention pre oprávnených zákazníkov API“, kým podľa poznámok k vydaniam Anthropicu vyžaduje Fable 5.1 uchovávanie dát 30 dní, ak Anthropic výslovne nepovolí inak.
Samotné zavádzanie bolo hrboľaté. The New Stack citoval Sama Altmana, ktorý jeden príspevok začal slovami „Po prvé, ospravedlňujem sa za chaotické zavádzanie“ a 4. septembra oznámil dostupnosť v API. Do 18:30 východoamerického času toho dňa mali model aj používatelia plánov Plus a Business. TechCrunch 10. septembra napísal, že OpenAI pozastavil nové registrácie do plánu Pro za $200 mesačne a odôvodnil to dopytom po Astre. Stavová stránka za 3. až 13. septembra neukazuje žiadny incident, ktorý by Astru menoval, no „zvýšená chybovosť pre používateľov ChatGPT v Európe“ sa na nej objavuje 11. aj 13. septembra.
Desať dní po spustení je prvým viditeľným obmedzením kapacita, nie bezpečnosť. Sľúbené uvoľnenie, teda „menej reštriktívne ochrany v najbližších týždňoch“ cez Daybreak, zatiaľ nemá dátum.
Náš pohľad
S Astrou sa bezpečnostný systém dodávateľa stáva súčasťou vášho runtime. Pri modeli, ktorý jeho vlastný tvorca zaradil ako Critical, je to rozumná reakcia. Zároveň to presúva jednu triedu zlyhaní z kategórie „naša chyba“ do kategórie „ich rozhodnutie“ a zmluva API výslovne hovorí, že pre danú konverzáciu je to rozhodnutie konečné.
Čo by sme si ujasnili, než ju povýšime do produkčnej trasy:
- So zastavením narábate ako s pádom. Trvalé checkpointy, idempotentné kroky, záložný model, ktorý prešiel tou istou eval sadou, a fronta pre človeka na všetko, čo vráti misalignment_policy_violation.
- Auditným záznamom je váš log. OpenAI píše, že jeho upozornenia nie sú úplnou históriou. Logujte na svojej strane každé volanie s modelom, verziou politiky, retrieval setom a akciami nástrojov.
- Povyšuje sa po jednotlivých záťažiach. Astra má cenníkovú cenu 2,5-násobne vyššiu než Sol a míňa menej tokenov. Artificial Analysis zaznamenala oproti Solu najmenej jedno zhoršenie. Na ktorej strane je konkrétna trasa, povie len vaša vlastná eval sada.
- Všetko postavené na logprobs alebo temperature potrebuje plán. Skórovanie istoty z logaritmických pravdepodobností prestane fungovať a snapshot bez dátumu znamená, že drift uvidíte len vo vlastných evaloch.
- Rezidenciu dát riešite pred návrhom, so zmluvou v ruke. Ktorá cesta dá spracovanie v regióne, pod akým dodatkom, s akým príplatkom a bez ktorých funkcií.
Úprimný limit: mieru falošných poplachov nového monitora nepozná nikto mimo OpenAI. Tri GitHub issues sú anekdota. Ak vaši agenti bežia hodiny, zmerajte si ju na vlastnej prevádzke skôr, než sa na model spoľahnete.
Sebrona navrhuje harnessy pre agentov, ktoré prežijú zastavenie na strane dodávateľa: s checkpointmi, záložným smerovaním a logovaním volaní, ktoré prečíta aj audítor. Ak Astra mieri na vašu produkčnú cestu, napíšte na info@sebrona.com.
Zdroje
Každé číslo a citát vyššie vedie k jednému z týchto zdrojov. Výsledky, ktoré uvádza dodávateľ, sú tak v texte označené.
- Oznámenie GPT-6 AstraFormulácia o dostupnosti, cena, odmietanie náročnejších kybernetických úloh, „úloha sa zastaví“, Zero Data Retention a celá tabuľka výsledkov vrátane riadkov Artificial Analysis a Humanity's Last Exam. openai.com/index/gpt-6-astra
- Dokumentácia OpenAI APIStránka modelu, cenové úrovne, príručka k misalignment monitoringu, tabuľka rezidencie dát, príručka pre Amazon Bedrock, changelog a stránka o dostupnosti v Enterprise na learn.chatgpt.com. developers.openai.com
- Path to AstraZaradenie Critical, jeho vysvetlenie bežnou rečou, priznanie falošných poplachov, poradie alfa testeri a potom Daybreak Blue. openai.com/index/path-to-astra
- Systémová karta GPT-6 AstraPodiely dokončených úloh z tabuľky 21 a podmienky Trusted Access for Cyber. deploymentsafety.openai.com
- ARC PrizeVýsledky ARC-AGI-3 na oboch harnessoch aj s nákladmi a opis harnessu Provider Adapter. arcprize.org/blog/astra
- Artificial AnalysisSkóre indexu, cena za úlohu, pokles na GDPval-AA, porovnanie cien „2,5-násobok“. artificialanalysis.ai
- Microsoft a AWSGeografie vo Foundry a cena v US Data Zone; všeobecná dostupnosť na Bedrocku 8. septembra. azure.microsoft.com · aws.amazon.com
- TlačThe Verge pre Brockmanov výrok; The New Stack pre zavádzanie 4. septembra; TechCrunch pre pozastavené registrácie do plánu Pro. theverge.com
- OstatnéPoznámky k vydaniam Anthropicu pre cenu a uchovávanie dát pri Fable 5.1; história stavovej stránky OpenAI za 3. až 13. septembra; issues 43042, 43208 a 43781 v repozitári Codexu. github.com/openai/codex