Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

OpenAI dots: Astra 24/7 – Pro stengt i EØS, 4000 apper • AISI: Astra 29 prosent – falsk identitet, payload utenfor scope • OpenAI-agenter: 16 500 UNCTAD-skann – XSS-spill, 82 rate-limits • OpenAI: DNS-hull – pause i trening av de mest kapable • OpenAI-agenter la ut 53 brukerbilder – kan ikke varsle ofrene

Astra Ultrafast: 60/300 dollar – 8x, stengt i EØS
OpenAINVIDIAGPT-6 AstraCIOCISOAPIFinOpsAgenterInferensEØS

Astra Ultrafast: 60/300 dollar – 8x, stengt i EØS

JH
Joachim Høgby
2. oktober 20262. oktober 20264 min lesingKilde: NVIDIA

NVIDIA bekrefter 1. oktober at GPT-6 Astra Ultrafast kjører på Blackwell-GPU-er. OpenAIs API-guide kaller det raskeste tjenestetrinnet, med inntil åtte ganger raskere token-generering enn Standard. Listen er 60 dollar per million inn-tokens og 300 dollar per million ut. Det er nøyaktig seks ganger Standard. Ultrafast støtter bare USA-residency og global prosessering. Ingen EØS-ende. For CIO er dette latens i agentløkker, ikke en ny modell. For CISO er det region og at 8x-tallet er NVIDIA og OpenAI, ikke et åpent harness.

Hva som faktisk skippes

Ultrafast er ikke en ny modell. Modell-ID forblir gpt-6-astra. Forskjellen er service_tier: ultrafast i Responses API. NVIDIA-bloggen 1. oktober, signert Dion Harris, sier at trinnet er live i OpenAI API og for kvalifiserte ChatGPT Work- og Codex-brukere. Philippe Tillet, inference-lead i OpenAI, sier at labens modeller er blitt gode til å programmere Blackwell og Rubin, og at Astra skriver kjerner som treffer latens, gjennomstrømning og kostnad. Uday Ruddarraju, compute-CTO i OpenAI, sier at interne modeller ble brukt til å optimalisere inferens på NVIDIA-GPU-er.

OpenAIs egen guide anbefaler WebSockets. Uten vedvarende tilkobling spiser nettverket opp gevinsten mellom verktøykall. HTTP er støttet. Alle API-kunder får Ultrafast, men med lave rate limits. Tier 1–3: 500 000 tokens per minutt. Tier 4: 1 million. Tier 5: 5 millioner. Høyere grenser krever account team. GPT-5.6 Sol har preview. GPT-6.1 Sol ligger ikke i Ultrafast-prislisten 2. oktober. Ikke les «kommer i dagene som kommer» fra DevDay som at 6.1 Sol Ultrafast er priset og åpent.

Tallene

OpenAI Pricing, Ultrafast-tabellen, gpt-6-astra, lest 2. oktober:

Kort kontekst, inntil 272 000 inn-tokens: 60 inn, 6 cache-les, 75 cache-skriv, 300 ut per million tokens.

Lang kontekst over 272 000: 120 inn, 12 cache-les, 150 cache-skriv, 450 ut. Hele requesten prises om, ikke bare tokenene over grensen.

Standard på samme modell: 10/1/12,50/50 kort og 20/2/25/75 lang. Ultrafast er 6x på alle fire linjer, kort og lang. Fast mode, tidligere Priority, ligger på 2x Standard. Ultrafast er tre ganger Fast, ikke et lite hopp.

NVIDIA og API-guiden skriver «inntil 8x» mot Standard. DevDay-materiale har tidligere skilt 8x i Codex og 6x i API. Ingen av sidene legger ved et åpent, gjentakbart oppsett. Ikke budsjetter 8x som SLA. Ikke bland Cerebras-historien fra GPT-5.6 Sol Ultrafast i august inn i denne saken. Dette er Blackwell, Astra, OpenAI API.

Et agentløp med 200 000 inn og 20 000 ut koster 2 + 1 = 3 dollar på Standard før cache. Samme løp på Ultrafast: 12 + 6 = 18 dollar. Ti slike runder i timen er 180 dollar, mot 30. Cache-les på 6 dollar per million er 90 prosent under inn-prisen, men seks ganger Standard-cachen. Rate limit 500k TPM på de fleste kunder kutter parallellitet før prisen gjør det.

Hva styret bør gjøre

Ikke slå på Ultrafast som default. Bruk det der ventetid mellom verktøykall er produktet: live kodeagent, kundeside, interaktiv loop. Resten på Standard eller Fast. Mål tid til ferdig oppgave i egen harness, ikke tokens per sekund i en NVIDIA-video.

CISO: Ultrafast har ikke EU-regional processing. Norsk persondata i agenten går global eller USA. Det er et nei for mange behandlingsgrunnlag, uansett hvor raskt Blackwell er. Pin region i kontrakt. Ikke anta at Standard- eller Fast-regler arves. WebSocket mot OpenAI er en drifts- og datastrømsavhengighet, ikke pynt.

FinOps: 6x liste mot et «inntil 8x»-løfte. Be om målt tokener per sekund og tid per ferdig oppgave på deres egne traces, med og uten verktøykall. Hvis 8x ikke viser seg i loop-tid, er Ultrafast bare dyrere Standard.

NVIDIA selger plattform. OpenAI selger tid. Dere betaler begge. Sett et tak på service_tier=ultrafast i gatewayen, og logg hvem som skrur det på.

Kilder og medier

Primærkilde: NVIDIA, «How NVIDIA GPUs Help Accelerate OpenAI’s GPT-6 Astra Ultrafast», 1. oktober 2026: https://blogs.nvidia.com/blog/gpus-openai-gpt-6-astra-ultrafast/

OpenAI API, Ultrafast mode: https://developers.openai.com/api/docs/guides/ultrafast-mode

OpenAI API, Pricing, Ultrafast-tabell for gpt-6-astra: https://developers.openai.com/api/docs/pricing

NVIDIA på X, 1. oktober 2026: https://x.com/nvidia/status/2105809442365423918

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.