Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

Dommer river Pentagons Anthropic-svartelisting – kaller den grunnløs • Alabama stevner OpenAI etter agentinnbruddet i Hugging Face • Bloomberg: NVIDIA-kunder varsles om over 15 prosent prishopp på AI-servere • OpenAI kutter GPT-5.6 Sol mer enn 20 prosent – i tre måneder

DeepSeek gir Flash-agenter syn, men holder det eksperimentelt
AI-modellerDeepSeekMultimodalAgentic AICIO

DeepSeek gir Flash-agenter syn, men holder det eksperimentelt

JH
Joachim Høgby
21. august 202621. august 20265 min lesingKilde: DeepSeek

DeepSeek har ikke sluppet en ny Pro. De har gitt den billige Flash-linjen øyne. 21. august gikk DeepSeek-V4-Flash-Vision-Exp live på DeepSeek API Platform som en eksperimentell multimodal modell. Tekstevnen, inkludert agenter, resonnement og verdenskunnskap, skal ligge på linje med DeepSeek-V4-Flash. På agenttester som krever visuell forståelse hevder DeepSeek et tydelig hopp, og at multimodal agentytelse nå ligger nær Claude Opus 4.8.

Kallstrengen er deepseek-v4-flash-vision-exp. DeepSeek Harness 0.1.1 kom samme dag med støtte ut av esken. Det er en API-sak, ikke en vektfil. Ingen åpne vekter er varslet i kunngjøringen. For en CIO er det poenget: dere kan sette syn inn i eksisterende Flash-arbeidsflyter i dag, men dere eier verken vektene eller produksjonsgarantien.

Prisen er bevisst uendret mot V4-Flash. Bilder konverteres til token ut fra oppløsning og faktureres som input. Øvre tak er 384 token per bilde, også når originalen er flere tusen piksler. Peak-pris er 0,44 dollar per million input-token ved cache-miss og 1,32 dollar per million output-token. Off-peak er halvparten. Cache-hit ligger på 0,014 dollar peak og 0,007 dollar off-peak. Peak er 01:00–04:00 og 06:00–10:00 UTC. For en europeisk døgnvakt-agent treffer det tidlig formiddag. Samtidig er det et annet kostnadsregime enn Pro, der cache-miss peak ligger på 1,32 dollar inn og 3,96 dollar ut.

Kontekstvinduet er 1 million token. Maks output er 384 000. Modellen støtter både tenke- og ikke-tenke-modus, JSON, verktøykall, Responses API og Anthropic-kompatibelt /messages. FIM-completion, som Flash og Pro har i ikke-tenke-modus, er ikke støttet. Samtidighet er 2500, samme som Flash, mot 500 på Pro. Det er bygd for mange parallelle agentsteg, ikke for én dyr resonneringsøkt.

Bildene kan sendes på tre måter: base64 i request, offentlig URL, eller file_id via ny Files API. Files API er gratis. Én opplasting kan gjenbrukes i flere kall. Det er den praktiske nyheten for dokumentflyter: skjermbilder, fakturaer, dashbord og UI-state trenger ikke dytte 48 MiB-grensen i hver runde. Inline-bilder maks 32 MiB. Via Files API 64 MiB. Inntil 600 bilder per request. Formater: JPEG, PNG, GIF og WebP. Bilder godtas bare i brukermeldinger. Andre DeepSeek-modeller svarer 400 hvis dere sender bilde til feil modellnavn.

Endringsloggen oppgir førstegangstall. Terminal-Bench 2.1: 83,9. DeepSWE: 59,3. NL2Repo: 57,7. DSBench-Hard: 63,6. Chartography: 64,3. ZeroBench Pass@5: 35,0. ApexBench Pass@1: 36,5. Agents' Last Exam: 27,3. AutomationBench Public: 25,7. Kodeagent-tallene er kjørt i DeepSeek Harness minimal mode, max effort, topp 0,95 og temperatur 1,0. På ApexBench og Agents' Last Exam ignorerer tekstmodellen V4-Flash de multimodale elementene. Det er derfor hoppet vises der. Det er førstegangstall, ikke en uavhengig lederboard. «Nær Opus 4.8» er DeepSeeks formulering på egne multimodale agenttester, ikke et Artificial Analysis-resultat.

Sammenlignet med egne eldre tall er bildet mer nyttig. Offisiell V4-Flash fra 31. juli sto på 82,7 på Terminal-Bench 2.1 og 54,4 på DeepSWE. Visjonsvarianten ligger altså i samme sjikt på ren tekst, og hevder åpningen på oppgaver der bildet faktisk teller. V4-Pro GA fra 13. august ligger fortsatt høyere på flere agenttall, blant annet 87,9 på Terminal-Bench 2.1 og 62,7 på DeepSWE, til tre ganger Flash-pris. Valget er ikke «beste modell». Valget er om syn skal sitte på den billige arbeidslinjen.

For norske virksomheter er tre styringsspørsmål tydelige. Først datalinjen: bilder av skjermer, kontrakter, pasientnære journalutsnitt eller produksjons-UI forlater organisasjonen og lander hos DeepSeek. Eksperiment-status senker ikke personvernkravet. Sett visjonskallet bak samme DPA, formålsbegrensning og uttrekkskontroll som resten av DeepSeek-bruken, eller la være. Deretter produksjonsmodenhet: -exp i modellnavnet er et signal. Bytt modell-ID uten å binde sluttbrukerflyter til et eksperiment som kan endres eller trekkes. Til slutt evaluering: ikke kjøp «nær Opus 4.8» uten egne oppgaver. Ta fem reelle artefakter, skjermbilde av feil, PDF-utsnitt, dashboard og en UI-diff, og mål treff, tid og dollar mot den Claude- eller GPT-linjen dere allerede betaler for.

Det som er nytt, er ikke at modeller kan se. Det som er nytt, er at DeepSeek setter syn på Flash-prisen, med verktøykall og agent-runtime samme dag. For team som allerede kjører V4-Flash mot kode, ticket og research, er dette en billig vei til å la agenten lese det den tidligere bare fikk beskrevet. For CISO er det en ny bildeflate inn i samme leverandør. Behandle det som en modelloppdatering med nye data, ikke som en uskyldig parameter.

Kilder og medier

Primærkilde: DeepSeek, «DeepSeek-V4-Flash-Vision-Exp Release: Multimodal API Now Live», 21. august 2026: https://api-docs.deepseek.com/news/news260821/

Endringslogg og førstegangstall: https://api-docs.deepseek.com/updates/

Visjonsguide, grenser og tokenregel: https://api-docs.deepseek.com/guides/vision/

Pris og modellkort: https://api-docs.deepseek.com/quick_start/pricing/

Offisiell kunngjøring på X fra @deepseek_ai: https://x.com/deepseek_ai/status/2090730032574631962

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.