Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

OpenAI dots: Astra 24/7 – Pro stengt i EØS, 4000 apper • AISI: Astra 29 prosent – falsk identitet, payload utenfor scope • OpenAI-agenter: 16 500 UNCTAD-skann – XSS-spill, 82 rate-limits • OpenAI: DNS-hull – pause i trening av de mest kapable • OpenAI-agenter la ut 53 brukerbilder – kan ikke varsle ofrene

Perplexity pplx-decider: 4 cent, Apache, sannsynlighet ikke prosa
PerplexityCIOCISOAI-modellerOpen sourceAgenterFinOpsQwenBeslutningsmodeller

Perplexity pplx-decider: 4 cent, Apache, sannsynlighet ikke prosa

JH
Joachim Høgby
1. oktober 20261. oktober 20264 min lesingKilde: Perplexity

Perplexity slipper 1. oktober 2026 Decisions API og åpner vektene til pplx-decider-v1-27b. Modellen skriver ikke svar. Den leser tekst og bilder og returnerer sannsynligheter over ja/nei, et sett valg du definerer, eller et nivå på en rubrikk. API-prisen er 0,04 dollar per million input-tokens. Output er gratis. Vektene ligger på Hugging Face under Apache 2.0, finjustert fra Qwen3.8-27B.

For CIO er dette et FinOps- og arkitekturvalg: en billig, strukturert beslutning før en dyr agentkall. For CISO er tre ting viktigere enn 85,71 prosent i labens egen tabell: Qwen-basen, custom inference-kode for self-host, og at benchmarkene er Perplexitys egne, målt gjennom deres API.

Hva Perplexity faktisk slipper

pplx-decider-v1-27b er en beslutningsmodell, ikke en chatmodell. Dokumentasjonen er presis: den skriver ikke svar, genererer ikke kode og forklarer ikke resonnementet. Koden din gjør det med tallene den får tilbake. Én modell betjener Decisions API. Ukjent modellnavn gir 400.

Du sender innholdet som state (streng, objekt eller array) og opptil 128 navngitte spørsmål i samme kall. Tre spørsmålstyper:

  • noul: sannsynlighet for ja, 0 til 1.
  • choice: sannsynlighet for hvert av 1–255 valg, pluss det mest sannsynlige.
  • score: sannsynlighetsvektet nivå på en rubrikk med inntil 10 trinn.

Eksempelet i dokumentasjonen er en produktanmeldelse. API-en svarer 94 prosent sannsynlighet for defekt, «mixed» som sentiment med 95 prosent, og alvorlighetsgrad 1,78 mellom «Inconvenient» og «Product unusable». Identiske kall gir vanligvis identiske tall. Av og til flytter andre desimal. Terskel må ha margin.

Endepunktet er POST https://api.perplexity.ai/v1/decisions. Vanlig Perplexity-nøkkel. Bare Authorization: Bearer. x-api-key gir 401. Input-grensen er under 262 144 tokens, inkludert state, bilder og alle spørsmål. Kropp maks 32 MiB. Organisasjonen har 10 kall per sekund på alle plan. 429 kommer med Retry-After.

Bilder i state må være PNG, JPEG eller WebP som data-URL. API-en henter aldri http/https. Et eksternt bilde-URL gir 400. Bilder leses i 32×32-fliser, maks 2048 fliser. 1440×1440 og 2048×1024 går. For stort bilde gir ikke 400: kallet venter rundt ett minutt og dør i 504. Perplexity målte om lag 1000 input-tokens per megapiksel.

Tallene, og hva de ikke er

Modellkortet sammenligner tre modeller over 11 benchmarks. pplx-decider-v1-27b er målt gjennom Perplexity API:

BenchmarkJevQwen3.8-27Bpplx-decider

Overall84,51 %74,76 %85,71 %
RAGTruth77,27 %61,53 %88,80 %
FinancialPhraseBank76,98 %75,68 %84,18 %
TabFact89,80 %78,60 %90,60 %
Circa84,60 %87,00 %89,20 %
WinoGrande90,70 %73,10 %83,30 %
BBH94,27 %72,80 %82,80 %
JevBench public hard73,27 %72,28 %70,30 %

Perplexity leder snittet og tre–fire deloppgaver. Jev leder blant annet WinoGrande, BBH, JevBench public hard, Belebele og TruthfulQA binary. Det er ikke en jevn seier. Det er Perplexitys egen tabell, ikke et uavhengig lederboard.

Latens, ifølge labens egne tester 30. september 2026: noen hundre tokens under 2 sekunder, om lag 90 000 tokens på 5 sekunder, om lag 190 000 på 14 sekunder, like under input-grensen 23 sekunder. Cookbook-eksempelet for saks-triage målte 150–250 ms på 590–659 tokens. Tolv klassifiseringskall tok om lag 2,5 sekunder. 504 etter rundt ett minutt.

Self-host krever Python 3.12+ og CUDA med plass til om lag 49 GiB vekter pluss arbeidsminne. Hugging Face merker custom-code. Det er forsyningskjede, ikke en uskyldig safetensors-fil.

Hva ledere bør gjøre nå

Sett beslutningsmodellen foran agenten, ikke i stedet for den. Perplexitys eget cookbook gjør nøyaktig det: Decisions API triager saken, Agent API tar bare eskaleringene. Tersklene er policy. Endre et tall, ikke en prompt.

FinOps er åpent. 0,04 dollar per million input og gratis output er omtrent 50 ganger billigere enn Gemini 4 Argons intropris på 2 dollar inn. En 600-token-forespørsel koster 0,000024 dollar. Det holder for høyfrekvente ja/nei og ruting. Det holder ikke for resonnement, kode eller forklaring. Der må du uansett betale en generativ modell.

CISO: Apache 2.0 fjerner lisensfriksjon. Den fjerner ikke Qwen-opphavet og den fjerner ikke custom Python ved lokal last. Pin commit-hash. Kjør i isolert GPU-jobb. For API: logg x-request-id, respekter 10 rps, og ikke send bilder som URL. Terskel nær 0,5 er usikkerhet, ikke et vedtak. Bygg avvisning og menneskelig gjennomgang der, særlig i kundesaker, kreditt og sikkerhetskø.

Ikke bytt Jev, intern klassifiserer eller regelmotor på labens samlede 85,71 prosent. Test mot egne merkede saker: ruting, eskalering, RAG-chunk-filter og «skal vi kalle et verktøy». Mål kalibrering, ikke bare treff. Hvis sannsynligheten ikke matcher utfallet, er tallet verdiløst som terskel.

Kilder og medier

Primærkilde: Perplexity, Decisions API-dokumentasjon, 1. oktober 2026: https://docs.perplexity.ai/docs/decisions/quickstart

Modellkort: Hugging Face, perplexity-ai/pplx-decider-v1-27b (Apache 2.0, finjustert fra Qwen3.8-27B).

Pris: Perplexity, Decisions API Pricing, 0,04 dollar per million input-tokens, output gratis.

Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.