Hopp til hovedinnhold
 AI-nyheter, ferdig filtrert for ledere
SISTE:

KI-briller: midlertidig forbud – skoler, sykehus, kjøpesenter • OpenAI dots: Astra 24/7 – Pro stengt i EØS, 4000 apper • AISI: Astra 29 prosent – falsk identitet, payload utenfor scope • OpenAI-agenter: 16 500 UNCTAD-skann – XSS-spill, 82 rate-limits • OpenAI: DNS-hull – pause i trening av de mest kapable

MiniMax åpner Music 3 for fullengde AI-musikk
AI-modellerGenerativ lydÅpne vekterCreative AIAI-styring

MiniMax åpner Music 3 for fullengde AI-musikk

JH
Joachim Høgby
13. august 202613. august 20264 min lesingKilde: MiniMax / Hugging Face model card

MiniMax har sluppet MiniMax Music 3 som en åpen vektmodell for musikkgenerering. Modellen lager komplette sanger på opptil fem minutter, med tekst, vokal, instrumentering og struktur styrt fra lyrics og en detaljert musikkbeskrivelse. Det høres først ut som en kreatørnyhet. For ledere er det mer konkret enn som så: generativ lyd flytter fra lukket SaaS-verktøy til noe utviklere kan laste ned, kjøre, integrere og kontrollere i egne arbeidsflyter.

Det viktigste i modellkortet er ikke at den kan lage enda en AI-låt. Det er at modellen beskrives som en produksjonsklar, åpen vektmodell med en arkitektur som faktisk er laget for lange, sammenhengende sanger. MiniMax sier Music 3 kombinerer en 8B Global LLM for langtrekkende musikalsk struktur, en 0,6B Local LLM for akustiske detaljer, og en syntesedel basert på Flow Matching og Flow-VAE. Resultatet er 32 kHz, 16-bit stereo WAV. Det er ikke bare en promptgenerator foran et lukket lyd-API. Det er en modellpakke som kan bli del av produktstakk, kreative systemer og lokale pipelines.

Hva som faktisk er nytt

Music 3 støtter fullsong-generering opp til fem minutter. Modellkortet peker eksplisitt på evnen til å holde musikalske temaer, rytme, vokalidentitet og arrangement gjennom intro, vers, pre-chorus, chorus, bridge, instrumentalparti og outro. Den tar to hovedinput: lyrics, gjerne med seksjonstagger, og en musikkbeskrivelse som styrer sjanger, stemning, vokal, instrumenter og produksjonsprofil. For mer presis styring anbefaler MiniMax en strukturert caption med global metadata, vokaldetaljer og arrangement.

Det er et annet kontrollnivå enn korte lydklipp og jingler. For et markedsmiljø betyr det at AI-musikk nærmer seg produksjon av kampanjevarianter, lokaliserte lydidentiteter, demoer, spillinnhold og interne konsepter uten at alt må via én leverandørs webgrensesnitt. For produktteam betyr det at musikk kan bli en funksjon i egne apper. For juridisk og innkjøp betyr det at lisens, treningsdata, output-rettigheter og godkjenningsløp må inn i samme regime som bilde, video og tekst.

Lederpoenget

Denne typen modell gjør lyd til en del av den vanlige AI-plattformdiskusjonen. Skal selskapet bruke en ekstern tjeneste, en API-leverandør, eller kjøre åpne vekter selv? Det valget påvirker kostnad, datakontroll, revisjon, ventetid, kapasitet og leverandørbinding. MiniMax Music 3 er ikke nødvendigvis riktig svar for alle. Men den gjør spørsmålet vanskeligere å ignorere.

Åpne vekter gir mer teknisk frihet, men ikke automatisk lav risiko. Modellen kan kjøres med SGLang-Omni, diffusers og ComfyUI, og modellkortet beskriver også lavere VRAM-oppsett med CPU-offloading. Samtidig sier modellen lite offentlig om treningsdata i selve kortet. For kommersiell bruk bør derfor CIO, CMO og juridisk eie samme beslutning: hva kan genereres, hvor kan det brukes, hvem godkjenner, og hvordan logges prompt, modellversjon, seed og ferdig asset?

Det er særlig viktig for virksomheter med sterk merkevare. AI-generert musikk kan ligne eksisterende stiler, stemmer eller produksjonsgrep selv når ingen bevisst prøver å kopiere. En åpen modell i en kreativ avdeling uten policy kan fort bli en IP- og omdømmerisiko. En åpen modell i en styrt pipeline kan derimot bli en billig og rask eksperimentmotor. Forskjellen ligger i styringen, ikke i magien.

Praktisk konsekvens for norske virksomheter

Første bruk bør ikke være full kommersiell kampanje. Start med lavrisiko: interne konsepter, prototyper, spill- eller app-demoer, moodboards, radioreklameutkast og lokaliserte variasjoner som uansett går gjennom menneskelig vurdering. Lag samtidig en enkel auditlinje: modellnavn, versjon, lisenslenke, input, seed, outputfil, godkjenner og bruksområde. Det høres kjedelig ut. Det er derfor det virker.

Sikkerhetsteam bør også tenke bredere enn tekst. Når lydmodeller blir lokale og billige, blir spoofing, falske merkevarelyder og syntetisk vokal lettere å produsere. Det betyr ikke at Music 3 i seg selv er et sikkerhetsproblem. Det betyr at lyd nå hører hjemme i AI-governance, på samme måte som bilde, video og agentverktøy.

MiniMax Music 3 viser hvor raskt generativ media flytter seg fra lukket leketøy til infrastruktur. For ledere er konklusjonen enkel: ikke la kreativ AI leve som en uformell sidekanal. Enten bygg en styrt sandbox, eller la være å bruke det kommersielt. Halvstyrt AI-musikk er som halvstyrt merkevarejuridikk. Det blir fort dyrere enn det høres ut.

Kilder og medier

Primærkilde: MiniMax / Hugging Face model card – https://huggingface.co/MiniMaxAI/MiniMax-Music3 Supplerende prosjektkilde: GitHub – https://github.com/MiniMax-AI/MiniMax-Music3 Demo: https://minimax-ai.github.io/music3-demo/ Thumbnail: OpenAI Image 2 / hogby.ai

📬 Likte du denne?

AI-nyheter for ledere. Kuratert av en CIO som bygger det selv. Daglig i innboksen.