Snilld

Baseten føjer DeepSeek‑V4.1‑Flash til Model APIs med 1M‑token kontekst

Baseten gør DeepSeek‑V4.1‑Flash tilgængelig via sine Model APIs pr. 11. september 2026, ifølge Basetens egen meddelelse og Unite.ai. Kilderne beskriver en 552B multimodal MoE‑model med 1M‑token kontekst og asymmetrisk aktiv parameter‑split (8B prefill, 16B decode) samt Causal Encoder‑Decoder og forbedret KV‑cache med fokus på coding‑workloads. Der foreligger ingen uafhængige benchmarks i kilderne.

12. september 2026 Peter Munkholm

Resumé og nyhedskrog

Baseten meddelte 11. september 2026, at DeepSeek‑V4.1‑Flash nu er tilgængelig via Baseten Model APIs. Det fremgår af Basetens blog og bekræftes også af Unite.ai. Kilderne beskriver modellen som en 552 milliarder‑parameters multimodal Mixture‑of‑Experts med 1.000.000 tokens kontekstvindue og en asymmetrisk aktiv fordeling af parametre mellem prefill og decode.

Unite.ai oplyser, at DeepSeek frigav de åbne weights på Hugging Face med en meddelelse dateret 9. september 2026, og Basetens blog indikerer samme tidslinje i sin opdatering. Begge kilder beskriver input og output som multimodal ind (tekst og billede) og tekst ud.

Nærbillede af et slidt task‑tag på en metallskinne, ingen læsbar tekst, dyb indigo belysning med cyan kantlys.

Hvad kilderne siger om modellen

Unite.ai og Baseten angiver, at DeepSeek‑V4.1‑Flash har 552B parametre og anvender en MoE‑tilgang, hvor et aktivt sæt parametre på cirka 8B benyttes i prefill og 16B i decode. Ifølge Baseten anvender modellen en Causal Encoder‑Decoder‑arkitektur, og Baseten fremhæver forbedret KV‑cache‑effektivitet og mere effektiv prefill rettet mod coding‑workloads.

I kilderne angives kontekstvinduet til 1M tokens. Begge kilder beskriver, at modellen accepterer tekst og billede som input og genererer tekstligt output. Disse punkter fremgår eksplicit af både Basetens blog og Unite.ai‑artiklen.

Datoer og tilgængelighed i kilderne

Basetens blog er opdateret 11. september 2026 og oplyser, at DeepSeek‑V4.1‑Flash er “available now as a Baseten Model API”. Unite.ai angiver tilsvarende, at Baseten annoncerede tilgængeligheden 11. september 2026. Begge peger desuden på, at DeepSeek lagde åbne weights på Hugging Face i ugen op til annonceringen, med DeepSeeks meddelelse dateret 9. september 2026 ifølge Unite.ai.

Banner

Kilderne leverer ikke yderligere dokumentation for licensvilkår i selve artiklerne/indlæggene og citerer ikke en specifik licenstekst fra Hugging Face. De henviser blot til, at vægtene er frigivet som åbne weights på Hugging Face.

Arkitektur og implikationer ifølge Baseten

Baseten beskriver en Causal Encoder‑Decoder‑arkitektur og angiver forbedret KV‑cache‑effektivitet med henblik på mere effektiv prefill i særligt coding‑scenarier. Formuleringen er Basetens egen og ledsages ikke af tredjepartsbenchmarks i kilderne. Den asymmetriske aktive parameter‑fordeling (8B prefill, 16B decode) fremgår ligeledes eksplicit i både Baseten og Unite.ai.

Unite.ai’s gennemgang af specifikationerne matcher Basetens liste på centrale punkter: 552B parametre, 1M‑token kontekst, 8B/16B aktiv split og multimodal input med tekstligt output.

En tekniker i arbejdstøj justerer en rack‑monteret test‑blade i et lille research‑rum, ansigt ude af fokus, dyb lilla stemning.

Kontekstvindue og input/outputs

Begge kilder anfører, at modellen understøtter et kontekstvindue på 1.000.000 tokens. Derudover angiver de, at modellen kan indtage både tekst og billeder som input og producerer tekst som output. Kilderne uddyber ikke detaljer om billedopløsninger eller specifik håndtering af meget lange billedserier.

Kilderne fremlægger ikke uafhængige resultater, der kvantificerer latenstid eller omkostning som funktion af kontekstlængde.

Loops‑understøttelse

Baseten oplyser, at Loops‑understøttelse er “coming soon” for DeepSeek‑V4.1‑Flash i deres miljø. Der angives ikke en dato i kilderne for, hvornår dette bliver tilgængeligt.

Unite.ai omtaler ikke Loops i detaljer ud over Basetens egen note om, at funktionen er på vej.

Banner

Hvad kilderne ikke dokumenterer

Hverken Baseten‑bloggen eller Unite.ai leverer uafhængige benchmarks, prisoplysninger per 1K tokens, GPU/HW‑profilering eller målinger af latenstid/throughput ved lange prefill‑sekvenser. Kilderne oplyser heller ikke detaljerede licensvilkår for de åbne weights ud over, at de er lagt på Hugging Face.

Basetens udsagn om forbedret KV‑cache og mere effektiv prefill er karakteriseret som deres egne produktbeskrivelser. Der indgår ingen sammenlignende, tredjepartsvaliderede nøgletal i det tilgængelige kildemateriale.

Nærbillede af en slidbane på et metalhjul, metafor for belastning og slid ved lange kørsler.

Overblik i punktform fra kilderne

  • Tilgængelighed: Baseten angiver 11. september 2026 som annonceringsdato og “available now”.
  • Vægte: Unite.ai angiver DeepSeeks meddelelse om åbne weights på Hugging Face dateret 9. september 2026.
  • Specifikationer: 552B parametre, MoE, 1M‑token kontekst, 8B prefill/16B decode aktiv split.
  • Arkitektur: Causal Encoder‑Decoder og forbedret KV‑cache ifølge Baseten.
  • Modalitet: Tekst og billede ind, tekst ud.
  • Funktioner: Loops‑understøttelse “coming soon” ifølge Baseten.

Afgrænsning og anvendelsesnær relevans som beskrevet i kilderne

Kilderne fokuserer på, at modelarkitektur og cache‑forbedringer er designet til mere effektiv prefill i coding‑workloads. De fremlægger specifikationer og tilgængelighed via Baseten Model APIs, men uden uafhængig dokumentation for ydeevne på tværs af konkrete produktionsscenarier.

Det betyder, at eventuelle forventninger til runtime‑ eller omkostningsgevinster bør læses som udbyderbeskrivelser i det foreliggende kildemateriale. Kilderne tilbyder ikke eksterne målinger, der bekræfter effekter på tværs af varierende kontekstlængder eller batchstørrelser.

Praktisk næste skridt med udgangspunkt i kilderne

Kilderne peger på, at modellen nu er tilgængelig som Baseten Model API og at vægtene ligger som åbne weights på Hugging Face. Derudover anbefaler kilderne ikke en bestemt målemetode, budgettering eller arkitekturvalg, og de leverer ikke licenstekst. Eventuelle beslutninger om anvendelse kræver derfor egen gennemgang af Basetens dokumentation og DeepSeeks Hugging Face‑materiale, herunder licensfilen.

Basetens henvisning til Loops som “coming soon” er det eneste, der ligner en fremadskuende funktionalitet i kilderne, men uden datoangivelse.

Konklusion i lyset af dokumenterede kilder

Baseten har gjort DeepSeek‑V4.1‑Flash tilgængelig via Model APIs med en annoncering 11. september 2026, samtidig med at DeepSeek har frigivet åbne weights på Hugging Face i ugen op til, med meddelelsesdato 9. september 2026 ifølge Unite.ai. De centrale, kildeunderstøttede specifikationer er 552B parametre, 1M‑token kontekst, MoE‑arkitektur med 8B/16B aktiv split, multimodal input og tekstligt output samt en Causal Encoder‑Decoder med forbedret KV‑cache ifølge Baseten.

Kilderne tilvejebringer ikke tredjepartsbenchmarks, pris eller hardwareprofiler. Det foreliggende materiale er derfor velegnet som overblik over tilgængelighed og egenskaber, mens præstation og omkostninger ikke er dokumenteret ud over udbyderens beskrivelser.

Kilder

    Gør brugeroplevelsen bedre.
    Hvilket firma arbejder du for?