Marketplace
MarketplaceMobil mega-meny för innehåll, tjänster och konto.

Huvudspår

Köp & säljAnnonserBoendeBostadObjektObjektBe om prisOffertFöretagsregisterFöretagLånBanklånLokaltHittaKarriärJobbDestinationerResorCoinsKryptoDiskussionForumKunskapWiki
AI-nyheter

DeepSeek V4.1 Flash lanserad – billigare API och ny arkitektur

Illustrationsbild: abstrakt neuralt nätverk. Bilden föreställer inte DeepSeek V4.1 Flash eller DeepSeeks faktiska system.
Illustrationsbild av ett abstrakt neuralt nätverk. Bilden föreställer inte DeepSeek V4.1 Flash eller DeepSeeks faktiska system. AI-genererad bild.Bildkälla:Sodapeaw / MagnificLicens

DeepSeek V4.1 Flash lanserad – billigare API och ny arkitektur

DeepSeek har den 10 september 2026 officiellt lanserat DeepSeek V4.1 Flash. Den kinesiska AI-utvecklaren beskriver modellen som den minsta medlemmen i en ny arkitekturfamilj, med inbyggd visuell förståelse, högre kapacitetstak, snabbare inferens och högre genomströmning. Samtidigt sänks API-priserna och det nya modellnamnet för API-anrop är `deepseek-flash`.

Lanseringen är relevant även för svenska utvecklare och företag som jämför kostnader för kodassistenter, AI-agenter och multimodala arbetsflöden. Men DeepSeeks egna prestandapåståenden bör skiljas från oberoende tester: flera av de siffror som publicerats vid lanseringen kommer från företagets egen utvärdering.

DeepSeek V4.1 Flash i korthet

PunktUppgift vid lanseringen
Lanseringsdatum10 september 2026
API-modellnamn`deepseek-flash`
Kontextlängd1 miljon tokens
Maximal output384 000 tokens
Visuell förståelseJa
Tool callsJa
Responses APIJa
Off-peak, cache-träff0,003 dollar per 1 miljon inputtokens
Off-peak, cache-miss0,15 dollar per 1 miljon inputtokens
Off-peak, output0,60 dollar per 1 miljon tokens

Uppgifterna ovan kommer från DeepSeeks aktuella API-dokumentation. Peak-priserna är dubbla och gäller enligt företaget vardagar 01.00–04.00 och 06.00–10.00 UTC.

Ny arkitektur med multimodal förståelse

DeepSeek beskriver V4.1 Flash som den första mindre modellen i en ny modellarkitektur. Företaget säger att konstruktionen är gjord för att ge ett högre kapacitetstak, snabbare inferens, högre genomströmning och möjlighet att skala vidare till större modeller.

En viktig skillnad är att visuell förståelse nu ingår i modellen. DeepSeeks pris- och modelltabell markerar stöd för Vision, samtidigt som modellen även stöder JSON-output, verktygsanrop, Responses API och Anthropic-kompatibelt API-format.

Det betyder inte automatiskt att modellen är bäst för alla bild- eller agentuppgifter. Kvalitet, latens och kostnad behöver mätas på den faktiska arbetslasten, särskilt när ett system använder långa kontexter eller flera verktygsanrop.

Så ändras DeepSeek-API:t

För att anropa den nya modellen ska utvecklare använda modellnamnet `deepseek-flash`. DeepSeek uppger att de tidigare modellerna V4 Flash och V4 Flash Vision Exp har tagits ur drift.

De äldre modellnamnen `deepseek-v4-flash` och `deepseek-v4-flash-vision-exp` accepteras tills vidare för kompatibilitet, men anropen betjänas enligt dokumentationen av V4.1 Flash och debiteras enligt Flash-priset.

Det är en viktig detalj för produktionsmiljöer. Ett gammalt modellalias kan alltså fortsätta fungera samtidigt som den faktiska modellen bakom aliaset har ändrats. Team som kräver reproducerbart beteende bör därför kontrollera modellversion och köra regressionstester efter lanseringen.

V4 Pro ska tillfälligt routas till V4.1 Flash

DeepSeek säger att företagets egna tester visar att V4.1 Flash har gått om V4 Pro i prestanda, kostnad, hastighet och total körtid. Det är DeepSeeks egen bedömning och bör inte läsas som ett oberoende benchmarkresultat.

Från klockan 12.00 Pekingtid den 14 september 2026 planerar DeepSeek att routa anrop till `deepseek-v4-pro` vidare till V4.1 Flash. Den lösningen ska gälla tills en framtida V4.1 Pro lanseras. Under perioden ska anropen debiteras enligt V4.1 Flash-priset.

För utvecklare som uttryckligen valt Pro-modellen innebär det att samma modellnamn senare kan ge svar från en annan modellfamilj. Det gör egna tester extra viktiga före och efter den 14 september.

Nya API-priser för DeepSeek V4.1 Flash

DeepSeek har samtidigt sänkt priserna för Flash-nivån. Den officiella prislistan anger följande off-peak-priser per en miljon tokens:

  • cache-träff för input: 0,003 dollar
  • cache-miss för input: 0,15 dollar
  • output: 0,60 dollar

Under peak-tid är priserna 0,006 dollar, 0,30 dollar respektive 1,20 dollar. Peak-fönstren är enligt DeepSeek 01.00–04.00 och 06.00–10.00 UTC från måndag till fredag.

Tokenpris är dock inte samma sak som total kostnad för ett färdigt jobb. En modell som skriver längre svar, behöver fler agentsteg eller kräver fler omkörningar kan bli dyrare i praktiken även om priset per token är lägre. Svenska företag bör därför jämföra kostnad per godkänt resultat, inte bara listpriset.

DeepSeeks egna benchmarkresultat

DeepSeek publicerar en rad resultat i samband med V4.1 Flash-lanseringen. Bland annat anges:

BenchmarkDeepSeeks rapporterade resultat
GPQA Diamond90,9
Terminal-Bench 2.190,6
DeepSWE v1.174,2
Automation-Bench54,8
Agents' Last Exam31,8

Resultaten är användbara som en första indikation, men de är leverantörens egna lanseringssiffror. Metod, agentramverk, verktyg, reasoning-inställningar och exakt testmiljö kan påverka jämförelser kraftigt. Reuters rapporterar också lanseringen och beskriver modellen som inriktad på högre kapacitet, snabbare inferens, högre genomströmning och skalning till större modeller.

Vad betyder lanseringen för svenska användare?

För svenska utvecklingsteam är tre saker särskilt intressanta: lägre API-pris, ett nytt standardnamn för Flash-modellen och att multimodal förståelse nu ingår direkt i V4.1 Flash.

Den som redan använder DeepSeek bör samtidigt kontrollera integrations- och säkerhetskrav. Ett modellbyte kan påverka svarsstil, verktygsanrop och regressioner även när API-formatet är kompatibelt. För organisationer som hanterar personuppgifter, källkod eller affärshemligheter är leverantörs- och dataskyddsbedömningen fortfarande separat från modellens benchmark och pris.

Marketplace har tidigare gått igenom DeepSeek-R1 och hur modellen pressade AI-priserna samt en checklista för DeepSeek och datasäkerhet i företag.

Vad bör utvecklare göra nu?

Den praktiska vägen är att behandla V4.1 Flash som en ny modellversion även om ett äldre alias fortfarande fungerar. Kör ett eget testset med verkliga uppgifter, kontrollera kostnad, latens, tool calls och svensk språkprecision, och verifiera hur modellen beter sig med långa kontexter och bilder.

Särskilt viktigt är att inte anta att DeepSeeks egna benchmark automatiskt motsvarar resultat i en egen kodbas eller verksamhetsprocess. En snabbare modell är värdefull först när den också levererar tillräckligt korrekta resultat.

Källor

  • DeepSeek: officiell changelog för V4.1 Flash
  • DeepSeek: aktuella modeller och API-priser
  • Reuters: DeepSeek launches V4.1-Flash model

Sammanfattning

DeepSeek V4.1 Flash lanserades den 10 september 2026 med ett nytt API-modellnamn, inbyggd visuell förståelse och lägre priser. DeepSeek säger att den nya modellen slår V4 Pro på flera övergripande mått, men det påståendet kommer från leverantören och behöver kompletteras med oberoende och egna tester.

För användare är den största omedelbara förändringen konkret: `deepseek-flash` är det nya modellnamnet, äldre Flash-alias routas till V4.1 Flash och V4 Pro planeras att routas dit från den 14 september tills V4.1 Pro lanseras.

Dela artikeln

Tipsa någon som kan ha nytta av den.

Kommentarer

Kommentarer

Diskutera artikeln i tråden nedan.

Inga omdömen ännu0 omdömen
Fortsätt diskussionen i ForumEn gemensam tråd skapas för artikeln. Har du redan konto kan du logga in och fortsätta direkt.
Diskutera i Forum
Lägg till kommentar

Kommentaren granskas innan den publiceras.

Ditt omdöme