DeepSeek kondigt forse prijsverhoging aan door stijgende vraag naar goedkope AI-modellen

DeepSeek heeft aangekondigd de prijzen van zijn API-diensten op korte termijn aanzienlijk te verhogen. Volgens de Chinese AI-start-up worden de nieuwe tarieven later bekendgemaakt, maar gebruikers doen er goed aan hun gebruik hier alvast rekening mee te houden. De aankondiging volgt een week na de introductie van DeepSeek-V4-Flash-0731, een lichtgewicht AI-model met 284 miljard parameters. Het model trok wereldwijd veel aandacht doordat het prestaties levert die dicht in de buurt komen van de beste AI-modellen, terwijl de kosten veel lager liggen. De prijsverhoging onderstreept de uitdaging waar DeepSeek voor staat. Het bedrijf heeft zijn reputatie opgebouwd met zeer lage prijzen, maar moet die strategie zien vol te houden in een markt waar de concurrentie steeds heviger wordt. AI-ontwikkelaar Michael Guo schreef op X dat een prijsverhoging op dit moment riskant kan zijn, omdat nieuwe modellen van onder meer Meta en OpenAI volgens hem vergelijkbare prestaties leveren tegen concurrerende tarieven. Onderzoeksbureau Epoch AI noemt DeepSeek-V4-Flash-0731 momenteel het op één na krachtigste open-weight AI-model op de markt, alleen overtroffen door het Kimi K3-model van het Chinese Moonshot AI. De prestaties zouden ongeveer tussen Anthropic’s Claude Opus 4.5 en Opus 4.6 liggen. Ook qua prijs onderscheidt het model zich sterk. Volgens Artificial Analysis kost een gemiddelde taak met DeepSeek-V4-Flash-0731 ongeveer 3 dollarcent, tegenover 3,15 dollar voor Anthropic’s Claude Fable 5. Dat maakt het DeepSeek-model ongeveer 105 keer goedkoper. Epoch AI wijst erop dat DeepSeek niet alleen goedkoper is dan Amerikaanse concurrenten, maar ook veel voordeliger dan vergelijkbare Chinese modellen. De huidige API-prijzen bedragen 0,14 dollar per miljoen invoertokens en 0,28 dollar per miljoen uitvoertokens, terwijl concurrent Zhipu AI respectievelijk 1,40 dollar en 4,40 dollar rekent. De populariteit van het model groeit snel. Op het platform Ollama, waarmee AI-modellen lokaal kunnen worden uitgevoerd, is DeepSeek-V4-Flash-0731 volgens het bedrijf uitgegroeid tot het snelst groeiende model ooit gemeten op basis van tokengebruik. Ollama breidt daarom de capaciteit in de Verenigde Staten en Europa uit. Volgens hoogleraar Zhenhui Jack Jiang van de Universiteit van Hongkong, die sprak met de South China Morning Post, dankt DeepSeek zijn lage prijzen aan een efficiënte technische aanpak. Het model maakt gebruik van een zogenoemde mixture-of-experts-architectuur, waarbij slechts een deel van het netwerk per opdracht wordt geactiveerd. Daardoor zijn minder rekenkracht en geheugen nodig. Daarnaast gebruikt DeepSeek een trainingsmethode waarbij kennis uit meerdere gespecialiseerde AI-modellen wordt samengebracht in één model, waardoor het efficiënter kan worden getraind.
emerce
10-08-2026 08:44