Op 13 augustus 2026 verschenen twee nieuwe modellen die de prijsverhoudingen in de markt opnieuw door elkaar schudden: Google lanceerde Gemini 3.7 Flash, en DeepSeek bracht zijn V4 Pro-model uit preview naar algemene beschikbaarheid. Beide zijn relevant voor Nederlandse professionals — maar op heel verschillende manieren.
Gemini 3.7 Flash: halvering van de prijs, sterke codeprestaties
Google presenteerde Gemini 3.7 Flash op 13 augustus als opvolger van Gemini 3.6 Flash — slechts drie weken na zijn voorganger, wat het hoge tempo van Google's Flash-reeks illustreert. Het model accepteert tekst, afbeeldingen, audio en video in een contextvenster van 1 miljoen tokens en genereert tot 64.000 output-tokens per verzoek.
Wat opvalt aan de prestatiecijfers: op FrontierCode 1.1 scoort 3.7 Flash 43,6% tegenover 34,4% voor zijn voorganger, en op DeepSWE v1.1 65,3% versus 49,0%. Dat zijn substantiële sprongen voor een tussenversie. Voor ontwikkelaars en teams die veel code laten genereren of reviewen — denk aan softwarebedrijven — is dit een relevant ijkpunt.
De introductieprijs bedraagt $0,75 per miljoen input-tokens en $3,75 per miljoen output-tokens, geldig tot en met 31 december 2026. Daarna verdubbelt de prijs naar $1,50 / $7,50. De tijdelijke introductieprijs is bewust lager dan Gemini 3.6 Flash en ligt ook onder vergelijkbare modellen van OpenAI en Anthropic. Google AI Studio en Vertex AI bieden het model via API aan; Gemini AI Pro- en Ultra-abonnees kunnen het via Gemini Spark inzetten.
Voor de EU-context: via Vertex AI is EU-dataresidentie afdwingbaar (Google Cloud biedt regiovastzetting inclusief Nederland). Dat maakt dit model voor zakelijke gebruikers die AVG-compliance willen garanderen, beter bruikbaar dan de consumentenapp. Zie de modelpagina van Gemini voor het volledige privacyprofiel.
DeepSeek V4 Pro 0813: GA én een aangekondigde prijsstijging
Tegelijk bracht DeepSeek zijn V4 Pro-model uit preview (GA-lancering 13 augustus). Het betreft een mixture-of-experts-architectuur met 1,6 biljoen parameters totaal en 49 miljard actief per token, een contextvenster van 1 miljoen tokens en een maximale output van 384.000 tokens. Het model ondersteunt zowel een denkmodus (chain-of-thought) als een snellere niet-denkmodus.
De huidige API-prijs is $0,435 per miljoen input-tokens (bij cache-miss) en $0,87 per miljoen output-tokens — goedkoop vergeleken met Amerikaanse concurrenten. Echter: DeepSeek heeft een significante prijsstijging aangekondigd voor de nabije toekomst. Wie nu kosten-batenberekeningen maakt op basis van de huidige tarieven, doet er verstandig aan die bandbreedte in te calculeren.
AVG-aandachtspunt: de officiële DeepSeek-clouddienst slaat data op in China, zonder adequaatheidsbesluit van de EU. Voor Nederlandse organisaties in gereguleerde sectoren — zorg, juridisch, financieel advies — blijft de directe API van DeepSeek een risico. Alternatieven zijn: zelfhosting van de open weights op EU-infrastructuur, of gebruik via Microsoft Azure (Foundry, beschikbaar sinds mei 2026 voor V4-generatie), waar EU-dataresidentie wél gewaarborgd is. Zie onze veiligheidspagina voor een overzicht per model.
Wat betekent dit in samenhang?
De twee lanceringen illustreren een breder patroon: de AI-markt concurreert tegelijk op prestaties én prijs, maar de goedkoopste opties zijn niet altijd de AVG-vriendelijkste. Voor Nederlandse professionals is de afweging steeds drieledig: wat kan het model, wat kost het, en waar worden mijn data verwerkt?
Gemini 3.7 Flash biedt een betrouwbare EU-route via Vertex AI. DeepSeek V4 Pro biedt frontier-prestaties tegen lage kosten, maar vereist actieve keuzes over de infrastructuur. Beide modellen zijn vandaag beschikbaar via hun respectievelijke API's.
Bronnen: SiliconAngle, 13 aug 2026 · MarkTechPost, 13 aug 2026 · Unite.AI, 13 aug 2026 · DeepSeek V4 Pro nieuws · LLM Gateway timeline