Default
Door Remote - 13 Aug 2026
In het kort
Google heeft donderdag Gemini 3.7 Flash gelanceerd, een goedkoop coderings- en agentenmodel dat nu algemeen beschikbaar is.
OpenAI gaf een preview van GPT-5.6 Sol Ultrafast, een door Cerebras aangedreven laag die zijn meest capabele model tot 14× sneller draait.
De snelheidsrace is verschoven van ruwe intelligentie naar real-time agenten, maar alleen het model van Google bereikt vandaag de dag elke ontwikkelaar.
Google en OpenAI hebben vandaag allebei dezelfde boodschap gepusht: AI is nu snel genoeg om indrukwekkend te zijn voor degenen die AI-agenten gebruiken, waarbij elk bedrijf ultrasnelle modellen aankondigt.
De twee lanceringen zijn verschillend gebouwd en je hebt er vandaag slechts één daadwerkelijk in handen.
Myriad: Wanneer zal OpenAI GPT-6 uitbrengen? Klik om uw voorspelling te doen. Google heeft Gemini 3.7 Flash uitgebracht, het nieuwste model dat is afgestemd op softwarecodering en autonome zakelijke workflows. OpenAI heeft een beperkte preview geopend van GPT-5.6 Sol Ultrafast, een nieuwe servicelaag die het meest capabele model draait met maximaal 750 uitvoertokens per seconde.
Vandaag introduceren we Gemini 3.7 Flash, ons meest intelligente werkpaardmodel tot nu toe voor coderen en agents.
Dit model levert aanzienlijke winsten op op het gebied van software-engineering, webontwikkeling en complex kenniswerk.
Nu tot het einde van het jaar is Gemini 3.7 Flash beschikbaar… pic.twitter.com/RSCBDipjKn
— Google (@Google) 13 augustus 2026
Gemini 3.7 Flash is een model voor algemene beschikbaarheid. Het heeft maximaal een miljoen invoertokens nodig (ongeveer 750.000 woorden) en retourneert er 64.000, verwerkt tekst, afbeeldingen, video, audio en pdf's, en kan tools oproepen en een computer besturen. Google presenteert het als het goedkope brein voor autonome systemen die taken plannen en taken in meerdere stappen voltooien met minder menselijke hulp.
Het model offert geen kwaliteit op voor snelheid. Het is zowel capabeler als efficiënter, omdat we onze testcoderingstaak in 2 minuten en 13 seconden kunnen voltooien, terwijl het nieuwste Flash-model meer dan 5 minuten duurde. Het kwaliteitsverschil tussen de twee is ook merkbaar.
OpenAI's Ultrafast is geen nieuw model. Het is GPT-5.6 Sol – hetzelfde model dat OpenAI een AI-red-team gebruikte om zich vóór de lancering te beschermen tegen prompt-injectie-aanvallen – op een sneller spoor, mogelijk gemaakt door chipmaker Cerebras. Het is ongeveer 14 keer sneller dan de standaardsnelheid van GPT-5.6 Sol.
Preview Ultrasnelle modus: GPT-5.6 Sol met tot 14x de snelheid.
Als eerste gelanceerd in de OpenAI API voor een selecte groep klanten met uitgebreide toegang tot meer bedrijven naarmate de capaciteit groeit. pic.twitter.com/a5dleofiDJ
— OpenAI (@OpenAI) 13 augustus 2026
De chips op waferschaal van Cerebras genereren tot 750 tokens per seconde, ongeveer 560 woorden, snel genoeg zodat een stemagent tijdens een gesprek kan nadenken.
De cijfers die er toe doen Google's eigen benchmark geeft Gemini 3.7 Flash een voorsprong op Claude Sonnet 5, GPT-5.6 Terra en anderen in 11 van de 18 geteste categorieën, waaronder een top Code Arena web-dev-score van 1.588 Elo en 30,4% op AutomationBench voor zakelijke workflows. Dat is allemaal gebaseerd op de methodologie van Google, dus behandel de lead als de claim van het bedrijf.
Zoals elke Gemini Flash is het model ook goedkoop. Met 75 cent per miljoen inputtokens en $3,75 per miljoen outputtokens tot het einde van het jaar is dit de helft van het oorspronkelijke tarief van Gemini 3.6 Flash. Die introductieprijs vervalt op 31 december en verdubbelt vervolgens naar $ 1,50 en $ 7,50, wat nog steeds goedkoop is voor een Google-model.
OpenAI heeft geen onderlinge scores voor Ultrafast gepubliceerd buiten de offertes van klanten. Jane Street AI-ingenieur John Crepezzi zei in de aankondiging van OpenAI dat de snelheid van Cerebras "verschillende manieren mogelijk maakt om de modellen te gebruiken." Podiumproductleider Courtland Lykins noemde het "van onschatbare waarde in onze voice-stack", en zei dat de snelheid "de belervaring volledig verandert." Het niveau is voorlopig alleen op uitnodiging.
De snelheidsboost komt naar voren als de laboratoria veranderen van 'wie is het slimst' naar 'wie is snel genoeg voor agenten'. De timing van Google is duidelijk. Het vlaggenschip Gemini 3.5 Pro ontbreekt nog steeds, zonder dat er een releasedatum is opgegeven, drie weken na 3.6 Flash en dagen na een herschikking van het DeepMind-leiderschap waarbij Demis Hassabis terzijde werd geschoven voor plaatsvervanger Koray Kavukcuoglu. OpenAI huurt ondertussen de snelheid van Cerebras in plaats van op zijn eigen stack te wachten.
Gemini 3.7 Flash is nu live in meer dan 160 landen; GPT-5.6 Sol Ultrafast is nog steeds alleen op uitnodiging beschikbaar.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!
Google heeft donderdag Gemini 3.7 Flash gelanceerd, een goedkoop coderings- en agentenmodel dat nu algemeen beschikbaar is.
OpenAI gaf een preview van GPT-5.6 Sol Ultrafast, een door Cerebras aangedreven laag die zijn meest capabele model tot 14× sneller draait.
De snelheidsrace is verschoven van ruwe intelligentie naar real-time agenten, maar alleen het model van Google bereikt vandaag de dag elke ontwikkelaar.
Google en OpenAI hebben vandaag allebei dezelfde boodschap gepusht: AI is nu snel genoeg om indrukwekkend te zijn voor degenen die AI-agenten gebruiken, waarbij elk bedrijf ultrasnelle modellen aankondigt.
De twee lanceringen zijn verschillend gebouwd en je hebt er vandaag slechts één daadwerkelijk in handen.
Myriad: Wanneer zal OpenAI GPT-6 uitbrengen? Klik om uw voorspelling te doen. Google heeft Gemini 3.7 Flash uitgebracht, het nieuwste model dat is afgestemd op softwarecodering en autonome zakelijke workflows. OpenAI heeft een beperkte preview geopend van GPT-5.6 Sol Ultrafast, een nieuwe servicelaag die het meest capabele model draait met maximaal 750 uitvoertokens per seconde.
Vandaag introduceren we Gemini 3.7 Flash, ons meest intelligente werkpaardmodel tot nu toe voor coderen en agents.
Dit model levert aanzienlijke winsten op op het gebied van software-engineering, webontwikkeling en complex kenniswerk.
Nu tot het einde van het jaar is Gemini 3.7 Flash beschikbaar… pic.twitter.com/RSCBDipjKn
— Google (@Google) 13 augustus 2026
Gemini 3.7 Flash is een model voor algemene beschikbaarheid. Het heeft maximaal een miljoen invoertokens nodig (ongeveer 750.000 woorden) en retourneert er 64.000, verwerkt tekst, afbeeldingen, video, audio en pdf's, en kan tools oproepen en een computer besturen. Google presenteert het als het goedkope brein voor autonome systemen die taken plannen en taken in meerdere stappen voltooien met minder menselijke hulp.
Het model offert geen kwaliteit op voor snelheid. Het is zowel capabeler als efficiënter, omdat we onze testcoderingstaak in 2 minuten en 13 seconden kunnen voltooien, terwijl het nieuwste Flash-model meer dan 5 minuten duurde. Het kwaliteitsverschil tussen de twee is ook merkbaar.
OpenAI's Ultrafast is geen nieuw model. Het is GPT-5.6 Sol – hetzelfde model dat OpenAI een AI-red-team gebruikte om zich vóór de lancering te beschermen tegen prompt-injectie-aanvallen – op een sneller spoor, mogelijk gemaakt door chipmaker Cerebras. Het is ongeveer 14 keer sneller dan de standaardsnelheid van GPT-5.6 Sol.
Preview Ultrasnelle modus: GPT-5.6 Sol met tot 14x de snelheid.
Als eerste gelanceerd in de OpenAI API voor een selecte groep klanten met uitgebreide toegang tot meer bedrijven naarmate de capaciteit groeit. pic.twitter.com/a5dleofiDJ
— OpenAI (@OpenAI) 13 augustus 2026
De chips op waferschaal van Cerebras genereren tot 750 tokens per seconde, ongeveer 560 woorden, snel genoeg zodat een stemagent tijdens een gesprek kan nadenken.
De cijfers die er toe doen Google's eigen benchmark geeft Gemini 3.7 Flash een voorsprong op Claude Sonnet 5, GPT-5.6 Terra en anderen in 11 van de 18 geteste categorieën, waaronder een top Code Arena web-dev-score van 1.588 Elo en 30,4% op AutomationBench voor zakelijke workflows. Dat is allemaal gebaseerd op de methodologie van Google, dus behandel de lead als de claim van het bedrijf.
Zoals elke Gemini Flash is het model ook goedkoop. Met 75 cent per miljoen inputtokens en $3,75 per miljoen outputtokens tot het einde van het jaar is dit de helft van het oorspronkelijke tarief van Gemini 3.6 Flash. Die introductieprijs vervalt op 31 december en verdubbelt vervolgens naar $ 1,50 en $ 7,50, wat nog steeds goedkoop is voor een Google-model.
OpenAI heeft geen onderlinge scores voor Ultrafast gepubliceerd buiten de offertes van klanten. Jane Street AI-ingenieur John Crepezzi zei in de aankondiging van OpenAI dat de snelheid van Cerebras "verschillende manieren mogelijk maakt om de modellen te gebruiken." Podiumproductleider Courtland Lykins noemde het "van onschatbare waarde in onze voice-stack", en zei dat de snelheid "de belervaring volledig verandert." Het niveau is voorlopig alleen op uitnodiging.
De snelheidsboost komt naar voren als de laboratoria veranderen van 'wie is het slimst' naar 'wie is snel genoeg voor agenten'. De timing van Google is duidelijk. Het vlaggenschip Gemini 3.5 Pro ontbreekt nog steeds, zonder dat er een releasedatum is opgegeven, drie weken na 3.6 Flash en dagen na een herschikking van het DeepMind-leiderschap waarbij Demis Hassabis terzijde werd geschoven voor plaatsvervanger Koray Kavukcuoglu. OpenAI huurt ondertussen de snelheid van Cerebras in plaats van op zijn eigen stack te wachten.
Gemini 3.7 Flash is nu live in meer dan 160 landen; GPT-5.6 Sol Ultrafast is nog steeds alleen op uitnodiging beschikbaar.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!

