Live News

De FBI maakt al sinds 1998 gebruik van hacktechnieken en -hulpmiddelen, zoals spyware, maar tot op heden zijn er geen openbare gegevens waaruit bli...

De Chinese fabrikant van autonome voertuigen Pony AI en Uber zijn van plan om 2.000 robotaxis naar vier steden in Europa te brengen als onderdeel v...

In het kort Een rechter in Washington heeft Kalshi bevolen te stoppen met het aanbieden van weddenschappen op sport, verkiezingen, politiek, entert...

14/08/26

Volg ons:

Writer introduceert een nieuw AI-model en een geüpgraded harnas om de tokenkosten te beperken

Writer introduceert een nieuw AI-model en een geüpgraded harnas om de tokenkosten te beperken
Default Door Remote - 13 Aug 2026
In de hele AI-industrie worden gebruikers zich steeds bewuster van hoe duur hun implementaties kunnen zijn – en voelen ze een nieuwe urgentie om kosten te besparen. Maar hoewel open source-modellen aanzienlijk lagere kosten per token bieden, kan het moeilijk zijn om het juiste model voor een bepaalde taak te vinden.

Donderdag lanceerde Writer, dat AI-tools en agenten voor marketeers aanbiedt, een nieuw vlaggenschipmodel genaamd Palmyra X6, gericht op het oplossen van dat probleem voor zijn gebruikers. Writer is gebouwd als een post-training variant op Z.ai’s open source model GLM-5.2 en zegt dat het nieuwe systeem implementatieklare mogelijkheden moet bieden tegen een veel lagere prijs. Het bedrijf schat dat het nieuwe model, gecombineerd met veranderingen in de infrastructuur van het bedrijf, de kosten voor zijn klanten met maar liefst 50% zal verlagen voor basistaken.

Samen met het nieuwe model bracht het bedrijf ook aanzienlijke upgrades uit voor zijn standaard agentenharnas. Beide functies zijn vanaf donderdag beschikbaar voor Writer-klanten.

“Ik denk dat de onderneming het helemaal zat is om de volgende benchmark na te jagen”, vertelde CEO May Habib aan TechCrunch. “Ze willen de kosten afvlakken, en het lijkt erop dat niemand dat kan waarmaken.”

De nieuwe aanpak legt bijzondere nadruk op complexe, uit meerdere stappen bestaande taken, die sneller en met minder tokens worden uitgevoerd. En Writer ziet harnasoptimalisatie als een cruciale hefboom om dat mogelijk te maken.

Een recent artikel van Writer-onderzoekers verleent geloofwaardigheid aan deze aanpak, waarbij kleine veranderingen in de harnasefficiëntie in meerdere verschillende modellen worden getest. Uit het onderzoek bleek dat veranderingen in het harnas in veel gevallen een betrouwbaardere manier waren om de kosten te verlagen dan modelkeuze, waarbij de kosten tijdens de tests met gemiddeld 40% daalden.

“Het harnas is het enige onderdeel waarvan de efficiëntie zich vermenigvuldigt in elk model dat een organisatie hanteert – nu en in de toekomst”, schreven de onderzoekers.

Voor de klanten van Writer is de ervaring nog steeds modelonafhankelijk: Palmyra X6 zal naast andere Writer-modellen of externe modellen worden geplaatst die via Azure of Amazon Bedrock zijn geïmporteerd. Maar Habib ziet de drang om de kosten te verlagen ook als een breder wantrouwen jegens grote AI-laboratoria, die een financiële prikkel hebben om het gebruik van tokens te stimuleren.

“De kostenexplosie hier is ongekend voor klanten, en dat geldt ook voor de mate waarin CIO’s de labs opgeven”, vertelde Habib aan TechCrunch, eraan toevoegend dat de AI-labs “niet goed begrijpen hoe ze een onderneming kunnen helpen profiteren van AI.”