Op 20 augustus 2026 verscheen er zonder aankondiging een nieuw AI-model op OpenRouter. De naam is Ox Alpha, de maker zijn onbekend en de eerste testresultaten zijn spectaculair. Het anonieme stealthmodel scoort op coding benchmarks beter dan Grok 4.6 en GPT 5.6.

Wat is Ox Alpha?

Ox Alpha is een reasoning model dat volgens de operator is gepositioneerd voor coding, langdurig agentisch werk en gebruik in productieomgevingen. Een reasoning model neemt de tijd om een probleem stap voor stap te ontleden voordat het antwoordt. Dat maakt dit type model geschikt voor complexe codeertaken en problemen die meerdere stappen vereisen. Je vindt Ox Alpha op OpenRouter onder de modelnaam stealth/ox-alpha.

Een stealthmodel is een anonieme release. Het lab erachter verzamelt zo eerlijke reacties uit de praktijk voordat de merknaam bekend wordt. De specificaties van Ox Alpha zijn stevig voor een model dat je voorlopig gratis kan gebruiken.

  • Een contextvenster van 1.048.576 tokens. Dat is ruim een miljoen tokens en ruim het dubbele van wat Grok 4.6 aanbiedt.
  • Een outputlimiet van 131.072 tokens. Het model kan lange stukken code en uitgebreide analyses in één antwoord leveren.
  • Multimodale input. Het model verwerkt tekst, afbeeldingen en video.
  • Gratis toegang tijdens de previewperiode, met volgens de operator vrijwel onbeperkte rate limits.
  • Geen dataretentie. Jouw prompts en de gegenereerde output worden volgens de operator niet opgeslagen.
  • Een capaciteit van 100 biljoen tokens per dag.

Een capaciteit van 100 biljoen tokens per dag associeer je met een groot AI-lab met diepe zakken en eigen infrastructuur. Het is een van de redenen waarom de community ervan uitgaat dat hier een serieuze speler achter zit.

Ter vergelijking: Grok 4.6 heeft een contextvenster van 500.000 tokens en kost via OpenRouter 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Ox Alpha biedt een dubbel zo groot geheugen en kost je tijdens deze preview niets.

Ox Alpha’ scores op coding benchmarks

Op Kingbench haalde Ox Alpha een score van 87,5%. Daarmee eindigt het als tweede achter GLM 5.3, dat 91,25% scoorde. Het laat Opus 4.8 met 80% en Qwen 3.8 Max met 81,25% achter zich.

Minstens zo opvallend zijn de resultaten op een subset van tien agentische codingtaken uit Deep SWA. Ox Alpha haalde daar 80%. GLM 5.3 en Grok 4.6 kwamen elk tot 62% en GPT 5.6 bleef steken op 52%. Op X gaan inmiddels berichten rond van ontwikkelaars die het model op het gebied van coderen aan de absolute top plaatsen.

Ox Alpha presteert vooral sterk bij taken waarbij het lang moet doorredeneren, zelf stappen moet plannen en grote hoeveelheden context actief moet vasthouden.

Wie zit er achter Ox Alpha?

De grootste vraag blijft wie dit model heeft gebouwd. Op Manifold, een platform waar gebruikers wedden op toekomstige gebeurtenissen, loopt inmiddels een markt over precies die vraag. De meest concrete aanwijzingen komen uit een fingerprintinganalyse die vrij stellig één richting op wijst.

  • De encoder voor video produceert tokenaantallen die overeenkomen met die van GLM-modellen.
  • De vocabulary van de tokenizer matcht met GLM 5.3 en GLM 5V Turbo.
  • De schrijfstijl van de output lijkt op die van eerdere GLM-releases.
  • Audio als input wordt geweigerd, wat past bij een model waarin die modaliteit nog is afgeschermd.

Op basis van deze aanwijzingen schatten onderzoekers de kans op ongeveer 90% dat Ox Alpha een multimodaal model van een nieuwe generatie is van Zhipu, het Chinese lab achter de GLM-familie. In de community gaat de naam GLM 5.5 al rond als aanduiding voor wat er straks onthuld wordt. Zhipu heeft met GLM 5.3 al bewezen modellen te kunnen bouwen die aan de top meedraaien.

Pliny the Liberator merkte op dat iemand in theorie een bestaand model kan finetunen en als nieuw model kan lanceren. Cursor deed dit in het verleden. Maar dan kan je nog geen 100 biljoen tokens per dag met vrijwel onbeperkte rate limits weggeven. Zoiets vereist een hoeveelheid rekenkracht die weinig partijen ter wereld hebben.

De verwachting is dat de gratis previewperiode rond 27 augustus 2026 eindigt. Dat moment lijkt tegelijk de deadline voor de grote onthulling van de maker.

Zo test je Ox Alpha zelf

Zolang de preview loopt, kost testen alleen tijd. Ox Alpha draait via OpenRouter, dus als je dat platform al gebruikt, is overstappen een kwestie van de modelnaam in je code aanpassen naar stealth/ox-alpha. Een nieuwe integratie bouwen is overbodig. Een paar scenario’s waarin het model zijn kracht het best laat zien.

  • Laat het model een complete codebase analyseren. Het contextvenster van een miljoen tokens is groot genoeg om de meeste projecten in één prompt te behandelen.
  • Draai een agentische workflow waarin het model meerdere stappen zelfstandig plant en uitvoert. De hoge outputlimiet voorkomt afgekapte antwoorden halverwege een taak.
  • Voer screenshots, diagrammen of korte video’s mee als input om de multimodale kant te testen
  • Vergelijk de output rechtstreeks met je huidige model.

Test met je eigen codebase en je eigen prompts. Jouw ervaring in de praktijk met het model bepaalt uiteindelijk of een model voor jou waarde toevoegt. Hou er ook rekening mee dat er na 27 augustus veel kan veranderen. De gratis toegang kan eindigen, de naam kan worden aangepast,….

Waarom deze stealth release slim is uitgespeeld

Ox Alpha laat zien hoe een lab een model kan lanceren zonder dat een merknaam de beoordeling kleurt. Iedereen die nu test, kijkt puur naar prestaties.

Blijkt het inderdaad om GLM 5.5 te gaan, dan heeft Zhipu straks een straf marketingresultaat behaald.