Sakana heeft op 24 juli 2026 een nieuwe versie van zijn orchestratiemodel uitgebracht: Fugu Ultra v1.1. Het resultaat is een model dat volgens Sakana tot 7,9 punten beter scoort op interne benchmarks dan v1.0, met de sterkste winsten op coding- en agentic taken. En dat alles tegen dezelfde prijs.

Wat is Sakana Fugu

Fugu is geen klassiek taalmodel. Het is een multi-agent systeem dat zich gedraagt als één model. Achter één API-call zit een orchestrator die dynamisch bepaalt welke frontier-modellen aan een specifieke taak worden toegewezen.
Het is een dirigent die verschillende specialisten laat samenwerken op basis van wat de taak nodig heeft.

Die aanpak is gebouwd op twee onderzoekspapers die op ICLR 2026 zijn gepresenteerd. TRINITY beschrijft een compacte coordinator die drie rollen verdeelt over een pool van LLM’s zonder gewichten samen te voegen. Het Conductor-model gebruikt reinforcement learning om communicatietopologieën tussen agents te ontwerpen en instructies op maat te schrijven voor elke worker. Samen zorgen die technieken ervoor dat de orchestrator kan leren welke combinatie van modellen het beste werkt per taaktype.

Het praktische voordeel: één API waar je alles doorheen stuurt, in plaats van zelf een setup te bouwen die per taak wisselt tussen providers. Sakana neemt de complexiteit van modelselectie op zich.

Wat verandert er in versie v1.1

De essentie van de update draait om drie punten.

Nieuwe frontier-modellen in de pool. Omdat Fugu een orchestrator is, hoeft Sakana niet het hele model opnieuw te trainen om betere resultaten te leveren. Het volstaat om de onderliggende agent-pool te verversen met sterkere modellen.

Winst op alle benchmarks die Sakana rapporteert. De grootste sprongen tot 7,9 punten zijn de bovengrens, niet het gemiddelde.

Sterkste verbeteringen op coding en agentic taken.

De model-ID is veranderd

Een detail dat operationeel belangrijker is dan het lijkt: het oude endpoint fugu-ultra-20260615 heet nu fugu-ultra-v1.0. Sakana stapt af van dated snapshots en gaat over op een v1.x-versienummering. Dat maakt drop-in upgrades en rollbacks eenvoudiger.

Prijzen blijven onveranderd

Fugu Ultra v1.1 en v1.0 delen exact dezelfde tarieven:

  • 5 dollar per 1 miljoen input tokens
  • 30 dollar per 1 miljoen output tokens
  • 0,50 dollar per 1 miljoen cached input tokens
  • Boven 272K context verdubbelen deze bedragen

De abonnementstiers zijn ook gelijk gebleven en bevatten telkens zowel standaard Fugu als Fugu Ultra. Sakana heeft  een launch-promo waarbij een abonnement voor eind juli 2026 een gratis tweede maand oplevert.

Belangrijker dan de tokenprijs is de kost per voltooide taak. Fugu Ultra orchestreert meerdere agents achter één API-call en Sakana rekent één tarief op basis van het top-tier model dat betrokken is, in plaats van gestapelde per-model kosten. Dat is voordeliger dan naïeve multi-model billing, maar orchestratie kan het totale tokengebruik wel opblazen. Bij een A/B-test loont het om input, output, cached tokens, latency en retry rate mee te loggen naast de kwaliteit van het resultaat.

Fugu Cyber

Sinds de junilancering is er ook een derde model bijgekomen: Fugu Cyber. Dat is een variant gericht op cybersecurity zoals vulnerability research, threat investigation en security analysis. Sakana rapporteert 86,9% op CyberGym en 72,1% op CTI-REALM. De pPijs is hoger dan Ultra: 6 dollar input, 36 dollar output en 0,60 dollar cached per miljoen tokens, en Cyber is alleen beschikbaar via het Token Plan.

Claude Code-compatibele interface

Naast de v1.1-update kondigde Sakana ook Claude Code-compatibele endpoints aan. Je kan Fugu’s multi-agent intelligentie nu rechtstreeks binnen Claude Code inzetten, in de terminal waar veel developers al werken. In plaats van te vertrouwen op één model orkestreer je een gecoördineerd team van frontier-modellen vanuit dezelfde workflow.

Voor teams die al Codex of Cursor gebruiken is er een eenvoudige installatieprocedure voor Ubuntu en macOS. Windows-gebruikers moeten de handmatige setup volgen. Omdat Claude Code closed source is, zijn er kleine cosmetische compatibiliteitsverschillen. De claude-fugu launcher werkt zichzelf niet automatisch bij, dus wie de laatste Fugu-modellen wil gebruiken moet opnieuw installeren.

Beschikbaarheid en beperkingen

Fugu draait via een OpenAI-compatibele API. Dit betekent dat een bestaande OpenAI-client of coding harness zonder migratie werkt. Daarnaast is Fugu beschikbaar via OpenRouter, Vercel AI Gateway en models.dev.

Fugu is voorlopig niet beschikbaar in de EU en EEA. Sakana werkt aan GDPR-conformiteit.

Wanneer is upgraden verstandig

Omdat de prijs identiek is en de API onveranderd, gaat de upgrade-vraag vooral over evaluatie-inspanning. Overstappen ligt voor de hand als:

  • Je Fugu Ultra al draait en model-ID’s makkelijk kan A/B-testen
  • Je workload vooral bestaat uit coding, terminal-taken of agentic werk
  • Je een herbruikbare interne taakset hebt

Zeker eerst testen als:

  • Je taken structureel meer dan 272K context nodig hebben
  • Je onafhankelijke benchmarks nodig hebt voor productie-adoptie
  • Je EU-gebruikers bedient
  • Je per-request inzicht nodig hebt in welke onderliggende modellen zijn ingezet

Een praktische hertest bestaat idealiter uit 50 representatieve taken, gescoord door mensen, met een aparte subset voor de categorieën waar Sakana verbeteringen claimt. Log tokengebruik, P50 en P95 latency, hoe vaak een tweede prompt nodig is en hoe vaak v1.1 de opdracht weigert of code kapotmaakt.

Wat deze release niet oplost is de routing-opaciteit. Je ziet nog altijd niet welke onderliggende modellen een specifieke request hebben verwerkt, en dat blijft een probleem in omgevingen waar compliance belangrijk is.