Aller au contenu principal
Vantaige
Sakana Fugu screenshot
Sakana Fugu logo

Sakana Fugu

Payant

Sakana Fugu est un modèle d'orchestration lancé en juin 2026 par l'entreprise japonaise Sakana AI : une API unique compatible OpenAI qui répartit les tâches entre GPT-5.5, Gemini et Claude Opus 4.8. Il affiche des scores de pointe en programmation, mais il s'agit d'un routeur et non d'un modèle unique, et il reste à la traîne derrière Fable 5 sur les benchmarks les plus exigeants.

Fonctionnalités :API

Sakana Fugu n'est pas un grand modèle de langage unique, même s'il est évalué comme tel et présenté comme un rival du Fable 5 d'Anthropic. Il s'agit d'un modèle d'orchestration : un coordinateur entraîné qui reçoit votre requête via une API compatible OpenAI et la répartit sur un ensemble de modèles de pointe existants (actuellement GPT-5.5, Gemini 3.5 Flash et Claude Opus 4.8), puis combine leur travail en une seule réponse. Il a été lancé le 22 juin 2026 par Sakana AI, le laboratoire tokyoïte cofondé par David Ha et Llion Jones, l'un des auteurs de l'article original sur les Transformers.

Fugu s'appuie sur deux articles de Sakana présentés à l'ICLR 2026 : Trinity, un petit coordinateur évolué d'environ 0.6B de paramètres, et Conductor, un modèle d'apprentissage par renforcement d'environ 7B de paramètres qui découvre des stratégies de coordination et peut s'appeler lui-même de manière récursive. Il est proposé en deux variantes derrière un seul point d'accès : Fugu, optimisé pour la vitesse et capable d'exclure des fournisseurs spécifiques pour des raisons de conformité, et Fugu Ultra, optimisé pour une précision maximale sur les tâches complexes à plusieurs étapes. Ce lancement est intervenu dix jours après que les contrôles à l'exportation américains ont coupé la majeure partie du monde de Fable 5 et Mythos Preview, et le positionnement de Sakana est explicite : des résultats de pointe sans dépendre d'un seul fournisseur ou d'une seule juridiction. Cette analyse sépare ce que Fugu fait réellement bien des éléments de ce discours qui ne tiennent pas la route.

Sakana Fugu en un coup d'œil, juin 2026

Fugu est, selon les propres termes de Sakana, « lui-même un LLM, entraîné pour faire appel à divers LLMs dans un groupe d'agents, y compris à des instances de lui-même de manière récursive ». Vous envoyez un prompt à un point d'accès compatible OpenAI sur console.sakana.ai, et le coordinateur décide quel spécialiste du groupe doit gérer chaque étape, en attribuant les rôles Thinker, Worker ou Verifier à tour de rôle, avant de renvoyer une réponse combinée unique. Il s'appuie sur un rapport technique publié sur arXiv (2606.21228), ce qui représente une transparence supérieure à celle de la plupart des lancements de produits.

Schéma de Sakana Fugu répartissant une tâche sur un ensemble de LLMs de pointe via un modèle d'orchestration unique

Deux variantes sont disponibles. Fugu est l'option par défaut axée sur la vitesse et les coûts, et vous permet d'exclure des fournisseurs spécifiques, ce qui est utile si vos règles de conformité interdisent un prestataire donné. Fugu Ultra (ID du modèle fugu-ultra-20260615) utilise un groupe fixe optimisé pour la précision. Sakana cite des études de cas couvrant la recherche automatisée, la prédiction de l'ordre de lecture du japonais classique, un solveur de Rubik's Cube, la conception CAO d'un iris mécanique, les échecs à l'aveugle et les décisions de trading d'actions. Une limite pratique au lancement : Fugu est disponible dans le monde entier, à l'exception de l'UE et de l'EEE, où la conformité au RGPD était encore en attente au 22 juin 2026.

Ce que Sakana Fugu fait vraiment bien

L'idée la plus forte ici est l'indépendance vis-à-vis des fournisseurs grâce à une interface unique. Au lieu de coder en dur votre architecture sur un seul modèle et de réécrire les prompts lorsque ce modèle change ou devient indisponible, vous faites appel à Fugu et laissez le coordinateur choisir. Pour une organisation ébranlée par les contrôles à l'exportation du 12 juin qui ont rendu Fable 5 et Mythos inaccessibles du jour au lendemain, cet argument de résilience est réel et opportun. Le PDG David Ha l'a formulé directement :

« S'appuyer sur les API d'une seule entreprise pour des infrastructures critiques, la finance ou la gouvernance constitue une vulnérabilité matérielle. Ce risque n'est plus une possibilité hypothétique, mais une réalité. » (David Ha, PDG de Sakana AI, juin 2026)

En termes de chiffres bruts, Fugu Ultra affiche effectivement des scores de pointe sur certaines parties de la suite de tests. Il est en tête sur LiveCodeBench (93.2) et prend une légère avance sur GPQA-Diamond (95.5), et Sakana rapporte qu'il surpasse Opus 4.8, GPT-5.5 et Gemini 3.1 Pro sur plusieurs benchmarks de programmation. L'orchestration récursive basée sur les rôles est un travail véritablement novateur de la part d'un laboratoire crédible, et le rapport arXiv rend la méthode inspectable plutôt que d'en faire une boîte noire.

La comparaison avec Fable 5 : ce que montrent vraiment les benchmarks

Sakana affirme que « Fugu Ultra fait jeu égal avec des modèles de premier plan comme Fable 5 et Mythos Preview sur les benchmarks d'ingénierie, scientifiques et de raisonnement les plus rigoureux de l'industrie ». Cette affirmation est réelle, mais trois éléments viennent la nuancer, et ils ont leur importance.

Premièrement, Fable 5 et Mythos ne font pas partie du groupe de Fugu. Ils sont soumis à des contrôles à l'exportation, Fugu ne peut donc pas y accéder, et la comparaison utilise les propres chiffres publiés par Anthropic plutôt qu'un test comparatif contrôlé. Deuxièmement, aucun tiers indépendant n'a encore reproduit les résultats. Troisièmement, les chiffres sont mitigés une fois que l'on regarde au-delà des victoires en programmation.

Graphique de benchmark comparant Sakana Fugu Ultra à Fable 5 et Mythos sur des tests de programmation, de raisonnement et d'ingénierie
BenchmarkFugu UltraFable 5 / MythosAvantage
LiveCodeBench93.289.8 (Fable 5)Fugu de 3.4
GPQA-Diamond95.594.1 (Mythos)Fugu de 1.4
SWE-Bench Pro73.780.0 (Fable 5)Anthropic de 6.3
TerminalBench 2.182.188.0 (Mythos)Anthropic de 5.9
Humanity's Last Exam50.053.3 (Fable 5)Anthropic de 3.3

L'analyse honnête : Fugu Ultra gagne sur LiveCodeBench et GPQA-Diamond et reste à la traîne sur les tests aux enjeux les plus élevés, SWE-Bench Pro, TerminalBench et Humanity's Last Exam. « Comparable à Fable 5 » correspond à une parité sélective sur quelques benchmarks, et non à une équivalence généralisée, et ces données sont rapportées par le fournisseur plutôt que vérifiées de manière indépendante. Considérez le titre comme du marketing, et le tableau comme la réalité.

Où Sakana Fugu échoue : les modes de défaillance signalés par les utilisateurs

Les premières réactions pratiques ont été pour la plupart sceptiques, et elles se concentrent sur trois problèmes : la vitesse, le coût et la question de savoir si l'orchestration ajoute suffisamment de valeur pour justifier cette couche supplémentaire. Sur Hacker News :

« Pour $200/mois, vous obtenez moins de 3 heures d'utilisation par semaine, l'API est extrêmement lente, et la qualité des résultats dans mes tests est loin d'égaler Fable. » (cortesi, Hacker News, juin 2026)

La critique structurelle la plus courante est que Fugu est un routeur payant superposé à des modèles pour lesquels vous payez déjà, ce qui peut signifier payer trois fournisseurs plus Sakana pour les coordonner. Un critique a résumé l'ambiance sans détour :

« Jusqu'à preuve du contraire, il s'agit simplement d'un routeur ou d'un wrapper très avancé, et non d'un bond fondamental en matière d'intelligence comme l'ont été Mythos ou Fable. » (GreedyWorking1499, Reddit, juin 2026)

Deux autres mises en garde méritent d'être pesées. L'argument de l'indépendance vis-à-vis des fournisseurs est en partie creux, car Fugu passe toujours par des modèles de pointe sous contrôle américain (Opus, GPT, Gemini), il réduit donc la dépendance à un seul fournisseur plutôt que d'éliminer l'exposition géopolitique. De plus, Sakana traîne un nuage sur sa crédibilité : son « AI CUDA Engineer » de 2025 revendiquait d'importantes accélérations de noyau qui ont rapidement été attribuées à une faille dans le bac à sable d'évaluation, c'est pourquoi une partie de la communauté souhaite une vérification indépendante avant de faire confiance aux chiffres phares de Fugu. Ajoutez à cela l'indisponibilité dans l'UE et la lenteur de l'API, et il s'agit d'un lancement à évaluer avec soin, et non à adopter aveuglément.

Sakana Fugu face à un modèle de pointe unique

La façon la plus claire de concevoir Fugu est de le voir comme un système permettant de décider comment utiliser plusieurs choix de modèles, tandis que Claude (Opus et Fable), ChatGPT (GPT-5.5) et Google Gemini sont des choix de modèles uniques avec une identité claire. Cette différence est à double tranchant. Le routage peut améliorer les résultats sur des travaux complexes à plusieurs étapes où différents modèles ont des forces différentes, et il vous donne un seul point d'accès à maintenir au lieu de trois intégrations. Mais il ajoute également de la latence, une couche de coûts, et réduit la visibilité sur le modèle qui a réellement produit votre résultat, ce qui est important pour la reproductibilité, le débogage et la conformité.

Fugu n'est donc pas un substitut direct à Fable 5. Si vous avez besoin d'un modèle premium connu, avec une identité stable et le meilleur score sur les benchmarks de programmation agentique les plus difficiles, un modèle de pointe unique reste gagnant. Si vous souhaitez un accès indépendant du fournisseur et êtes prêt à sacrifier un peu de contrôle et de vitesse pour l'obtenir, Fugu est l'option la plus intéressante. Les deux résolvent des problèmes différents, malgré la présentation des benchmarks qui les met en concurrence directe.

Tarifs de Sakana Fugu

L'accès se fait par abonnement ou par jetons à l'usage (pay-as-you-go). Les abonnements sont Standard à $20 par mois, Pro à $100 par mois (environ dix fois le quota Standard) et Max à $200 par mois (environ trente fois le Standard). La tarification à l'usage pour Fugu Ultra est de $5 par million de jetons en entrée et $30 par million de jetons en sortie, passant à $10 et $45 pour un contexte supérieur à 272K, avec une entrée en cache à $0.50 par million. Sakana offre un deuxième mois gratuit pour les abonnements souscrits avant le 31 juillet 2026. Notez que les coûts des jetons reflètent les frais généraux d'orchestration, car une seule requête peut se déployer sur plusieurs modèles sous-jacents, de sorte que les dépenses réelles peuvent être plus élevées que le tarif affiché ne le suggère sur des tâches à plusieurs étapes.

Qui devrait utiliser Sakana Fugu, et qui devrait attendre

Fugu mérite d'être examiné sérieusement si vous êtes un développeur ou une équipe de plateforme qui souhaite une API unique indépendante du fournisseur pour les modèles de pointe, une organisation préoccupée par la dépendance à un fournisseur ou l'exposition aux contrôles à l'exportation après les restrictions du 12 juin, ou une équipe effectuant des travaux complexes de programmation et de recherche à plusieurs étapes où le routage entre spécialistes peut aider. Le point d'accès compatible OpenAI rend l'essai facile si vous développez déjà sur cette interface.

Attendez ou cherchez ailleurs si vous avez besoin d'un modèle unique éprouvé avec une identité stable et les meilleurs scores sur les benchmarks de programmation agentique, où Fable 5 ou Opus 4.8 sont toujours en tête, si vous êtes sensible aux coûts ou à la latence, si vous êtes dans l'UE où il n'est pas encore disponible, ou si vous souhaitez un raisonnement de pointe vérifié de manière indépendante plutôt que des affirmations rapportées par le fournisseur pour un tout nouveau produit. Fugu est l'un des lancements les plus véritablement novateurs de la mi-2026, mais il n'a pas encore fait ses preuves sur le terrain, et la décision la plus judicieuse aujourd'hui est de le tester sur votre propre charge de travail plutôt que de vous fier au titre comparatif avec Fable 5.

Avis des utilisateurs

Aucun avis pour l'instant. Soyez le premier à partager votre expérience !

Se connecter pour écrire un avis.

Articles associés

Guides et articles en lien avec Sakana Fugu.