Kimi K3 + Fable : routage vers le SoTA à moindre coût

Original : Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA

Pourquoi c'est important

Le routage multi-modèles s'impose comme nouvelle norme pour allier qualité frontier et maîtrise des coûts en production.

Fireworks AI a testé Kimi K3 (open source) contre Fable 5 (propriétaire) sur environ 1 030 tâches agentiques. En combinant les deux modèles via un routeur, l'équipe atteint 93 % de précision avec un coût jusqu'à 50 fois inférieur à Fable seul.

Fireworks AI a publié le 21 juillet 2026 une étude comparative entre Kimi K3, modèle open source de Moonshot AI, et son propre modèle propriétaire Fable 5. Les deux modèles ont été soumis à un même environnement de test couvrant cinq familles de tâches : correction de bugs réels (SWE-bench, 460 tâches), opérations longues en terminal (89 tâches), algorithmique (100 tâches), implémentation multi-langages (225 tâches) et tâches juridiques (120 tâches).

Sur le benchmark SWE, les résultats sont quasi identiques : K3 obtient 92,4 % et Fable 92,6 %. Cependant, chaque modèle excelle dans des domaines précis : K3 est plus performant en mathématiques symboliques et outils de développement, tandis que Fable domine sur la visualisation web et les langages Java, Python et C++.

L'approche centrale de l'étude est le routage : plutôt que de choisir un seul modèle, un routeur dirige chaque tâche vers le modèle optimal. Le « oracle routing » montre que K3 est sélectionné dans 72 à 96 % des tâches, signalant que la majorité du travail ne nécessite pas un modèle frontier coûteux. Résultat : 93 % de précision globale et jusqu'à 50× de réduction de coût sur les boucles agentiques longues.

Source

fireworks.ai — Lire l'original →