Portal by Spotify : -90% de tokens Claude Code

Original : Portal by Spotify cut my Claude Code token usage by 90%

Pourquoi c'est important

Le routage intelligent vers des modèles moins coûteux devient un enjeu majeur pour maîtriser les budgets IA en ingénierie.

Un ingénieur Spotify a réduit sa consommation de tokens Claude Code de 90% grâce à Portal by Spotify. En routant les tâches répétitives (lecture de fichiers, génération de boilerplate) vers Gemini 2.5 Flash via deux modes AiKA, il économise sur les coûts de frontier models.

Un ingénieur de Spotify explique comment il a réduit de 90% sa consommation de tokens Claude Code en exploitant Portal by Spotify et ses « AiKA Modes ». Le constat de départ : la majorité des tâches confiées à un agent de coding (lecture de fichiers, génération de tests, mise à jour de docs) ne requiert pas de raisonnement avancé, mais consomme massivement des tokens. Or, selon l'article, les coûts d'IA pour le coding devraient dépasser le salaire moyen d'un développeur d'ici 2028, et un quart des responsables engineering dépensent déjà 200 à 500 dollars par développeur par mois, certains dépassant 2 000 dollars.

La solution repose sur deux modes déclaratifs : « bulk-reader » pour déléguer la lecture de fichiers volumineux, et « code-writer » pour la génération de code boilerplate. Les deux utilisent Gemini 2.5 Flash comme modèle worker, nettement moins coûteux que les frontier models. Un plugin Claude Code baptisé « shunt » assure le routage automatique via des hooks PreToolUse, sans nécessiter de copier des règles dans chaque projet.

Source

engineering.atspotify.com — Lire l'original →