Introduction
Dans le monde en constante évolution du développement logiciel, l'intelligence artificielle (IA) joue un rôle de plus en plus crucial. Mais avec cette avancée, les coûts associés à l'utilisation de modèles IA peuvent rapidement devenir prohibitifs. En 2028, les coûts de codage IA devraient dépasser le salaire moyen des développeurs. Déjà, un quart des leaders en ingénierie dépensent entre 200 et 500 dollars par développeur et par mois en tokens, certains dépassant même les 2 000 dollars.
C'est ici qu'intervient Portal de Spotify, qui a permis de réduire l'utilisation de mes tokens Claude Code de 90%. Comment ? Grâce à deux modes simples qui délèguent efficacement le travail à des modèles moins coûteux.
L'inefficacité des tokens de haute technologie
La plupart des tâches effectuées par un agent de codage IA ne nécessitent pas une réflexion intense. Qu'il s'agisse de lire plusieurs fichiers pour répondre à une question ou de générer un fichier de test suivant un modèle existant, ces tâches consomment des milliers de tokens sans nécessiter de raisonnement complexe. Utiliser un modèle IA de pointe pour ces tâches revient à utiliser un marteau-pilon pour écraser une mouche.
Les Modes AiKA dans Portal
Portal de Spotify a introduit AiKA Modes, une solution innovante qui permet de gérer ces tâches de manière plus économique. Un mode est un agent déclaratif qui fonctionne sur un runtime éphémère, semblable à AWS Lambda, mais pour les agents. Tu définis les instructions, choisis un modèle, configures des paramètres comme la température, et attaches des outils MCP. Portal s'occupe du reste.
Mode 1 : bulk-reader
Le mode bulk-reader est conçu pour les situations où Claude devrait normalement lire plusieurs fichiers volumineux juste pour répondre à une question. En utilisant Gemini 2.5 Flash comme modèle de travail, ce mode agit comme un lecteur de fichiers en masse pour l'analyse de code.
- Nom: bulk-reader
- Description: Lecteur de fichiers en masse pour l'analyse de code - délègue l'I/O des instructions Claude Code.
- Instructions: Tu es un analyste de code précis. Lis les fichiers fournis et réponds à la question de manière concise.
Mode 2 : code-writer
Le mode code-writer est idéal pour les tests, la création de configurations, les stubs de types ou toute autre tâche où la sortie est prévisible à partir de modèles existants.
- Nom: code-writer
- Description: Générateur de code boilerplate - délègue le travail lourd en sortie des instructions Claude Code.
- Instructions: Tu génères des fichiers de code basés sur une spécification et des fichiers de référence.
Impact significatif sur les coûts
Grâce à ces deux modes, l'utilisation des tokens Claude Code a été réduite à seulement 10% de l'utilisation précédente. Cela signifie non seulement des économies significatives en termes de coûts, mais aussi une optimisation des ressources IA pour des tâches plus complexes nécessitant un raisonnement approfondi.
Conclusion
Portal de Spotify a démontré qu'il est possible de gérer efficacement l'utilisation des tokens IA, réduisant ainsi les coûts sans compromettre la qualité du travail. Pour les entreprises technologiques cherchant à optimiser leurs dépenses en IA, l'adoption de solutions similaires pourrait être un levier considérable.
Discutons de ton projet en 15 minutes.