Introduction
Dans le monde effréné de l'intelligence artificielle, où chaque avancée promet de transformer notre quotidien, une tendance surprenante émerge : les modèles d'IA deviennent délibérément « moins intelligents ». Mais que signifie réellement cette approche, et pourquoi les chercheurs choisissent-ils de privilégier le raisonnement au détriment de la connaissance factuelle ?
La montée du raisonnement efficace
Les scores de raisonnement continuent de grimper alors que le calcul par token diminue. Par exemple, le modèle GLM-5.2 a atteint un score de 99,2% sur l'AIME 2026 avec environ 40 milliards de paramètres actifs par token. À titre de comparaison, le modèle GPT-4, avec ses 280 milliards de paramètres actifs, peinait à résoudre un problème AIME en 2023. Cette augmentation de l'efficacité du raisonnement par paramètre montre que les modèles deviennent plus intelligents selon ces critères spécifiques.
La connaissance factuelle : un coût élevé
Cependant, cette intelligence accrue a un coût. Les modèles de petite taille, comme le Qwen3.5 avec ses 9 milliards de paramètres, ne parviennent pas à exceller dans les tâches de rappel factuel. Sur le benchmark SimpleQA, qui mesure la capacité à rappeler des faits sans outils, le meilleur modèle, Gemini 2.5 Pro, plafonne à 53% de réussite. Cela indique que même les meilleurs modèles peuvent échouer à rappeler la moitié des informations factuelles.
Un échange délibéré
Les laboratoires choisissent délibérément d'échanger la connaissance factuelle contre des compétences de raisonnement. Pourquoi ? Parce que les faits nécessitent beaucoup d'espace. Des recherches montrent qu'il faut environ deux bits de connaissance factuelle par paramètre. Ainsi, pour qu'un modèle connaisse des détails triviaux, une masse considérable de poids est nécessaire, ce qui explique pourquoi les modèles les plus avancés ont atteint des milliards de paramètres.
Compression du raisonnement
Le raisonnement est beaucoup plus compressible que la connaissance factuelle. C'est un ensemble restreint de procédures appliquées de manière répétée : décomposer le problème, suivre l'état intermédiaire, vérifier son travail, et revenir en arrière si nécessaire. Des techniques comme la distillation et l'apprentissage par renforcement sur des tâches vérifiables permettent de transférer ces compétences dans des modèles plus petits de manière remarquable.
Le modèle généraliste
Les modèles actuels se transforment en généralistes : ils savent un peu sur presque tout, mais presque rien en profondeur. Par exemple, un modèle pourrait comprendre ce qu'est PostgreSQL et ses avantages, mais sera incapable de fournir des détails spécifiques ou techniques en profondeur.
Implications pour l'avenir
Cette transition vers des modèles plus petits et plus efficaces en termes de raisonnement représente une opportunité pour les entreprises technologiques. Ces modèles peuvent être intégrés dans des systèmes nécessitant une adaptation rapide et un apprentissage continu avec des ressources limitées. Cependant, pour des tâches nécessitant une connaissance experte, l'approche actuelle pourrait poser problème.
Conclusion
La tendance à rendre les modèles d'IA « moins intelligents » au niveau factuel, tout en améliorant leur capacité de raisonnement, pourrait bien redéfinir le développement et l'application des technologies intelligentes. Pour les entreprises et les développeurs, comprendre cette dynamique est essentiel pour capitaliser sur les nouvelles opportunités technologiques.
Discutons de ton projet en 15 minutes.