Partager

Mode clair Mode sombre

Temps de lecture : 3 minutes

14 septembre 2026

Plus intelligentes, mais pas toujours plus malignes. Les IA locales peuvent résoudre des problèmes complexes, mais perdre beaucoup de temps et d'énergie sur des questions toutes simples. Le défi n'est plus de faire réfléchir les modèles… Mais de les empêcher de trop en faire.

Qwen 3.8 27B marque un progrès prometteur pour l'IA locale, notamment en programmation, mais son réglage par défaut pose un défi très concret : adapter son effort de raisonnement à la tâche. À l'image d'un génie à qui l'on poserait une question triviale, les modèles de la génération Qwen ont parfois tendance à sur-analyser si on ne les bride pas.

L'IA propose en effet quatre niveaux de réflexion avant de répondre (off, low, medium et xhigh) et c'est le plus gourmand des quatre, xhigh, qui s'applique par défaut. Le développeur et analyste d'IAs Simon Willison en a fait la drôle d'expérience. En demandant au modèle (réglé sur la réflexion maximale) de dessiner un simple pélican à vélo, l'IA a « réfléchi » pendant près de 21 minutes sur un ordinateur portable, générant 22 276 tokens de raisonnement (les fragments de textes comptabilisés par le modèle) avant de produire 3 223 tokens de réponse pour s'assurer que les pattes étaient bien sur les pédales ! Le résultat était magnifique, mais le temps d'attente absurde.