Mathieu Grenier Granite 4.1 passe l'épreuve du code Python — jusqu'où un SLM de 3 milliards peut aller Dans mon dernier article , je vous ai montré que l'allemand est la langue optimale pour granite4.1:3b — et que ce petit SLM de 3 milliards de paramètres peut atteindre 87/100 sur des raisonnements mat... 7 mai 2026
Mathieu Grenier IBM Granite 4.1 : l'effet de la langue, testé sur GPU local Hier soir, je suis rentré d'une conférence à Osaka. Un événement European Night avec des dizaines de chercheurs en IA et robotique — des profils solides, habitués à lire des papiers, à manipuler des m... 2 mai 2026
Mathieu Grenier qwen3:4b résout des problèmes GPQA Diamond — sans chaîne de pensée interne Hier, je vous parlais de mes tests sur le raisonnement de qwen3:4b en chinois. La conclusion principale : avec le bon cadrage dans la bonne langue, un modèle local de 4 milliards de paramètres rivalis... 28 avr. 2026
Mathieu Grenier qwen3:4b-instruct-2507 égale Claude Haiku 4.5 avec le bon prompt en chinois La semaine dernière, je vous expliquais comment la langue de votre prompt modifie structurellement le raisonnement de Claude. Le turc force le marquage épistémique. Le japonais impose une ontologie hi... 27 avr. 2026
Mathieu Grenier Japonais et IA : 5 concepts qui révèlent l'architecture cachée des LLM La langue du prompt change le raisonnement d'un LLM — pas à la marge, structurellement. En japonais, cinq structures conceptuelles émergent systématiquement dans les sessions d'analyse IA que j'ai doc... 23 avr. 2026
Mathieu Grenier La langue de votre prompt n'est pas neutre — ce que j'ai découvert en testant Claude en turc, japonais et hindi Ça fait une semaine que je lutte avec deux problèmes liés dans mon architecture IA. Le premier : maintenir un RAG qui pilote Claude Code sur mes projets. 176 fichiers agents, 1 117 skills indexés, un ... 22 avr. 2026
Mathieu Grenier Ce n'est pas Claude qui dérive — c'est l'ambiguité de vos documents On le voit de plus en plus. Un agent Claude qui ignore une consigne pourtant clairement écrite. Un skill qui ne fait pas ce qu'on lui demande. Une règle qui semble « oubliée » d'un run à l'autre. Le r... 14 avr. 2026
Mathieu Grenier J'ai arrêté d'évaluer mes modèles IA « au feeling » — voici ce que les chiffres m'ont appris Pendant des mois, j'ai fait confiance à mon instinct pour choisir mes modèles LLM locaux. Un modèle répondait vite ? Bon signe. Il donnait des réponses qui « paraissaient cohérentes » ? Encore mieux. ... 11 avr. 2026
Mathieu Grenier Gemma 4 ne rentrait pas dans mon GPU — jusqu'à ce que je supprime ce qu'il n'utilisait pas Hier, je vous présentais les modèles Gemma 4 de Google. Des modèles impressionnants, sortis le 3 avril 2026 sous licence Apache 2.0, avec un système de raisonnement intégré et une architecture multimo... 8 avr. 2026
Mathieu Grenier Gemma 4 e2b et e4b : ce que j'ai appris après des heures de benchmark sur des modèles locaux C'est la première fois que je passe autant d'heures à tester les limites d'un modèle local. Pas juste lancer quelques prompts et voir si ça répond — vraiment benchmarker : scripts automatisés, métriqu... 7 avr. 2026
Mathieu Grenier 920 appels LLM par jour à votre insu : l'architecture silencieuse qui mesure tout dans Claude Code Hier, mon assistant local IA a généré 920 appels de scoring qualité, traduit 590 prompts automatiquement, et consolidé 173 sessions d'agents éphémères. Rien de tout ça n'était visible dans mon termina... 5 avr. 2026
Mathieu Grenier 1 327 fichiers Markdown, 14 projets, zéro chaos : comment un registre centralisé a éliminé ma dette technique documentaire Imaginez un bureau. Au début, vous avez trois feuilles posées proprement. Une pour les règles du projet, une pour la config de l'agent, une pour les notes. Vous savez exactement où tout se trouve. Six... 3 avr. 2026