[{"data":1,"prerenderedAt":273},["ShallowReactive",2],{"\u002Fblog\u002Fmodel-harness-decoupling\u002F:fr":3,"\u002Fblog\u002Fmodel-harness-decoupling\u002F-surround:fr":169,"blog-all-posts:fr":170},{"id":4,"title":5,"author":6,"body":10,"date":151,"description":152,"extension":153,"image":154,"locale":155,"meta":156,"minRead":157,"navigation":158,"original":159,"path":160,"pinned":159,"seo":161,"source":162,"sourceUrl":23,"stem":163,"tags":164,"updated":154,"__hash__":168},"blog\u002Fblog\u002Fmodel-harness-decoupling.fr.md","Le Harness first-party n'est pas forcément la réponse du moment : à l'ère des modèles ouverts, choisissez le modèle et le Harness séparément",{"name":7,"avatar":8},"Chen Dahuang",{"src":9,"alt":7},"\u002Favatar.jpg",{"type":11,"value":12,"toc":142},"minimark",[13,28,31,34,39,42,45,49,52,55,71,74,78,81,84,92,96,99,105,111,117,123,129,133,136],[14,15,16],"blockquote",{},[17,18,19,20,27],"p",{},"L'argument central est d'abord paru sur ",[21,22,26],"a",{"href":23,"rel":24},"https:\u002F\u002Fx.com\u002Frealchendahuang\u002Fstatus\u002F2093890559874388141",[25],"nofollow","X"," ; cet article en est la version complète, avec une carte de positionnement des cinq Harness.",[17,29,30],{},"La première réaction de la plupart des gens au moment de choisir un Coding Agent est tout ce qu'il y a de plus naturelle : Claude → Claude Code ; GPT → Codex ; GLM → ZCode ; DeepSeek → évidemment, d'abord le Harness maison de DeepSeek.",[17,32,33],{},"Et l'instinct est parfaitement sain. Le plus grand avantage du first-party, c'est de connaître son propre modèle mieux que personne.",[35,36,38],"h2",{"id":37},"lavantage-first-party-est-réel","L'avantage first-party est réel",[17,40,41],{},"Quels prompts aime le modèle, quelle conception du Tool Schema est la plus stable, comment organiser un Context long, quelles capacités apportent les nouvelles versions, où il trébuche le plus facilement — le first-party le sait généralement avant les tiers.",[17,43,44],{},"Alors pour des produits comme Claude Code et Codex, où modèle et Harness itèrent ensemble sur la durée, la combinaison first-party est souvent la meilleure réponse du moment. Là-dessus, je ne conteste rien.",[35,46,48],{"id":47},"mais-entraîner-un-modèle-et-construire-un-harness-sont-deux-ingénieries-complètement-différentes","Mais entraîner un modèle et construire un Harness sont deux ingénieries complètement différentes",[17,50,51],{},"Avec les modèles ouverts comme DeepSeek et GLM, ça devient intéressant — parce qu'entraîner un bon modèle et construire un bon Harness, ce sont deux ingénieries totalement différentes.",[17,53,54],{},"Une fois qu'un Coding Agent tourne réellement, apparaît une masse de problèmes hors-modèle :",[56,57,58,62,65,68],"ul",{},[59,60,61],"li",{},"Comment lire les fichiers, comment modifier le code",[59,63,64],{},"Comment contrôler l'Agent Loop, comment compresser le Context",[59,66,67],{},"Comment exploiter le Cache, comment récupérer après un Tool Call en échec",[59,69,70],{},"Comment ordonnancer les Subagents, comment gérer les permissions",[17,72,73],{},"La qualité de tout cela détermine directement si le même modèle se révèle bon à l'usage. Le même modèle dans un autre Harness, et l'expérience peut être le jour et la nuit.",[35,75,77],{"id":76},"le-problème-le-plus-grand-les-modèles-évoluent-trop-vite","Le problème le plus grand : les modèles évoluent trop vite",[17,79,80],{},"Aujourd'hui GLM domine, le mois prochain DeepSeek sort peut-être un Flash encore plus costaud, et un moment plus tard un nouveau modèle revient à la charge.",[17,82,83],{},"Si tout votre workflow de codage est lié au produit first-party d'un seul éditeur, changer de modèle signifie souvent changer d'outils et d'habitudes. Des mois de configs, de mémoires et de workflows peaufinés partent à la benne.",[17,85,86,87,91],{},"C'est exactement là que les Harness tiers gagnent leur existence : ",[88,89,90],"strong",{},"vous pouvez verrouiller les outils, Skills, MCP, permissions et workflows que vous maîtrisez, et ne remplacer que le modèle en dessous."," Aujourd'hui DeepSeek, demain GLM, après-demain autre chose — l'environnement de travail n'est pas à reconstruire.",[35,93,95],{"id":94},"une-carte-de-positionnement-des-cinq-harness","Une carte de positionnement des cinq Harness",[17,97,98],{},"Où en sont les cinq grands, d'après mon expérience à fin août 2026 :",[17,100,101,104],{},[88,102,103],{},"Pi"," : philosophie minimaliste ; le Harness interfère le moins possible avec le modèle. Léger, rapide, faible overhead de Token, malléable à l'extrême. Idéal comme fondation pour votre agent longue durée — simple, propre, hackable à volonté.",[17,106,107,110],{},[88,108,109],{},"OMP"," : empile sur Pi des capacités de codage lourdes — LSP, Debugger, Browser, AST — comme si on équipait l'agent d'un IDE complet. Pour du codage vraiment intensif et de la navigation complexe dans les repos.",[17,112,113,116],{},[88,114,115],{},"DeepSeek Harness"," : va le plus loin — Everything is Plugin. Agent Loop, outils, permissions, Presets et UI se démontent et se recombinent. Pour ceux qui bricolent l'architecture d'agents, les Presets, le multi-agent et les Runtime de nouvelle génération. Essayez plus souvent le mode PTC — plus rapide et plus économe en tokens.",[17,118,119,122],{},[88,120,121],{},"OpenCode"," : le plus équilibré du lot — open source, nombreux Provider, gros écosystème, Client\u002FServer, appli desktop et Subagents matures. Pour qui veut un Coding Agent multi-modèles, généraliste et éprouvé.",[17,124,125,128],{},[88,126,127],{},"Command Code"," : une route complètement différente — il adore couvrir le modèle. Les arguments de Tool Call erronés sont corrigés en local ; les lectures de fichiers en double sont dédupliquées ; les longues sessions gardent un Stable Prefix pour monter le Cache Hit ; quand le Context menace d'exploser, Compaction. Appliqué à des modèles de corvée comme DeepSeek V4 Flash ou GLM-5.3 Flash, ça vaut de l'or : plus le modèle est faible, plus le Harness compense.",[35,130,132],{"id":131},"ma-méthode-de-choix","Ma méthode de choix",[17,134,135],{},"Si je ne regarde que la malléabilité long terme, je préfère toujours Pi. Mais si on me demandait aujourd'hui de faire bosser sérieusement DeepSeek V4 Flash ou GLM-5.3, j'irais vraiment goûter Command Code — la combinaison modèle-Harness se règle par tâche, pas par camp.",[17,137,138,139],{},"À l'ère des modèles ouverts, modèle et Harness sont des choix désormais pleinement séparables. ",[88,140,141],{},"Arrêtez de demander « le modèle de qui avec l'outil de qui », demandez plutôt « dans quel Harness ce modèle travaille-t-il le mieux ».",{"title":143,"searchDepth":144,"depth":144,"links":145},"",2,[146,147,148,149,150],{"id":37,"depth":144,"text":38},{"id":47,"depth":144,"text":48},{"id":76,"depth":144,"text":77},{"id":94,"depth":144,"text":95},{"id":131,"depth":144,"text":132},"2026-09-09","Claude ? Donc Claude Code. À l'ère des modèles ouverts, cet instinct mérite une mise à jour. L'avantage first-party est réel, mais entraîner un bon modèle et construire un bon Harness sont deux ingénieries différentes — cet article explique pourquoi modèle et Harness peuvent désormais se choisir séparément, avec une carte de positionnement de cinq Harness.","md",null,"fr",{},8,true,false,"\u002Fblog\u002Fmodel-harness-decoupling",{"title":5,"description":152},"x","blog\u002Fmodel-harness-decoupling.fr",[165,166,167],"AI Agent","Harness","Choix d'outils","2Jb16HjthSPAa5L1ZZSgelXxeA-fSrweOZk6xS1VI-E",[154,154],[171,178,187,196,203,210,212,219,227,233,240,249,256,264],{"path":172,"title":173,"description":174,"date":175,"minRead":176,"tags":177},"\u002Fblog\u002Fagent-harness-selection","J'ai trifouillé Pi Agent, OMP, Codex et ZCode — voici pourquoi j'ai fini par choisir OpenCode + OpenChamber","Retour d'expérience sur le choix d'un Agent Harness : trois critères — expérience GUI, verrouillage fournisseur, liberté de développement — qui ont écarté Pi Agent, OMP, Codex et ZCode, pour atterrir sur le noyau OpenCode + l'interface OpenChamber.","2026-08-06",6,[165,167],{"path":179,"title":180,"description":181,"date":182,"minRead":176,"tags":183},"\u002Fblog\u002Fcloudflare-broke-stack","Meilleures pratiques 2026 de l'indie dev : le combo Cloudflare du radin","La stack zéro coût de l'indépendant : Codex écrit le code, GitHub gère les versions, Stripe encaisse ; front TanStack Start, back Hono + Workers, base D1, stockage R2, cache KV — tout tourne sur Cloudflare.","2026-06-15",[184,185,186],"Cloudflare","Développement indépendant","Stack technique",{"path":188,"title":189,"description":190,"date":191,"minRead":176,"tags":192},"\u002Fblog\u002Fdeepseek-api-web-search","DeepSeek intègre la recherche web dans son API — la recherche officielle à l'œil via Responses API","DeepSeek a intégré la recherche web directement dans son API : il suffit d'appeler deepseek-v4-flash via l'interface Responses et de déclarer l'outil web_search. Pas besoin de moteur tiers, pas besoin de clé de recherche.","2026-08-05",[193,194,195],"DeepSeek","API","Outil IA",{"path":197,"title":198,"description":199,"date":191,"minRead":200,"tags":201},"\u002Fblog\u002Fdeepseek-v4-flash-review","DeepSeek V4 Flash en profondeur : pas cher, rapide, 1M de contexte, recherche intégrée","Quelques jours de test intensif de DeepSeek V4 Flash : pas cher à l'extrême, rapide comme l'éclair, 1M de contexte, recherche web intégrée par défaut, totalement open source. Seul point faible : le multimodale, mais on le comble en l'associant à d'autres modèles.",7,[193,202,195],"Test de modèle",{"path":204,"title":205,"description":206,"date":182,"minRead":157,"tags":207},"\u002Fblog\u002Ffree-cloudflare","Comment presser Cloudflare comme un citron quand on est gratuit, jusqu'où va le plan gratuit ?","Le plan gratuit de Cloudflare peut supporter toute une infrastructure perso sur Internet : DNS, CDN, Pages, Workers, KV, D1, R2, email, Tunnel, AI Gateway, etc.",[184,208,209],"Quota gratuit","Déploiement",{"path":160,"title":5,"description":152,"date":151,"minRead":157,"tags":211},[165,166,167],{"path":213,"title":214,"description":215,"date":151,"minRead":157,"tags":216},"\u002Fblog\u002Fopencode-productive-stack","Stable, rapide, productif, pas cher : mon AI Coding stack complet, documenté","OpenCode + OpenChamber + deux abonnements DeepSeek V4 Flash : 15 projets compilent du code en même temps et le quota bouge à peine. Toute ma configuration dévoilée — élagage de Context, mémoire à étages, automatisation du bureau, et la leçon « rester avec la combinaison d'origine ».",[121,217,218],"Programmation IA","Configuration",{"path":220,"title":221,"description":222,"date":223,"minRead":224,"tags":225},"\u002Fblog\u002Fproduct-faxin-principle","Le principe de l'intention première : pourquoi l'indie dev doit savoir lâcher prise","Pourquoi tu pars ? Pour qui tu pars ? Quel problème tu veux vraiment résoudre ? La netteté d'un produit vient de ce qu'on accepte de perdre et d'abandonner.","2026-06-20",10,[226,185],"Pensée produit",{"path":228,"title":229,"description":230,"date":223,"minRead":157,"tags":231},"\u002Fblog\u002Fproduct-pain-vs-itch","Quand l'utilisateur dit « génial », ne monte pas sur ton nuage : douleur vs. démangeaison","L'approbation verbale ne vaut pas un clou. Pour juger un besoin, un seul critère dur : ce que l'utilisateur est prêt à débourser.",[226,232],"Jugement du besoin",{"path":234,"title":235,"description":236,"date":175,"minRead":237,"tags":238},"\u002Fblog\u002Fqwen-vision-for-deepseek","Apporter le multimodal à DeepSeek : la solution de lecture d'images Qwen-3.7-Flash","DeepSeek V4 Flash n'a pas de multimodal ; et pour lire les images ? Après comparaison, la solution au meilleur rapport qualité\u002Fprix est Qwen-3.7-Flash : coût de reconnaissance d'une image ultra bas, combinée à V4 Flash pour combler le manque.",5,[193,239,202],"Multimodal",{"path":241,"title":242,"description":243,"date":244,"minRead":245,"tags":246},"\u002Fblog\u002Fsub-store-cloudflare","J'ai déplacé mon agrégateur d'abonnements vers Cloudflare","Plusieurs fournisseurs plus des nœuds maison, le tout concassé dans un seul abonnement ; les règles de routage configurées côté serveur, et le client n'a plus qu'à s'abonner.","2026-06-28",4,[184,247,248],"Réseau","Projet open source",{"path":250,"title":251,"description":252,"date":151,"minRead":200,"tags":253},"\u002Fblog\u002Ftui-cognitive-bandwidth","Le TUI est en train de tuer votre bande passante cognitive : le « filtre geek » de l'AI Coding devrait se briser","Une flopée d'AI Coding Agents se précipitent pour sortir des TUI, refourbent l'interaction dans le paradigme terminal des années 80 et appellent ça « immersif » et « respectueux des développeurs ». Cet article démonte les trois mécanismes par lesquels le TUI réduit systématiquement la bande passante cognitive — et pourquoi le Web UI est la bonne réponse.",[217,254,255],"Design d'interaction","Essai",{"path":257,"title":258,"description":259,"date":260,"minRead":176,"tags":261},"\u002Fblog\u002Fvalue-not-external","Discuter de la valeur, c'est ça qui n'a aucune valeur","Notre valeur n'est définie par personne. À l'ère de l'IA, comment l'humain doit-il se comprendre lui-même ?","2026-06-18",[262,263],"Réflexion IA","Essai humaniste",{"path":265,"title":266,"description":267,"date":268,"minRead":269,"tags":270},"\u002Fblog\u002Fx-growth-1000-followers","Plus de 1000 followers en un jour et demi, voilà ce que j'ai fait","En juin, j'ai sérieusement animé mon compte X, et je suis passé à plus de 1000 followers en un jour et demi. Ce post raconte ce que j'ai fait et les retours que j'ai eus.","2026-06-16",12,[271,272],"Animation X","Croissance de contenu",1789752315590]