[{"data":1,"prerenderedAt":273},["ShallowReactive",2],{"\u002Fblog\u002Fmodel-harness-decoupling\u002F:pt":3,"\u002Fblog\u002Fmodel-harness-decoupling\u002F-surround:pt":169,"blog-all-posts:pt":170},{"id":4,"title":5,"author":6,"body":10,"date":151,"description":152,"extension":153,"image":154,"locale":155,"meta":156,"minRead":157,"navigation":158,"original":159,"path":160,"pinned":159,"seo":161,"source":162,"sourceUrl":23,"stem":163,"tags":164,"updated":154,"__hash__":168},"blog\u002Fblog\u002Fmodel-harness-decoupling.pt.md","O Harness first-party nem sempre é a resposta: na era dos modelos abertos, escolha o modelo e o Harness separadamente",{"name":7,"avatar":8},"Chen Dahuang",{"src":9,"alt":7},"\u002Favatar.jpg",{"type":11,"value":12,"toc":142},"minimark",[13,28,31,34,39,42,45,49,52,55,71,74,78,81,84,92,96,99,105,111,117,123,129,133,136],[14,15,16],"blockquote",{},[17,18,19,20,27],"p",{},"O argumento central foi publicado primeiro no ",[21,22,26],"a",{"href":23,"rel":24},"https:\u002F\u002Fx.com\u002Frealchendahuang\u002Fstatus\u002F2093890559874388141",[25],"nofollow","X","; este artigo é a versão completa, com um mapa de posicionamento dos cinco Harness.",[17,29,30],{},"A primeira reação da maioria das pessoas ao escolher um Coding Agent é super natural: Claude → Claude Code; GPT → Codex; GLM → ZCode; DeepSeek → obviamente, o próprio Harness da DeepSeek primeiro.",[17,32,33],{},"E o instinto é totalmente sensato. A maior vantagem do first-party é conhecer o próprio modelo melhor que ninguém.",[35,36,38],"h2",{"id":37},"a-vantagem-first-party-é-real","A vantagem first-party é real",[17,40,41],{},"Que Prompts o modelo gosta, qual design de Tool Schema é mais estável, como organizar um Context longo, quais capacidades cada versão nova traz, onde ele mais tropeça — o first-party geralmente fica sabendo de tudo isso antes dos terceiros.",[17,43,44],{},"Então, em produtos como Claude Code e Codex, em que modelo e Harness iteram juntos no longo prazo, a combinação first-party costuma ser a versão mais forte da resposta. Nisso eu não discuto.",[35,46,48],{"id":47},"mas-treinar-um-modelo-e-construir-um-harness-são-duas-engenharias-completamente-diferentes","Mas treinar um modelo e construir um Harness são duas engenharias completamente diferentes",[17,50,51],{},"Quando chegamos em modelos abertos como DeepSeek e GLM, a coisa fica interessante — porque treinar um bom modelo e construir um bom Harness são dois tipos de engenharia totalmente diferentes.",[17,53,54],{},"Quando um Coding Agent realmente entra em operação, surge um monte de problemas fora do modelo:",[56,57,58,62,65,68],"ul",{},[59,60,61],"li",{},"Como ler arquivos, como editar código",[59,63,64],{},"Como controlar o Agent Loop, como comprimir o Context",[59,66,67],{},"Como aproveitar o Cache, como recuperar um Tool Call que falhou",[59,69,70],{},"Como escalonar Subagents, como gerenciar permissões",[17,72,73],{},"A qualidade desses pontos decide diretamente se o mesmo modelo vai ser bom de usar no final. O mesmo modelo em outro Harness pode ser uma experiência do dia e da noite.",[35,75,77],{"id":76},"o-problema-maior-os-modelos-atualizam-rápido-demais","O problema maior: os modelos atualizam rápido demais",[17,79,80],{},"Hoje a GLM está na frente, mês que vem a DeepSeek talvez lance um Flash ainda mais forte, e um tempo depois outro modelo novo alcança todo mundo.",[17,82,83],{},"Se o seu workflow de codagem inteiro estiver preso ao produto first-party de uma única casa, trocar de modelo quase sempre significa trocar também de ferramentas e de hábitos. Meses de configuração, memória e workflow lapidados vão pro chão.",[17,85,86,87,91],{},"É exatamente aí que os Harness de terceiros ganham o lugar deles: ",[88,89,90],"strong",{},"você pode fixar as ferramentas, Skills, MCP, permissões e workflows que já domina, e trocar só o modelo lá embaixo."," Hoje DeepSeek, amanhã GLM, depois de amanhã outra coisa — o ambiente de trabalho não precisa ser reconstruído do zero.",[35,93,95],{"id":94},"um-mapa-de-posicionamento-dos-cinco-harness","Um mapa de posicionamento dos cinco Harness",[17,97,98],{},"Onde os cinco grandes estão parados, pela minha experiência até o fim de agosto de 2026:",[17,100,101,104],{},[88,102,103],{},"Pi",": filosofia minimalista; o Harness interfere o mínimo possível no modelo. Leve, rápido, baixo consumo de Token, moldável ao extremo. Ideal como fundação para o seu agente de longo prazo — simples, limpo, hackeável à vontade.",[17,106,107,110],{},[88,108,109],{},"OMP",": vai empilhando sobre Pi capacidades pesadas de codagem — LSP, Debugger, Browser, AST — como vestir o agente com um IDE completo. Para quem codifica pesado de verdade e navega repos complexos.",[17,112,113,116],{},[88,114,115],{},"DeepSeek Harness",": vai mais longe que todo mundo — Everything is Plugin. Agent Loop, ferramentas, permissões, Presets e UI se desmontam e se recombinam. Para quem mexe com arquitetura de agentes, Presets, multi-agente e Runtime de nova geração. Experimente mais o modo PTC — mais rápido e economiza mais token.",[17,118,119,122],{},[88,120,121],{},"OpenCode",": o mais equilibrado do grupo — open source, muitos Provider, ecossistema grande, Client\u002FServer, app desktop e Subagents maduros. Para quem quer um Coding Agent multi-modelo, generalista e maduro.",[17,124,125,128],{},[88,126,127],{},"Command Code",": uma rota completamente diferente — ele adora cobrir as lacunas do modelo. Argumentos de Tool Call escritos errado são corrigidos localmente; leitura duplicada de arquivos é deduplicada; sessões longas mantêm um Stable Prefix para subir o Cache Hit; quando o Context está prestes a estourar, faz Compaction. Colocada em modelos de braço como DeepSeek V4 Flash ou GLM-5.3 Flash, essa abordagem vale ouro: quanto mais fraco o modelo, mais o Harness cobre.",[35,130,132],{"id":131},"como-eu-escolho","Como eu escolho",[17,134,135],{},"Se eu só olhar a moldabilidade de longo prazo, sigo preferindo o Pi. Mas se hoje me pedissem para colocar DeepSeek V4 Flash ou GLM-5.3 pra trabalhar pesado, eu daria uma chance de verdade ao Command Code — a combinação modelo-Harness é montada por tarefa, não por campo.",[17,137,138,139],{},"Na era dos modelos abertos, modelo e Harness já são escolhas totalmente separáveis. ",[88,140,141],{},"Pare de perguntar \"o modelo de quem com a ferramenta de quem\" e comece a perguntar \"em qual Harness esse modelo rende mais\".",{"title":143,"searchDepth":144,"depth":144,"links":145},"",2,[146,147,148,149,150],{"id":37,"depth":144,"text":38},{"id":47,"depth":144,"text":48},{"id":76,"depth":144,"text":77},{"id":94,"depth":144,"text":95},{"id":131,"depth":144,"text":132},"2026-09-09","Usa Claude, vai de Claude Code? Na era dos modelos abertos, esse instinto pede um upgrade. A vantagem first-party é real, mas treinar um bom modelo e construir um bom Harness são duas engenharias diferentes — este artigo explica por que modelo e Harness já podem ser escolhidos separadamente, com um mapa de posicionamento de cinco Harness.","md",null,"pt",{},8,true,false,"\u002Fblog\u002Fmodel-harness-decoupling",{"title":5,"description":152},"x","blog\u002Fmodel-harness-decoupling.pt",[165,166,167],"AI Agent","Harness","Escolha de ferramenta","REEjoXHeAXujxs3o8X4-MQdUm3gVSuWf_-Qj1HQOeiM",[154,154],[171,178,187,196,203,210,212,219,227,233,240,249,256,264],{"path":172,"title":173,"description":174,"date":175,"minRead":176,"tags":177},"\u002Fblog\u002Fagent-harness-selection","Testei Pi Agent, OMP, Codex, ZCode — no fim escolhi OpenCode + OpenChamber","Retrospectiva da escolha de Agent Harness: critérios de experiência GUI, vendor lock-in e liberdade de customização que eliminaram Pi Agent, OMP, Codex e ZCode, para no fim escolher o núcleo OpenCode + a interface OpenChamber.","2026-08-06",6,[165,167],{"path":179,"title":180,"description":181,"date":182,"minRead":176,"tags":183},"\u002Fblog\u002Fcloudflare-broke-stack","Melhores práticas de dev independente em 2026: o combo \"pobretão\" da Cloudflare","Stack de custo zero para devs independentes: Codex escreve código, GitHub cuida da versão, Stripe recebe o dinheiro; front em TanStack Start, backend com Hono + Workers, banco D1, storage R2, cache KV — tudo rodando na Cloudflare.","2026-06-15",[184,185,186],"Cloudflare","Desenvolvimento independente","Stack tecnológica",{"path":188,"title":189,"description":190,"date":191,"minRead":176,"tags":192},"\u002Fblog\u002Fdeepseek-api-web-search","Busca na web embutida na API do DeepSeek — Responses API de graça com busca oficial","O DeepSeek embutiu busca na web na API oficial: é só chamar o deepseek-v4-flash pelo endpoint Responses declarando a ferramenta web_search, sem integrar buscador de terceiros e sem pedir chave de busca.","2026-08-05",[193,194,195],"DeepSeek","API","Ferramenta de IA",{"path":197,"title":198,"description":199,"date":191,"minRead":200,"tags":201},"\u002Fblog\u002Fdeepseek-v4-flash-review","DeepSeek V4 Flash oficial — experiência aprofundada: barato, rápido, 1M de contexto, busca embutida","Dias de uso intenso do DeepSeek V4 Flash oficial: barato ao extremo, rápido que dá gosto, 1M de contexto, busca na web oficial embutida e totalmente open source. O único senão é multimodal — mas dá para cobrir combinando com outros modelos.",7,[193,202,195],"Review de modelo",{"path":204,"title":205,"description":206,"date":182,"minRead":157,"tags":207},"\u002Fblog\u002Ffree-cloudflare","Como usuário gratuito, como espremer a Cloudflare até a última gota — até onde o free tier realmente grátis?","O plano gratuito da Cloudflare sustenta a infraestrutura pessoal inteira: DNS, CDN, Pages, Workers, KV, D1, R2, email, Tunnel, AI Gateway e mais.",[184,208,209],"Franquia grátis","Deploy",{"path":160,"title":5,"description":152,"date":151,"minRead":157,"tags":211},[165,166,167],{"path":213,"title":214,"description":215,"date":151,"minRead":157,"tags":216},"\u002Fblog\u002Fopencode-productive-stack","Estável, rápido, produtivo, barato: meu stack de AI Coding documentado","OpenCode + OpenChamber + duas assinaturas DeepSeek V4 Flash: 15 projetos rodando código ao mesmo tempo e a cota mal se mexeu. Toda a configuração aberta aqui — poda de Context, memória em camadas, automação de desktop e a lição de 'ficar com a combinação original'.",[121,217,218],"Programação IA","Configuração",{"path":220,"title":221,"description":222,"date":223,"minRead":224,"tags":225},"\u002Fblog\u002Fproduct-faxin-principle","O princípio do \"fa'xin\": por que o dev independente precisa aprender a abrir mão","Por que você começa? Para quem você começa? Qual problema você realmente quer resolver? A capacidade de um produto ser afiado vem de saber o que largar e o que abandonar.","2026-06-20",10,[226,185],"Pensamento de produto",{"path":228,"title":229,"description":230,"date":223,"minRead":157,"tags":231},"\u002Fblog\u002Fproduct-pain-vs-itch","Usuário diz \"caralho, que foda\" e você se empolga: dor vs. coceira","Aprovação verbal não vale nada. Para julgar necessidade existe só um critério duro: ver o que o usuário está disposto a pagar.",[226,232],"Julgamento de necessidade",{"path":234,"title":235,"description":236,"date":175,"minRead":237,"tags":238},"\u002Fblog\u002Fqwen-vision-for-deepseek","Dando multimodal ao DeepSeek: solução de visão com Qwen-3.7-Flash","O DeepSeek V4 Flash não tem multimodal. E ler imagem, como fica? Na minha pesquisa, a opção com melhor custo-benefício hoje é o Qwen-3.7-Flash: reconhecer uma imagem custa quase nada e, combinado com o V4 Flash, cobre a lacuna.",5,[193,239,202],"Multimodal",{"path":241,"title":242,"description":243,"date":244,"minRead":245,"tags":246},"\u002Fblog\u002Fsub-store-cloudflare","Migrei a agregação de assinaturas de proxy para a Cloudflare","Vários serviços de proxy mais os seus próprios nós fundidos em uma única assinatura, com as regras de roteamento configuradas no servidor — o cliente só assina.","2026-06-28",4,[184,247,248],"Contorno da rede","Projeto open source",{"path":250,"title":251,"description":252,"date":151,"minRead":200,"tags":253},"\u002Fblog\u002Ftui-cognitive-bandwidth","A TUI está matando sua banda cognitiva: está na hora de quebrar o “filtro geek” do AI Coding","Um bando de AI Coding Agents disputando quem sobe TUI primeiro, empurrando a interação de volta ao paradigma de terminal dos anos 80 e ainda chamando isso de “imersivo” e “respeita o programador”. Este artigo disseca os três mecanismos pelos quais a TUI reduz sistematicamente sua banda cognitiva — e por que o Web UI é a resposta certa.",[217,254,255],"Design de interação","Ensaio",{"path":257,"title":258,"description":259,"date":260,"minRead":176,"tags":261},"\u002Fblog\u002Fvalue-not-external","Discutir se algo tem valor é, em si, algo sem valor","Nosso valor não é definido por ninguém. Na era da IA, como a pessoa deve se entender, afinal?","2026-06-18",[262,263],"Reflexão sobre IA","Ensaio humano",{"path":265,"title":266,"description":267,"date":268,"minRead":269,"tags":270},"\u002Fblog\u002Fx-growth-1000-followers","Mais de 1000 seguidores em pouco mais de um dia — o que eu fiz","Em junho, comecei a levar o X a sério e ganhei 1000+ seguidores em pouco mais de um dia. Este post registra o que eu fiz na ocasião e os retornos que recebi.","2026-06-16",12,[271,272],"Operação no X","Crescimento de conteúdo",1789752315157]