Agent Harness Kit, versão zero ponto cinco ponto dois.

O Agent Harness Kit é um scaffold instalável e independente de plataforma para organizar desenvolvimento de software com agentes de código. Ele oferece contexto durável, limites claros por tarefa, verificações focadas e uma forma confiável de continuar o trabalho sem varrer o repositório inteiro ou pedir aprovações cerimoniais a todo momento.

Você instala a ferramenta de linha de comando com U V e executa agent harness install dentro do projeto. O instalador adiciona o kit de forma contida e cria entradas seguras na raiz. O Codex entra por A G E N T S ponto markdown, o Claude Code por CLAUDE ponto markdown, e ambos seguem as mesmas regras e o mesmo estado neutro.

Em uma nova janela de contexto, em pedidos de retomada ou em pedidos de status, o agente deve ler primeiro o contexto aprovado, depois PENDING ponto M D e, por último, TASK GRAPH ponto M D. PENDING contém decisões e ações humanas e a visão macro das áreas ainda incompletas, como backend ou autenticação. TASK GRAPH contém ordem, dependências e execução técnica. Todo status deve mostrar etapa, progresso, bloqueios, próxima ação e caminhos inspecionáveis. Uma varredura mais ampla só pode acontecer quando esses artefatos revelarem uma lacuna concreta ou quando o usuário pedir uma auditoria.

Para controlar o custo sem reduzir a qualidade de forma silenciosa, as tarefas são roteadas por capacidade. Trabalho mecânico pode usar modelos econômicos, implementação normal usa modelos balanceados e modelos avançados ficam reservados para arquitetura, segurança, integração difícil ou falhas repetidas. A escolha do modelo nunca concede permissões adicionais.

Cada tarefa também recebe um orçamento executável. Tentativas, ciclos sem progresso e expansões de contexto têm limites que continuam valendo para o mesmo objetivo, mesmo quando muda o modelo, o agente, a tarefa ou a sessão. Ao atingir um teto, o agente registra evidências e replana, em vez de consumir tokens indefinidamente.

Ele serve tanto para projetos novos quanto para repositórios maduros que já têm contexto do Claude, instruções do Codex, agentes, regras e até um harness próprio. Nesses casos, não sobrescreve nada de imediato. Primeiro, faz um inventário e congela as autoridades existentes. Depois, instala por coexistência gradual em um espaço separado e pede revisão humana antes de qualquer remoção ou substituição. O README também aponta para o playbook e para os contratos de migração e coexistência.

O perfil recomendado, Core, cobre a entrega normal. Core Learning adiciona aprendizado opcional usando o projeto, e Full também inclui um pacote separado para estudar engenharia de harness. Instalar suporte de aprendizado nunca ativa observação nem cria notas automaticamente. Antes, o agente pergunta o caminho Markdown, a pasta do Obsidian, o alvo e o conector do Notion ou outro destino aprovado.

No primeiro uso, o agente apresenta o Kit e inicia uma descoberta curta antes de propor tecnologia ou implementação. A mensagem também informa que o usuário pode escolher entrega normal ou modo hackathon. No hackathon, a descoberta é comprimida, uma fatia completa e testável vem primeiro, a integração acontece cedo e o foco é chegar rapidamente a um M V P ou demo funcionando.

Depois da descoberta, o usuário aprova o contexto e as decisões importantes. O Kit registra ações humanas e pendências macro em PENDING, e ordem técnica e dependências em TASK GRAPH. Frontend, backend, dados, infraestrutura, integração e estudo podem usar contextos separados quando a plataforma permite. Cada tarefa ativa recebe contexto de código delimitado, lease exclusivo de arquivos e um revisor diferente do implementador.

Quando as verificações passam, a tarefa é concluída, o resultado é informado e a próxima tarefa pronta pode começar. A revisão independente funciona como garantia não bloqueante: uma review proporcional ao risco e, somente quando existir um bloqueio real, no máximo uma re-review focada na correção e nas regressões relacionadas. No hackathon, a review é leve por padrão. Nunca existe um terceiro loop.

O README agora começa pela instalação curta, escolha do modo, os três arquivos de estado, perfis e limites honestos. Os contratos detalhados continuam disponíveis por links para quem precisar se aprofundar.

Hoje, o Agent Harness Kit oferece uma interface de linha de comando instalável, contratos operacionais, papéis, templates, playbooks, roteamento por capacidade, execução limitada, validação e empacotamento. Ele é um scaffold seguido por agentes capazes, não um daemon em segundo plano. Ele não promete criar chats ou worktrees, integrar branches, fazer deploy ou publicar quando a plataforma não oferece e autoriza essas capacidades.

O projeto usa a licença MIT e está aberto à comunidade. Em resumo: instale o Kit, escolha entrega normal ou hackathon, aprove o contexto uma vez e deixe o agente trabalhar com estado durável até um resultado testável.
