Agentes de IA já conseguem ler um projeto, planejar mudanças, editar vários arquivos, executar comandos, testar e corrigir o próprio trabalho. Eles não são desenvolvedores infalíveis: são sistemas com acesso ao computador, ao código e, às vezes, à internet. O ganho vem do loop de execução; o risco vem das permissões.
Codex, Claude Code, Cursor, recursos de agentes do VS Code, OpenCode, Hermes Agent e OpenClaw ocupam partes diferentes desse mercado. Este comparativo de agentes de IA para programação mostra o que muda entre modelo, agente, IDE e assistente pessoal.
Para observar como promessas de programação devem ser verificadas, veja também a análise do ChamadoTI sobre o Ornith 1.0 para código.
Neste artigo
Agentes de IA em resumo
| Ferramenta | Categoria | Uso principal |
|---|---|---|
| Codex | Agente de programação | Desenvolver, revisar, testar e automatizar em app, CLI, IDE e nuvem |
| Claude Code | Agente de programação | Trabalho em repositórios, terminal, ferramentas e workflows |
| Cursor | IDE centrada em IA | Autocomplete, edição, agente local e agentes remotos |
| VS Code | Editor/IDE extensível | Agentes locais, CLI, nuvem e terceiros com governança |
| OpenCode | Agente de código open source | Terminal, desktop ou extensão com múltiplos provedores |
| Hermes Agent | Agente geral open source | Terminal, memória, ferramentas e criação de skills |
| OpenClaw | Assistente pessoal autohospedado | Mensagens, automações, serviços e tarefas gerais persistentes |
Modelo, agente e IDE não são a mesma coisa
O modelo produz raciocínio, texto e chamadas de ferramentas. O agente administra o ciclo de trabalho, contexto, ferramentas, estado e permissões. A IDE é o ambiente onde pessoas editam, depuram, testam e revisam software.
Cursor e VS Code são ambientes de desenvolvimento. Codex, Claude Code e OpenCode são agentes que podem trabalhar em interfaces diferentes. Hermes e OpenClaw são agentes mais gerais, embora possam programar quando recebem ferramentas adequadas. A qualidade final depende do conjunto, não apenas do nome do LLM escolhido.
Como funciona o loop de um agente de código
- Entender: lê pedido, instruções do projeto e arquivos relevantes.
- Planejar: divide o objetivo em alterações e verificações.
- Agir: pesquisa, edita arquivos ou executa ferramentas.
- Observar: interpreta saída do terminal, testes, navegador ou API.
- Corrigir: muda a abordagem quando encontra falha.
- Concluir: compara o resultado com a spec e entrega o diff para revisão.
Ferramentas ampliam o agente. Sem elas, o LLM só sugere código em texto. Com acesso ao sistema, pode ler arquivos, aplicar alterações e rodar comandos. Por isso, testes passando não bastam: o teste pode ser incompleto, a implementação pode introduzir vulnerabilidade e o agente pode ter alterado algo fora do escopo.
Spec, plan, rules, skills e AGENTS.md
Uma spec descreve o que deve existir ao final e como provar que está correto. O plan é o caminho proposto. Rules ou instructions são normas persistentes. Uma skill empacota um procedimento reutilizável. O arquivo AGENTS.md fornece orientação do repositório para agentes compatíveis.
Exemplo de spec útil: “Adicionar exportação CSV apenas para administradores; preservar filtros; mascarar CPF; registrar auditoria; não alterar banco; incluir testes de permissão e arquivo acima de 100 mil linhas”. Isso reduz decisões implícitas e cria critérios que pessoas e agentes conseguem verificar.
OpenCode pode gerar um AGENTS.md ao inicializar um projeto. O Cursor CLI também lê AGENTS.md e CLAUDE.md, além de regras próprias. O Codex usa AGENTS.md como instrução persistente e permite skills com documentação e scripts. O nome do arquivo é menos importante que manter as regras versionadas e revisadas pela equipe.
O que muda entre as principais ferramentas
Codex
O Codex é o agente de programação da OpenAI e aparece em aplicativo, CLI, extensão de IDE, nuvem e SDK. Trabalha com contexto do repositório, comandos, revisão de diferenças, worktrees, skills, MCP e agentes especializados. Sandboxing e políticas de aprovação limitam arquivos, rede e comandos.
Claude Code
Claude Code é o agente da Anthropic voltado a desenvolvimento e terminal. Pode trabalhar com instruções do projeto, ferramentas e integrações, além de aparecer como agente de terceiros em ambientes como VS Code. Empresas devem separar o desempenho do modelo Claude das permissões concedidas ao runtime do agente.
Cursor
Cursor combina edição, autocomplete, chat e modo Agent em uma IDE. O modo Ask é indicado para exploração sem mudanças; Agent pode editar múltiplos arquivos e rodar comandos. Background Agents trabalham em máquinas remotas isoladas, clonam repositórios e operam em branches separadas.
A documentação alerta que agentes de fundo têm internet e executam comandos automaticamente, o que cria risco de exfiltração por prompt injection. Privacidade, acesso GitHub, segredos do ambiente e retenção precisam ser definidos antes do uso.
VS Code
O VS Code se tornou um host para agentes locais, em segundo plano, na nuvem e de terceiros, incluindo soluções da Anthropic e OpenAI. A organização pode controlar modelos, ferramentas e servidores MCP. Skills, custom agents, instructions e hooks personalizam o comportamento.
Um hook é especialmente útil para controles determinísticos: executar formatador após edição, impedir comandos proibidos ou checar segredos antes de concluir. Ele não depende de o modelo “lembrar” da regra.
OpenCode
OpenCode é um agente open source disponível no terminal, desktop e extensão de IDE. Permite conectar diferentes provedores e configurar agentes especializados com prompts, modelos e ferramentas. Os agentes primários Build e Plan separam execução e análise; subagentes podem cuidar de tarefas focadas.
Hermes Agent
Hermes Agent, da Nous Research, é um agente open source executado no terminal, com memória persistente e capacidade de criar skills reutilizáveis. Ele pode usar modelos oferecidos pelo OpenRouter. Não deve ser confundido com os modelos Hermes da mesma organização.
OpenClaw
OpenClaw é um assistente pessoal autohospedado que se conecta a canais como Slack, Telegram, WhatsApp e outros serviços. Pode ler e escrever arquivos, executar scripts e acionar APIs. Seu foco é mais amplo que programação: funciona como uma camada persistente de automação pessoal.
Esse alcance exige cautela extrema no ambiente corporativo. Um agente persistente ligado a e-mail, mensagens, arquivos, senhas e terminal concentra privilégios. A implantação deve usar conta dedicada, mínimo acesso, isolamento, allowlists, revisão de skills e nenhuma credencial administrativa.
Work, workflow e worktree: três coisas diferentes
- Work: pode ser apenas “trabalho” ou um modo de produto para tarefas longas.
- Workflow: a sequência de trabalho, decisões e sistemas.
- Worktree: no Git, uma segunda cópia de trabalho do mesmo repositório, útil para isolar mudanças paralelas.
Worktrees reduzem conflitos com alterações locais, mas não são uma barreira de segurança completa. O agente ainda pode receber rede, segredos e permissões amplas. Isolamento de código e isolamento de credenciais são controles diferentes.
O que agentes de programação não podem garantir
- Compreender todos os requisitos não documentados.
- Detectar toda vulnerabilidade ou regressão.
- Escolher corretamente uma dependência que não conhece ou inventou.
- Preservar compatibilidade sem testes representativos.
- Interpretar “pronto” como a equipe interpreta sem critérios de aceitação.
- Proteger segredos se o ambiente os expõe e uma entrada maliciosa influencia o agente.
- Assumir responsabilidade pela mudança publicada.
Política segura para agentes no desenvolvimento
- Comece com modo de planejamento ou somente leitura.
- Use branch ou worktree isolada e proteja a branch principal.
- Negue arquivos de segredo e variáveis desnecessárias.
- Restrinja rede por domínio e prefira registros de dependência aprovados.
- Exija aprovação para instalar pacotes, alterar infraestrutura e acessar produção.
- Rode testes, lint, análise de segurança e revisão humana.
- Não permita merge ou deploy automático no primeiro estágio.
- Registre prompt, ferramentas, diff, aprovador e resultado da validação.
Perguntas frequentes
Cursor é um modelo de IA?
Não. Cursor é uma IDE com recursos de IA e acesso a diferentes modelos. Seu Agent é a camada que executa tarefas.
OpenCode é igual ao VS Code?
Não. OpenCode é um agente open source; VS Code é um editor que hospeda agentes e extensões.
Agente pode publicar diretamente em produção?
Tecnicamente pode, se receber acesso. Para a maioria das empresas, produção deve exigir pipeline, verificações e aprovação de uma pessoa autorizada.
Fontes e metodologia
Recursos verificados em 19 de julho de 2026. Ferramentas de agentes mudam rapidamente; confirme disponibilidade, planos e controles antes de padronizar.