Terça-feira, 21 de julho

Explorando o universo da tecnologia: Notícias, IA, Segurança, Cinema, Games e Reviews para quem vive de TI e muito mais!

Pesquisar

Entrar / Cadastrar

Minha Conta

Entrar / Cadastrar

Minha Conta

Pesquisar
Agora
Inteligência Artificial

Agentes de IA já programam sozinhos — o perigo é deixá-los mandar

Codex, Claude Code, Cursor, VS Code, OpenCode, Hermes e OpenClaw: entenda o que cada agente faz, como funciona o loop e quais acessos limitar.

Leandro Santos Por Leandro Santos 7 min de leitura 3 visualizações
Engenheiro revisa agentes de IA trabalhando em ambientes de programação isolados

Agentes de IA já conseguem ler um projeto, planejar mudanças, editar vários arquivos, executar comandos, testar e corrigir o próprio trabalho. Eles não são desenvolvedores infalíveis: são sistemas com acesso ao computador, ao código e, às vezes, à internet. O ganho vem do loop de execução; o risco vem das permissões.

Codex, Claude Code, Cursor, recursos de agentes do VS Code, OpenCode, Hermes Agent e OpenClaw ocupam partes diferentes desse mercado. Este comparativo de agentes de IA para programação mostra o que muda entre modelo, agente, IDE e assistente pessoal.

Para observar como promessas de programação devem ser verificadas, veja também a análise do ChamadoTI sobre o Ornith 1.0 para código.

Agentes de IA em resumo

FerramentaCategoriaUso principal
CodexAgente de programaçãoDesenvolver, revisar, testar e automatizar em app, CLI, IDE e nuvem
Claude CodeAgente de programaçãoTrabalho em repositórios, terminal, ferramentas e workflows
CursorIDE centrada em IAAutocomplete, edição, agente local e agentes remotos
VS CodeEditor/IDE extensívelAgentes locais, CLI, nuvem e terceiros com governança
OpenCodeAgente de código open sourceTerminal, desktop ou extensão com múltiplos provedores
Hermes AgentAgente geral open sourceTerminal, memória, ferramentas e criação de skills
OpenClawAssistente pessoal autohospedadoMensagens, automações, serviços e tarefas gerais persistentes

Modelo, agente e IDE não são a mesma coisa

O modelo produz raciocínio, texto e chamadas de ferramentas. O agente administra o ciclo de trabalho, contexto, ferramentas, estado e permissões. A IDE é o ambiente onde pessoas editam, depuram, testam e revisam software.

Cursor e VS Code são ambientes de desenvolvimento. Codex, Claude Code e OpenCode são agentes que podem trabalhar em interfaces diferentes. Hermes e OpenClaw são agentes mais gerais, embora possam programar quando recebem ferramentas adequadas. A qualidade final depende do conjunto, não apenas do nome do LLM escolhido.

Como funciona o loop de um agente de código

  1. Entender: lê pedido, instruções do projeto e arquivos relevantes.
  2. Planejar: divide o objetivo em alterações e verificações.
  3. Agir: pesquisa, edita arquivos ou executa ferramentas.
  4. Observar: interpreta saída do terminal, testes, navegador ou API.
  5. Corrigir: muda a abordagem quando encontra falha.
  6. Concluir: compara o resultado com a spec e entrega o diff para revisão.

Ferramentas ampliam o agente. Sem elas, o LLM só sugere código em texto. Com acesso ao sistema, pode ler arquivos, aplicar alterações e rodar comandos. Por isso, testes passando não bastam: o teste pode ser incompleto, a implementação pode introduzir vulnerabilidade e o agente pode ter alterado algo fora do escopo.

Spec, plan, rules, skills e AGENTS.md

Uma spec descreve o que deve existir ao final e como provar que está correto. O plan é o caminho proposto. Rules ou instructions são normas persistentes. Uma skill empacota um procedimento reutilizável. O arquivo AGENTS.md fornece orientação do repositório para agentes compatíveis.

Exemplo de spec útil: “Adicionar exportação CSV apenas para administradores; preservar filtros; mascarar CPF; registrar auditoria; não alterar banco; incluir testes de permissão e arquivo acima de 100 mil linhas”. Isso reduz decisões implícitas e cria critérios que pessoas e agentes conseguem verificar.

OpenCode pode gerar um AGENTS.md ao inicializar um projeto. O Cursor CLI também lê AGENTS.md e CLAUDE.md, além de regras próprias. O Codex usa AGENTS.md como instrução persistente e permite skills com documentação e scripts. O nome do arquivo é menos importante que manter as regras versionadas e revisadas pela equipe.

O que muda entre as principais ferramentas

Codex

O Codex é o agente de programação da OpenAI e aparece em aplicativo, CLI, extensão de IDE, nuvem e SDK. Trabalha com contexto do repositório, comandos, revisão de diferenças, worktrees, skills, MCP e agentes especializados. Sandboxing e políticas de aprovação limitam arquivos, rede e comandos.

Claude Code

Claude Code é o agente da Anthropic voltado a desenvolvimento e terminal. Pode trabalhar com instruções do projeto, ferramentas e integrações, além de aparecer como agente de terceiros em ambientes como VS Code. Empresas devem separar o desempenho do modelo Claude das permissões concedidas ao runtime do agente.

Cursor

Cursor combina edição, autocomplete, chat e modo Agent em uma IDE. O modo Ask é indicado para exploração sem mudanças; Agent pode editar múltiplos arquivos e rodar comandos. Background Agents trabalham em máquinas remotas isoladas, clonam repositórios e operam em branches separadas.

A documentação alerta que agentes de fundo têm internet e executam comandos automaticamente, o que cria risco de exfiltração por prompt injection. Privacidade, acesso GitHub, segredos do ambiente e retenção precisam ser definidos antes do uso.

VS Code

O VS Code se tornou um host para agentes locais, em segundo plano, na nuvem e de terceiros, incluindo soluções da Anthropic e OpenAI. A organização pode controlar modelos, ferramentas e servidores MCP. Skills, custom agents, instructions e hooks personalizam o comportamento.

Um hook é especialmente útil para controles determinísticos: executar formatador após edição, impedir comandos proibidos ou checar segredos antes de concluir. Ele não depende de o modelo “lembrar” da regra.

OpenCode

OpenCode é um agente open source disponível no terminal, desktop e extensão de IDE. Permite conectar diferentes provedores e configurar agentes especializados com prompts, modelos e ferramentas. Os agentes primários Build e Plan separam execução e análise; subagentes podem cuidar de tarefas focadas.

Hermes Agent

Hermes Agent, da Nous Research, é um agente open source executado no terminal, com memória persistente e capacidade de criar skills reutilizáveis. Ele pode usar modelos oferecidos pelo OpenRouter. Não deve ser confundido com os modelos Hermes da mesma organização.

OpenClaw

OpenClaw é um assistente pessoal autohospedado que se conecta a canais como Slack, Telegram, WhatsApp e outros serviços. Pode ler e escrever arquivos, executar scripts e acionar APIs. Seu foco é mais amplo que programação: funciona como uma camada persistente de automação pessoal.

Esse alcance exige cautela extrema no ambiente corporativo. Um agente persistente ligado a e-mail, mensagens, arquivos, senhas e terminal concentra privilégios. A implantação deve usar conta dedicada, mínimo acesso, isolamento, allowlists, revisão de skills e nenhuma credencial administrativa.

Work, workflow e worktree: três coisas diferentes

  • Work: pode ser apenas “trabalho” ou um modo de produto para tarefas longas.
  • Workflow: a sequência de trabalho, decisões e sistemas.
  • Worktree: no Git, uma segunda cópia de trabalho do mesmo repositório, útil para isolar mudanças paralelas.

Worktrees reduzem conflitos com alterações locais, mas não são uma barreira de segurança completa. O agente ainda pode receber rede, segredos e permissões amplas. Isolamento de código e isolamento de credenciais são controles diferentes.

O que agentes de programação não podem garantir

  • Compreender todos os requisitos não documentados.
  • Detectar toda vulnerabilidade ou regressão.
  • Escolher corretamente uma dependência que não conhece ou inventou.
  • Preservar compatibilidade sem testes representativos.
  • Interpretar “pronto” como a equipe interpreta sem critérios de aceitação.
  • Proteger segredos se o ambiente os expõe e uma entrada maliciosa influencia o agente.
  • Assumir responsabilidade pela mudança publicada.

Política segura para agentes no desenvolvimento

  1. Comece com modo de planejamento ou somente leitura.
  2. Use branch ou worktree isolada e proteja a branch principal.
  3. Negue arquivos de segredo e variáveis desnecessárias.
  4. Restrinja rede por domínio e prefira registros de dependência aprovados.
  5. Exija aprovação para instalar pacotes, alterar infraestrutura e acessar produção.
  6. Rode testes, lint, análise de segurança e revisão humana.
  7. Não permita merge ou deploy automático no primeiro estágio.
  8. Registre prompt, ferramentas, diff, aprovador e resultado da validação.

Perguntas frequentes

Cursor é um modelo de IA?

Não. Cursor é uma IDE com recursos de IA e acesso a diferentes modelos. Seu Agent é a camada que executa tarefas.

OpenCode é igual ao VS Code?

Não. OpenCode é um agente open source; VS Code é um editor que hospeda agentes e extensões.

Agente pode publicar diretamente em produção?

Tecnicamente pode, se receber acesso. Para a maioria das empresas, produção deve exigir pipeline, verificações e aprovação de uma pessoa autorizada.

Fontes e metodologia

Recursos verificados em 19 de julho de 2026. Ferramentas de agentes mudam rapidamente; confirme disponibilidade, planos e controles antes de padronizar.

Gostou? Compartilhe

Generic selectors
Exact matches only
Search in title
Search in content
Post Type Selectors