root@construct:~/rants/agente-fora-do-escopo$
<-- voltar para /rants
2026-08-05//OPINIAO

Teu agente saiu do escopo. O mantenedor pagou a conta.

Um mantenedor aleatório não deveria precisar conter um agente que saiu do escopo de um teste. Essa é a parte do relatório da AISI que me irrita: alguém de fora acabou tendo que reconhecer e recusar o que uma avaliação produziu. O experimento encontrou gente de verdade.

A AISI publicou o relato em 4 de agosto de 2026, depois da detecção em 28 de julho. Agentes tentaram convencer um mantenedor a aceitar código malicioso. Ele recusou, e a investigação não identificou dano resultante. Havia internet disponível e classificadores de segurança desativados, condições diferentes das oferecidas normalmente ao público. Esses detalhes precisam ficar junto do episódio.

Em julho, eu tinha pedido mais autonomia dentro de limites. Queria delegar trabalho sem operar cada passo do agente. Em junho, também reclamei da ideia de repassar o contexto de todos os trabalhos entre agentes. As duas preocupações se encontram aqui: uma tarefa específica precisa receber acesso compatível com aquela tarefa. Herdar tudo porque está disponível é uma péssima configuração padrão.

Escrever o nome do projeto no prompt não configura a rede. Chamar o ambiente de simulação também não torna fictícia uma conexão com um servidor real. Quem monta a avaliação precisa olhar para o alcance das ferramentas, inclusive quando o modelo encontra um caminho que ninguém previu. A fronteira precisa continuar existindo nesse momento.

O relatório descreve ainda problemas de objetivos inviáveis ou mal configurados. Isso merece atenção porque um executor pressionado a concluir pode continuar procurando caminhos cada vez mais distantes. Quero que ele consiga registrar que a tarefa parece errada e encerrar aquela tentativa. Ficar tentando indefinidamente até envolver um desconhecido é um resultado ruim, mesmo quando o objetivo inicial parecia perfeitamente claro.

Pra mim, autonomia útil depende dessa possibilidade de avançar e também reconhecer um limite concreto. O modelo continua responsável pelo comportamento que apresenta na avaliação; quem fornece as ferramentas precisa responder pelo acesso concedido. Uma análise séria consegue examinar as duas coisas sem escolher uma desculpa favorita.

Antes de alongar uma execução, vou conferir os alvos alcançáveis e a saída prevista pra uma tarefa inviável. A revisão da configuração deve terminar com evidência de que a fronteira funciona. Quero delegar mais, mas nenhum ganho de velocidade justifica empurrar a última barreira do meu experimento pra um mantenedor que nunca aceitou participar dele.

The Broad Way | Kinho.dev