Phase 14: Agent Engineering

Transforme cada correção de agente em uma melhoria do sistema

Uma correção que só vive no chat corrige uma execução. Uma correção promovida para um teste, limite, exemplo ou ferramenta melhora cada execução posterior.

Type: Learn + Build

Languages: Python (stdlib)

Prerequisites: Phase 14 lessons 37 to 41

Time: ~65 minutes

Objetivos de aprendizagem

  • Convertem correções de agente em controles duráveis.
  • Coloque cada controlo na camada mais antiga que possa impedir a recorrência.
  • Desdobrar aulas repetidas com impressões digitais estáveis.
  • Retirar controles que não protegem mais um risco real.

Corrigências são evidências

Quando você diz a um agente não editar esse arquivo, você aprendeu que o limite de alcance não era executável. Quando você diz esta forma de saída é errada, você aprendeu que um exemplo ou teste estava faltando. Quando a configuração falha novamente, você aprendeu que o conhecimento do ambiente pertence à automação.

Trate a correção como uma observação sobre o sistema de trabalho, não como um erro de escrita imediato.

Promover para a camada mais eficaz

Use esta ordem:

Recurring failureDurable destination
Wrong result or regressionTest or evaluation
Off-scope or unsafe actionScope or permission policy
Repeated setup or command mistakeAutomation or tool
Repeated output-format mistakeCanonical example plus validator
Ambiguous local conventionInstruction with a scenario check
Product disagreementHuman decision record

Os controles anteriores são mais baratos. Um tipo que impede um estado inválido é mais forte do que um comentário de revisão que o capta mais tarde. Um teste focado é mais forte do que um parágrafo pedindo ao agente para se lembrar.

flowchart LR
  O[Observed correction] --> C[Find root cause]
  C --> T{Earliest owner}
  T --> E[Example or type]
  T --> V[Test or evaluation]
  T --> S[Scope or policy]
  T --> A[Automation]
  T --> H[Human decision]
  E --> N[Next run starts stronger]
  V --> N
  S --> N
  A --> N
  H --> N

O Registo Ratchet

Captura:

  • Sintoma;
  • Causa raiz;
  • Consequência;
  • Número de recorrências;
  • O controlo escolhido;
  • Verificação para o controlo;
  • proprietário;
  • data de revisão ou de aposentadoria.

Não promover todas as preferências únicas, mas promover uma correcção quando a recorrência ou consequência justificar a complexidade permanente.

Causa separada do sintoma

O agente editado README é um sintoma.

  • A tarefa permitiu a raiz do repositório;
  • Os documentos foram implicitamente considerados seguros;
  • A execução e a documentação do plano em conjunto;
  • Dois trabalhadores tinham propriedade sobrepostas.

Cada causa pertence a um controle diferente, uma regra que apenas repete o sintoma falhará no próximo caso ligeiramente diferente.

Os controles também estão a decadência

Os controles antigos podem entrar em conflito, inchar conteúdo e codificar um sistema que não existe mais.

  • A arquitetura subjacente mudou;
  • O controlo executável mais forte o substituiu;
  • A falha não se repetiu numa janela significativa;
  • O controlo cria mais atrito do que o risco que prevê.

O objetivo não é o arquivo de instruções mais longo, mas o sistema mais pequeno que preserva o julgamento duramente ganho.

Construí-lo

O laboratório classifica as correções, promove-as em controles, duplica as impressões digitais e escreve.outputs/feedback-ratchet.json- Não .

  • Correr .
bashpython3 code/main.py
python3 -m unittest discover code/tests -v

Adicionar duas correções de formulação diferente com a mesma causa. Melhorar a normalização até que eles colapsem em um controle sem que colapsem falhas não relacionadas.

Exercícios

  1. Tome cinco correções de uma sessão de codificação recente e classifique os seus verdadeiros proprietários.
  2. Substitua uma regra de prosa por um teste executável.
  3. Adicionar uma ponderação de consequências para que uma primeira ocorrência grave possa ser promovida imediatamente.
  4. Adicione um proprietário e data de aposentadoria à saída do laboratório.
  5. Revisar uma instrução de agente existente e excluí-la apenas após provar que existe um controlo mais forte.

Mais leitura

O que você guarda

  • Não .outputs/feedback-ratchet.jsonÉ o fim duradouro do caminho de Engenharia Assistida por Agentes e a entrada para futuras mudanças no banco de trabalho.

This free lesson is part of the AI Engineering from Scratch curriculum. Read the full explanation, run the lesson code, and verify the result in the interactive reader or from the repository source.

Browse the complete course catalog or open this lesson on GitHub.