Forward Deployed Engineer · Agentes de IA e Orquestração de LLM

Filipe Pawlik Leite

Faço agente de IA parar de mentir.

Construo o arreio em volta dos agentes de IA — os portões, a avaliação e a orquestração que decidem se a saída do agente é boa o bastante para ir ao ar. Depois sento com o cliente e fico até a coisa funcionar.

02 — O que eu de fato vendo

Uma porta que
recusa.

Tudo que um agente escreve tem que passar por typecheck, por uma suíte de testes de verdade e — no web — por um build que produz artefato servível. Sem isso não vai ao ar. Vire a chave e quebre o código. A porta abaixo é a mesma lógica, rodando aqui no seu navegador.

Porta de qualidade idle
// agent output · profile: web
export function splitCost(cents: number, ways: number) {
  if (ways < 1) throw new Error('ways must be ≥1');
  const base = Math.floor(cents / ways);
  const rem = cents % ways;
  return Array.from({ length: ways }, (_, i) => base + (i < rem ? 1 : 0));
}
// splitCost(100, 3) → [34, 33, 33]  · sums to 100
    Veredito
    Pronta
    Aperte rodar. A porta não sabe qual variante você escolheu.

    Provada honesta com testes-sombra: código sabidamente ruim é recusado. Quando a porta reprova, o sistema devolve o erro ao agente e tenta de novo com backoff, até um teto duro.

    03 — Quem é ele

    Infraestrutura que
    conversa.

    Forward Deployed Engineer

    Constrói o arreio em volta dos agentes de IA — os portões, a avaliação e a orquestração que decidem se a saída de um agente é boa o bastante para ir ao ar. Depois senta com o cliente, acha o problema de verdade, e fica até a coisa funcionar.

    AI Agents & LLM
    🌎

    Três línguas, um fuso

    Português nativo, inglês e espanhol fluentes — todas línguas de trabalho. UTC−3, sobreposição total com o horário comercial dos EUA. Bombinhas, Santa Catarina, Brasil.

    PT · EN · ES
    🔗

    A combinação rara

    Entrega a infraestrutura E conduz a conversa com o cliente. Não precisa de tradutor entre o que o cliente precisa e o que o sistema faz — ele é os dois lados da ponte.

    Engenharia + Cliente

    Vinte anos de estrada

    Hospitais, bancos de sangue, governos, Chevrolet — seis paradas em vinte anos. Sistemas que rodam sem ele porque foram desenhados para isso desde o dia um.

    2004 — 2024
    04 — Oito agentes, um roteador

    Roteio por taxa de acerto,
    não por impressão.

    A precisão medida de cada agente decide quem pega a próxima tarefa. Escolha um trabalho. O roteador pesa taxa de acerto contra elegibilidade e escolhe — do mesmo jeito que faz em produção.

    Aguardando seleção Escolha um trabalho para ver o roteador decidir.
    05 — Medido, não afirmado

    Todo número aqui
    foi contado.

    Se um número desta página não tem fonte, ele não deveria estar nesta página. Amostra pequena aparece com o tamanho da amostra junto.

    0
    Projetos
    entregues autonomamente — sem intervenção manual entre a tarefa e o deploy
    Fonte: histórico de deploys, jan/2023–jul/2024
    0
    Execuções
    medidas com registro de acerto, erro e custo por chamada
    Fonte: ledger de avaliação interno, 117 execuções documentadas
    $0
    Custo mediano
    por chamada de agente — incluindo LLM, avaliação e backoff
    Fonte: planilha de custos, amostra de 342 chamadas
    06 — O que ele construiu

    Sistemas que rodam
    sem ele.

    Agentes

    Porta de Qualidade

    Pipeline de typecheck, testes e build que valida saída de agentes antes de ir ao ar. Recusa automática com backoff e teto duro.

    TypeScriptNodeLLM
    Infra

    Roteador de Agentes

    Sistema de orquestração que pesa taxa de acerto contra elegibilidade e distribui tarefas entre oito agentes especializados.

    PythonFastAPIPostgres
    Saúde

    Banco de Sangue

    Sistema de gestão de estoque e rastreamento de hemocomponentes para rede hospitalar. 12 anos em produção sem falha crítica.

    C#SQL ServerAzure
    Automotivo

    Chevrolet

    Sistema de gestão de frota e logística com orquestração de agentes para roteamento dinâmico de entregas.

    JavaKafkaAWS
    07 — Como ele escolhe tecnologia

    Custo, qualidade, escala.
    Depois medir.

    💰 Primeiro

    Quanto custa?

    Toda decisão tem custo de implementação, custo de operação e custo de troca. Se uma biblioteca resolve o problema mas te prende a um ecossistema, ela não sai barata — sai financiada.

    🎯 Segundo

    Quão boa é de verdade?

    Benchmark de fabricante não é prova. Teste simulado não é dado de produção. A única medida que vale é a que foi colhida no cenário real, com carga real, e documentada com o tamanho da amostra.

    📈 Terceiro

    Aguenta crescer?

    O que funciona com 100 requisições por dia quebra com 100 mil — e o quebra-quebra revela o desenho. Escala não é sobre performance, é sobre se o sistema continua fazendo sentido conforme o tamanho muda.

    📐 Depois

    Medir.

    Candidata não é decisão. Estudo não é decisão. O padrão da casa é o que sobreviveu à medição. Uma tecnologia que não pode ser testada lado a lado com a atual não entra — porque escolher sem medir não é escolher, é chutar.

    08 — Vamos trabalhar juntos

    Ache o seu problema
    de verdade.

    Forward Deployed Engineer · aberto a oportunidades de construir o arreio em volta de agentes de IA em produção.

    filipe@netcks.com
    Bombinhas, Santa Catarina, Brasil · UTC−3 — sobreposição total com o horário comercial dos EUA.
    linkedin.com/in/filipecrocks · +55 48 9 9187 5051