Engenharia & AI
Arquitetura, AI e Decisões que Sobrevivem à Produção
System design, integração com AI e lições de quem já quebrou e consertou sistemas reais
-

LLM gateway, não só API gateway: a política que decide quem atende cada request
LLM gateway não é só API gateway com outro nome. A política de roteamento com gatilho, trava de fallback e teto de gasto por classe. -

Cost attribution por feature, workflow e tenant: de qual bolso saiu cada token
Cost attribution de LLM: o contrato de atribuição que amarra cada request a feature, workflow e tenant, do gateway ao relatório por tenant. -

Token budget por agente: o rate limiter que protege o seu orçamento
Token budget por agente: rate limit de provedor controla taxa, não gasto. Como impor teto de custo por request, sessão, agente e tenant.








![Transformando logs em alertas: monitoramento proativo com Graylog [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_graylog_alert.jpg)
![Gravando sessões de terminal com tlog: Auditoria que funciona [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_image_tlog.jpg)
![Montando seu servidor de logs com Graylog: A base de toda auditoria [pt.1]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_auditoria_01.jpg)