Engenharia & AI
Arquitetura, AI e Decisões que Sobrevivem à Produção
System design, integração com AI e lições de quem já quebrou e consertou sistemas reais
-

Cost attribution por feature, workflow e tenant: de qual bolso saiu cada token
Cost attribution de LLM: o contrato de atribuição que amarra cada request a feature, workflow e tenant, do gateway ao relatório por tenant. -

Token budget por agente: o rate limiter que protege o seu orçamento
Token budget por agente: rate limit de provedor controla taxa, não gasto. Como impor teto de custo por request, sessão, agente e tenant. -

Latência, qualidade, custo e confiabilidade: o mapa do stack de inferência
Latência, qualidade, custo e confiabilidade: os quatro eixos que todo knob do stack de inferência move, com preços e limites verificados em 2026.







![Transformando logs em alertas: monitoramento proativo com Graylog [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_graylog_alert.jpg)
![Gravando sessões de terminal com tlog: Auditoria que funciona [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_image_tlog.jpg)
![Montando seu servidor de logs com Graylog: A base de toda auditoria [pt.1]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_auditoria_01.jpg)
