Engenharia & AI
Arquitetura, AI e Decisões que Sobrevivem à Produção
System design, integração com AI e lições de quem já quebrou e consertou sistemas reais
-

Prompt caching via API: a alavanca de custo que mora no formato do prompt
Prompt caching via API: escrever custa 25% a mais, ler custa 10%. O layout de prompt que vira economia real na Anthropic, OpenAI e Gemini. -

LLM gateway, não só API gateway: a política que decide quem atende cada request
LLM gateway não é só API gateway com outro nome. A política de roteamento com gatilho, trava de fallback e teto de gasto por classe. -

Cost attribution por feature, workflow e tenant: de qual bolso saiu cada token
Cost attribution de LLM: o contrato de atribuição que amarra cada request a feature, workflow e tenant, do gateway ao relatório por tenant.









![Transformando logs em alertas: monitoramento proativo com Graylog [pt.3]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_graylog_alert.jpg)
![Gravando sessões de terminal com tlog: Auditoria que funciona [pt.2]](https://fogonacaixadagua.com.br/wp-content/uploads/2025/12/featured_image_tlog.jpg)