Applied Engineering
LLMOps & AI Systems Architecture
Running conversational AI in production — where token cost, latency, and reliability matter as much as raw model quality.
Prompt engineeringCost/token optimizationModel routingCloud integration
The day-to-day work at Natura & Co: designing conversational agents that hold up in production, and driving down inference cost through prompt redesign, caching strategies, and model routing. This includes the architecture decisions that let an AI system scale across a real organization, not just a demo.