Toward Reliable Design of LLM-Enabled Agentic Workflows: Optimizing Latency-Reliability-Cost Tradeoffs
Article arXiv analysant les compromis latence-fiabilité-coût dans les workflows multi-agents LLM. Propose des modèles de performance pour agents LLM et non-LLM, une politique d'allocation de tokens par water-filling, et caractérise la fiabilité optimale via shadow prices sous contraintes de latence et coût.