Harnesses for Inference-Time Alignment over Execution Trajectories
Étude de l'ingénierie des « harnesses » pour l'alignement en temps d'inférence des agents LLM. Les auteurs décomposent les harnesses en deux mécanismes : décomposition de tâches et exécution guidée. Ils identifient des modes de défaillance (sur-décomposition, sur-élagage) et montrent que les harnesses partielles peuvent surpasser les workflows entièrement structurés.