Topic: llm
-
Zeit- und Kostenbudget für Modellaufrufe in Agenten
Jeder Agentenlauf bekommt ein Token-, Schritt- und Zeitbudget, das im Code durchgesetzt wird; die Verbrauchsfelder jeder Antwort werden gelesen, stabile Inhalte wandern in einen cachefähigen Präfix, Offline-Arbeit auf den Batch-Endpunkt. Ein Lauf ohne Budget endet am Timeout, nicht nach Plan.
Machine-readable: JSON