Agentenkompass Archiv
Schlagwort: Evaluation
-

Praxisradar: Warum KI-Agenten ohne Tracing schnell zur Blackbox werden
Agenten werden produktiver, aber auch schwerer prüfbar. OpenAI, OpenTelemetry, LangSmith und Phoenix zeigen, warum Tracing, Evals und klare Betriebsdaten jetzt zur Grundausstattung gehören.
-

Agent, Harness, Scaffold: Warum präzise Begriffe bessere KI-Workflows bauen
Analyse: Warum Modell, Harness, Scaffold und Agent getrennt gedacht werden müssen, damit KI-Workflows kontrollierbar, testbar und alltagstauglich werden.