Automatisierte Qualitätsbewertung technischer Dokumentation (LLM-basiert)
Konzeption und Entwicklung einer Evaluations-Pipeline, die KI-generierte technische Dokumente automatisiert gegen definierte Qualitätskriterien prüft. Umsetzung als Erweiterung einer internen Developer-Plattform. Rubric-basiertes Scoring nach LLM-as-a-Judge-/G-Eval-Methodik mit separatem Judge-Modell zur Vermeidung von Self-Enhancement-Bias. Zweistufige Architektur aus Offline-Kalibrierung und Online-Bewertung, Anbindung von Fachsystemen über MCP-Tools.