SoSe 2025
Reported Aug 31, 2026
FB20 Computer Science · Offered in SoSe 2026, SoSe 2025
Average of averages
1.68
Every semester counts equally, whatever its size.
Pooled average
1.69
Weighted by cohort size — what an arbitrary student across all semesters scored.
Pass rate
100%
Share of results at 4.0 or better. 4.0 is the last passing grade.
Semesters with data
2
The German scale runs 1.0 (best) to 4.0 (last pass), with 5.0 as fail. There is no 4.3.
Reported Aug 31, 2026
No ratings yet — be the first.
Your vote is stored against a random id in this browser. No account, nothing that identifies you.
Große Sprachmodelle haben die KI-Branche verändert und sind Teil unseres Alltags geworden, wo sie von Einzelpersonen, Unternehmen und Regierungen genutzt werden. Doch genau die Eigenschaften, die LLMs auszeichnen, machen es auch so schwer, sie zu bewerten. Wie kann man bei einem LLM wissen, was es kann und was nicht? Wie können wir wissen, ob dieses Verhalten in verschiedenen Anwendungskontexten gleich bleibt? Welche Belege sollten wir als Beweis für die Leistungsfähigkeit oder Unzulänglichkeit eines LLM akzeptieren? Welche Vereinfachungen sollten wir vermeiden, wenn wir über intelligente Maschinen nachdenken und sprechen? Vor dem Hintergrund von Einzelberichten, Medienrummel, unbegründeten Befürchtungen und berechtigten Bedenken hinsichtlich der Leistungsfähigkeit von LLMs befasst sich das diesjährige Seminar eingehend mit dem Thema der LLM-Bewertung. Auf der Grundlage von Arbeiten zur Messtheorie und modernsten LLM-Bewertungspraktiken werden wir die grundlegenden LLM-Bewertungsparadigmen, die grundlegenden Herausforderungen bei der Erstellung robuster Aussagen über das Verhalten von LLMs und anderen intelligenten Agenten sowie mögliche Wege für die Zukunft untersuchen.
No exam date published.
Add to plannerMissing (no reason): 1Reported Aug 31, 2026
Times, rooms and details come from TUCaN and may be out of date. Report something wrong