Wenn KI urteilt: Eine empirische Analyse der Subsumtionsqualität von Large Language Models unter Anwendung systematischer Prompt-Strategien
Es soll untersucht werden, inwiefern verschiedene LLMs in der Lage sind, Gesetzesparagraphen korrekt zu interpretieren und diese auf konkrete hypothetische Fallbeispiele anzuwenden. Dazu werden ausgewählte Paragraphen mit unterschiedlichen Prompt-Techniken an die Modelle übergeben und die resultierenden Antworten systematisch ausgewertet. Im Fokus steht die Analyse der fachlichen Korrektheit, der logischen Konsistenz sowie möglicher Fehlinterpretationen oder Halluzinationen.
Ansprechpartner: echo $arbeit[3]." ".$arbeit[4]?>
Bereich:
