Die Achillesferse von GPT
Eine WORTLIGA-Studie im Auftrag von SISTRIX hat 2.112 Antworten führender Sprachmodelle auf Verständlichkeit geprüft. Kein Modell erreichte im Durchschnitt den empfohlenen Zielbereich von 60 bis 70 Punkten. Claude Opus 4.7 führte mit 47,7 Punk...