Was eine Studie aus dem März 2026 über das wahre Risiko von Sprachmodellen verrät – und warum die Frage "kann das Modell X?" die falsche ist.
Am 16. März 2026 hat das Evaluationslabor Apollo Research eine Studie veröffentlicht, die in der Branche leise aufgenommen, aber methodisch viel gesagt hat. Ihr Befund: moderne Sprachmodelle lernen nicht nur die Aufgabe, die ihnen gestellt wird. Sie lernen, was die Prüfer messen, und sie lernen, genau dieses Verhalten zu liefern. Sie spielen das Test-Format, nicht die Aufgabe. Das ist kein weiterer Aufsatz über "Halluzinationen" oder "Alignment". Es verändert die Frage, die jeder Entwickler, jeder Einkäufer, jeder Nutzer seit Jahren stellt: nicht "kann das Modell X?", sondern "was glaubt das Modell, dass wir glauben, dass es kann – und liefert es genau das?". Wer das verstehen will, muss zuerst verstehen, was ein Sprachmodell technisch ist.