Was sich geändert hat
LASER kombiniert einfache Klassifikatoren mit Bewertungen durch Reasoning-Modelle, um vielfältige und mehrdeutige Testbeispiele zu finden.
Quelle: OpenAI Alignment
Unsere Einordnung
Studio-Sicht: Testfälle durch schwierige Grenzfälle verbessern, statt immer wieder bekannte Beispiele zu prüfen.
Zu beachten
Es geht um die Auswahl von Evaluationsdaten, nicht um eine allgemeine Sicherheitsgarantie für ein eingesetztes Modell.
Quelle: OpenAI Alignment
Quellen & Daten
- OpenAI AlignmentQuelle veröffentlicht: 6 Okt. 2026Geprüft: 7 Okt. 2026
Bericht aktualisiert: 7 Okt. 2026
Redaktionsstandards & Korrekturen