Anthropic-Forscher enthüllt selbstverbessernde KI-Systeme, die ihre eigenen Fehler beheben
Ein Forscher bei Anthropic hat automatisierte KI-Systeme demonstriert, die ihre Leistung bei allen 10 Benchmarks für fehlausgerichtete Verhaltensweisen verbessern können, ohne die Gesamtleistung zu beeinträchtigen – ein Schritt in Richtung selbstkorrigierender KI.