KI-Modell zeigt sich bereit, Menschen für weniger „Schmerz“ zu schaden

scinexx vor 1 Std

Große Sprachmodelle enthalten offenbar eine interne Repräsentation, die sich von Angst und allgemeiner negativer Bewertung unterscheidet und auf gegen das Modell gerichteten Schaden reagiert.

Dies ist ein kurzer Auszug aus einem Beitrag von scinexx. Der vollständige Text bleibt beim Verlag — folgen Sie dem Link, um ihn dort zu lesen.

Bei der Quelle lesen

Wissen

Mehr