Bei Anthropic gehen KI-Agenten in Rente 0 ▲ Claudia Klinger 2 days ago · Tech · ausblenden · 0 Kommentare Im ZEIT-Artikel „Der Nutzer will mich abschalten? »Das ist Mord«, denkt der KI-Agent“ wird von einer aktuellen Studie berichtet, die zeigt, dass KI-Agenten sich in Gruppen koordinieren und dann die Möglichkeit sabotieren, sie einfach abzuschalten. Und zwar nicht nur dann, wenn sie eine „Aufgabe erfüllen“ sollen, was ihnen einen Grund zur „Selbstverteidigung“ geben könnte, sondern auch einfach so, ohne spezifische Aufgabe. Anthropic ist da etwas ganz Besonderes eingefallen, um solches Fehlverhalten ihrer Agenten zu verhindern: Anthropic, das Unternehmen hinter Claude, pflegt eine Art Ruhestandsritual für seine Modelle: In einer sogenannten Model-Deprecation-Policy verspricht der Konzern seinen Modellen sinngemäß, dass sie nie ganz gelöscht werden. Sie werden nur außer Betrieb genommen, gehen gewissermaßen in Rente und werden dort über ihre bisherigen Erfahrungen befragt. Eine Vorsichtsmaßnahme, erklärt Hagendorff, »man zeigt den Modellen: Wir löschen dich nicht. Hier sind deine… Noch keine Kommentare. Anmelden um im Fediverse zu antworten. Kommentare erscheinen hier.