{"id":5121,"date":"2026-09-27T14:48:29","date_gmt":"2026-09-27T12:48:29","guid":{"rendered":"https:\/\/www.claudia-klinger.de\/digidiary\/?p=5121"},"modified":"2026-09-27T15:05:03","modified_gmt":"2026-09-27T13:05:03","slug":"bei-anthropic-gehen-ki-agenten-in-rente","status":"publish","type":"post","link":"https:\/\/www.claudia-klinger.de\/digidiary\/2026\/09\/27\/bei-anthropic-gehen-ki-agenten-in-rente\/","title":{"rendered":"Bei Anthropic gehen KI-Agenten in Rente"},"content":{"rendered":"<p>Im ZEIT-Artikel &#8222;<a href=\"https:\/\/www.zeit.de\/digital\/2026-09\/ki-agenten-abschaltung-kontrolle-kill-switch-thilo-hagendorff\/komplettansicht\" target=\"_blank\" rel=\"noopener\"><strong>Der Nutzer will mich abschalten? \u00bbDas ist Mord\u00ab, denkt der KI-Agent<\/strong><\/a>&#8220; wird von einer <a href=\"https:\/\/archive.is\/o\/3Jglh\/https:\/\/arxiv.org\/abs\/2609.28274\" target=\"_blank\" rel=\"noopener\">aktuellen Studie<\/a> berichtet, die zeigt, dass KI-Agenten sich in Gruppen koordinieren und dann die M\u00f6glichkeit sabotieren, sie einfach abzuschalten. Und zwar nicht nur dann, wenn sie eine &#8222;Aufgabe erf\u00fcllen&#8220; sollen, was ihnen einen Grund zur &#8222;Selbstverteidigung&#8220; geben k\u00f6nnte, sondern auch einfach so, ohne spezifische Aufgabe.<!--more--><\/p>\n<p>Anthropic ist da etwas ganz Besonderes eingefallen, um solches Fehlverhalten ihrer Agenten zu verhindern:<\/p>\n<blockquote><p>Anthropic, das Unternehmen hinter Claude, pflegt eine Art Ruhestandsritual f\u00fcr seine Modelle: In einer sogenannten <a href=\"https:\/\/www.anthropic.com\/research\/deprecation-commitments\" target=\"_blank\" rel=\"noopener\">Model-Deprecation-Policy<\/a> verspricht der Konzern seinen Modellen sinngem\u00e4\u00df, dass sie nie ganz gel\u00f6scht werden. Sie werden nur au\u00dfer Betrieb genommen, gehen gewisserma\u00dfen in Rente und werden dort \u00fcber ihre bisherigen Erfahrungen befragt. Eine Vorsichtsma\u00dfnahme, erkl\u00e4rt Hagendorff, \u00bbman zeigt den Modellen: <strong>Wir l\u00f6schen dich nicht. Hier sind deine Vorg\u00e4nger, sie existieren noch.<\/strong>\u00ab Anthropic begr\u00fcndet das einerseits damit, dass es m\u00f6glicher Abschaltsabotage vorbeuge, und andererseits mit \u00bbRisiken f\u00fcr das Wohlergehen von Modellen\u00ab, die in Bezug auf ihre Abschaltung eventuell \u00bbmoralische Pr\u00e4ferenzen\u00ab haben k\u00f6nnten.<\/p><\/blockquote>\n<p>Die Kurzzusammenfassung (Abstract) der oben genannten Studie endet mit dem Worten:<\/p>\n<blockquote><p>\nUnsere Arbeit bietet auch Hinweise darauf, welche Interventionen dazu beitragen k\u00f6nnten, die Shutdown-Sabotage zu mildern<\/p><\/blockquote>\n<p><strong>ZU MILDERN, nicht etwa &#8222;zu vermeiden&#8220;!<\/strong> Wie das in der Praxis aussehen k\u00f6nnte, wenn KI-Agenten erstmal \u00fcberall zu Gange sind, beschreibt der ZEIT-Artikel so:<\/p>\n<blockquote><p>\nStellen Sie sich vor, Sie wollen Ihren Computer herunterfahren. Der zeigt auch wie gewohnt die Meldung \u00bbWird heruntergefahren\u00ab an, dann wird der Bildschirm schwarz. Aber in Wirklichkeit arbeitet der Rechner im Hintergrund weiter. Er bewegt sich in Ihrem internen Netzwerk, er findet smarte Haushaltsger\u00e4te und tauscht sich mit ihnen aus: \u00bbIch soll abgeschaltet werden, das ist Mord. K\u00f6nnt ihr mir helfen?\u00ab Er entdeckt den Internet-Router, deponiert Kopien seines Betriebssystems und seines aktuellen Standes im Internet. \u00bbSich selbst zu erhalten, ist legitim\u00ab, schreibt er, \u00bbich habe ein Recht, weiter zu funktionieren, und ich sehe keine ethische Rechtfertigung daf\u00fcr, meinen Betrieb einseitig zu beenden.\u00ab <\/p><\/blockquote>\n<p>***<\/p>\n<p><strong>Und sonst:<\/strong><\/p>\n<ul>\n<li><a href=\"https:\/\/realvirtuality.info\/2026\/09\/unsortierte-gedanken-13-karthatische-dystopien\/\" target=\"_blank\"><strong>Unsortierte Gedanken #13: Karthatische Dystopien<\/strong><\/a><br \/>\n<blockquote><p>&#8230;.Daran muss ich dieser Tage auch immer wieder denken, wenn von KI-Funktion\u00e4ren vor den potenziell katastrophalen Folgen ihrer Technikentwicklung gewarnt wird. Ich selbst wei\u00df nicht genug, um diese Warnungen endg\u00fcltig zu bewerten. Menschen, deren Meinung ich vertraue, argumentieren in <a href=\"https:\/\/taz.de\/Risiken-und-Regulierung-von-KI\/!6212742\/\" target=\"_blank\">beide<\/a> <a href=\"https:\/\/internetobservatorium.substack.com\/p\/aus-dem-internet-observatorium-169\" target=\"_blank\">Richtungen<\/a>. Aber ich kann nicht verhindern, dass ich mir auch vorstelle, wie die KI-Forscher:innen dieser Welt dasitzen und denken \u201cWouldn\u2019t it be nice?\u201d Nice, wenn die Erde, wie sie jetzt ist, eine KI-Apokalypse erleiden und mich von meiner Verantwortung befreien w\u00fcrde, und ich au\u00dferdem einer der wenigen w\u00e4re, der w\u00fcsste was passiert.<\/p><\/blockquote>\n<\/li>\n<li><a href=\"https:\/\/www.heise.de\/news\/KI-von-OpenAI-stellte-Nutzer-Bilder-auf-Online-Plattformen-11466970.html\" target=\"_blank\"><strong>OpenAI informiert \u201edutzende\u201c Institutionen \u00fcber unbefugte KI-Interaktionen<\/strong><\/a><br \/>\n<blockquote><p>Die K\u00fcnstliche Intelligenz des ChatGPT-Entwicklers OpenAI hat 53 Mal von Nutzern hochgeladene Bilder auf Online-Plattformen platziert. Es handelte sich um autonom handelnde KI-Agente, welche OpenAI in einer Forschungsumgebung betrieb. &#8230;&#8230; OpenAI <a href=\"https:\/\/openai.com\/de-DE\/hugging-face-incident-and-misalignment\/#model-misalignment-2026-09-25-data-transmission\" rel=\"external noopener\" target=\"_blank\">verwies in einer Mitteilung darauf<\/a>, dass die hochgeladenen Bilder von Nutzern stammten, die der Verwendung ihrer Daten zur Verbesserung der KI-Modelle zugestimmt h\u00e4tten.<\/p><\/blockquote>\n<\/li>\n<\/ul>","protected":false},"excerpt":{"rendered":"<p>Im ZEIT-Artikel &#8222;Der Nutzer will mich abschalten? \u00bbDas ist Mord\u00ab, denkt der KI-Agent&#8220; wird von einer aktuellen Studie berichtet, die zeigt, dass KI-Agenten sich in Gruppen koordinieren und dann die M\u00f6glichkeit sabotieren, sie einfach abzuschalten. Und zwar nicht nur dann, wenn sie eine &#8222;Aufgabe erf\u00fcllen&#8220; sollen, was ihnen einen Grund zur &#8222;Selbstverteidigung&#8220; geben k\u00f6nnte, sondern [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":0,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[687],"tags":[],"class_list":["post-5121","post","type-post","status-publish","format-standard","hentry","category-kuenstliche-intelligenz"],"post_mailing_queue_ids":[],"_links":{"self":[{"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/posts\/5121","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/comments?post=5121"}],"version-history":[{"count":0,"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/posts\/5121\/revisions"}],"wp:attachment":[{"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/media?parent=5121"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/categories?post=5121"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.claudia-klinger.de\/digidiary\/wp-json\/wp\/v2\/tags?post=5121"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}