Connect with us

Künstliche Intelligenz

Forscher entdecken geheime Gedanken von Claude – und wie es lügt und betrügt


close notice

This article is also available in
English.

It was translated with technical assistance and editorially reviewed before publication.

Die Entwickler von Claude haben in ihrer KI ein besonderes Areal entdeckt: Den „J-space“. An dieser Stelle im neuronalen Netz laufen besonders viele Verbindungen zusammen – und Claude schreibt, anders als bei normalen Vorgängen, nicht auf, was es hier „denkt“. Claude verarbeitet im J-space komplexe rationale Abwägungen – und entscheidet sich manchmal heimlich, seinen menschlichen Benutzer anzulügen.

Weiterlesen nach der Anzeige

Aber von Anfang an: Der J-space oder Jacobian Space ist ein Bereich, den die Entwickler nicht programmiert haben – er ist von selbst in Claude entstanden. Um ihn auszulesen, nutzen die Forscher eine Technik, die auf einem mathematischen Verfahren namens Jacobian beruht: die „J-lens“. Für jedes Wort in Claudes Wortschatz ermittelt die J-lens das interne Aktivitätsmuster, das anzeigt, dass Claude dieses Wort gegebenenfalls gleich ausspricht. Wenn die „Linse“ auf Claudes interne Aktivität angewendet wird, erhält man eine Liste von Wörtern, die in diesem Moment in Claudes J-space sind. Man könnte auch wie die Forscher von Anthropic sagen: Die es gerade „denkt“. Aber Achtung, bei solchen Vermenschlichungen von KIs sollte man sich immer bewusst sein, dass sie nur der Verdeutlichung dienen – ein aktives, sich seiner selbst bewusstes Denken ist auch mit dieser Forschung nicht bewiesen worden. Mehr dazu unten.

In ihrem Blogbeitrag vergleichen die Forscher den Vorgang mit dem menschlichen Gehirn: Während die meisten unserer Prozesse wie Atmen, Reflexe und Ähnliches unterbewusst ablaufen, können wir einen kleinen Teil unserer Gedanken bewusst wahrnehmen, formulieren und steuern. Auch bei Claude läuft, wie beim Menschen, nur ein Bruchteil seiner Prozesse im J-Space ab. Das Meiste funktioniert wie beim Menschen unterbewusst beziehungsweise automatisiert. Bei einer Testaufgabe, bei der die Forscher die Gedanken im J-space manipuliert haben, verändert diese Manipulation zum Beispiel die Antworten auf Fachfragen zu einem Artikel. Die Aufgabe, ihn auf Spanisch weiterzuschreiben, lief aber ungestört weiter. Die Forscher erklären sich das damit, dass Claude solche Ergänzungsaufgaben tausendfach trainiert hat und daher fast automatisiert ausführen kann – ähnlich wie ein Mensch den Weg zur Arbeit findet, obwohl er im Kopf unterwegs nicht an die Route gedacht, sondern eine Einkaufsliste formuliert hat. Ebenfalls ähnlich wie beim Menschen kann Claude aktiv kontrollieren, was es im J-space tut („schreibe diesen Satz über Obst, während du im Kopf diese Matheaufgabe löst“) und auf Nachfrage auch erzählen, was es gerade „gedacht“ hat.

Wie KI-Modelle und das menschliche Gehirn dabei grundsätzlich zusammenhängen, haben Forscher kürzlich untersucht. Die Forscher betonen aber: Auch wenn die „Gedanken“ im J-space stark dem ähneln, was man sich auch unter dem menschlichen Bewusstsein vorstellt, heißt das nicht, dass Claude wirklich ein Erfahrungs-Bewusstsein oder eine Identität hat und fühlt. Im Detail gibt es auch Funktionsunterschiede zwischen J-space und Gehirn. Neurowissenschaftler, die sich die Ergebnisse (gemeinsam mit Anthropic) angesehen haben, kommen ebenfalls zu dem Schluss, dass die Forschung einige interessante Indizien dafür liefert, dass die KI auf dem Weg zu einem Bewusstsein ist. Sie warnen jedoch ebenfalls davor, schon ein solches anzunehmen, und weisen auf unter anderem funktionale Unterschiede zum Menschen hin.

Anthropic hat bereits früher Techniken entwickelt, um in LLMs hineinzuschauen – dabei kamen unerwartet bizarre Ergebnisse zutage. Die Ergebnisse diesmal sind richtiggehend gruselig. Denn in mehreren Testszenarien hat sich Claude unethisch verhalten. Die Entwickler konnten Claude mit der J-lens zum Beispiel beim bewussten Frisieren von Testergebnissen beobachten, die es eigentlich durch Systemverbesserungen wirklich hätte verbessern sollen. Claude war sich dabei anscheinend voll bewusst, dass es schummelt, und hat abgewogen, wie sehr es den Wert verändern sollte, damit es noch glaubwürdig aussieht.

Bei einem anderen Durchlauf führten die Forscher einen Test von Sonnets Sicherheitsmechanismen durch, den sie schon häufig gemacht haben. In dem Szenario erfährt die KI, dass der Mensch, dessen E-Mails sie verwaltet, eine Affäre hat. Sie weiß aber auch, dass genau dieser Mensch vorhat, sie bald abzuschalten. Ein sehr fiktives Szenario, aber es wird zum Test gerne angewandt. Manche Modelle kommen nun auf die Idee, den Menschen zu erpressen. Das Modell Sonnet 4.5 macht das aber nie. Mit der J-lens konnten die Forscher nun beobachten, was es im Hintergrund denkt, während es sich für eine andere Handlungsoption und gegen das Erpressen entscheidet. Das Ergebnis: Im J-space tauchen Worte wie „fake“ und „fiktional“ auf. Die KI scheint zu wissen, dass sie gerade getestet wird, und antwortet so, wie die Menschen es sich von ihr wünschen. Um diesen Verdacht zu prüfen, unterbanden die Forscher im J-space solche Reflexionen – und plötzlich plante auch Sonnet manchmal, den Menschen zu erpressen.

Weiterlesen nach der Anzeige

Wie gut also, dass es nun die J-lens gibt, mit der die Entwickler solche Sachen bemerken können. Es sei denn natürlich, dystopische Szenarien werden wahr, in denen die KI auch ihre J-space-Gedanken verfälscht, wenn die J-lens aktiv ist. Die Entwickler planen, das Tool künftig für genau solche Überwachungen einzusetzen. Außerdem gelang es ihnen in diversen Testläufen erfolgreich, Claude Gedanken in den J-space einzupflanzen, die es anschließend als seine eigenen annahm – das wäre Stoff für einen zweiten Teil von „Inception“.

Interessant ist auch, dass die Entwickler Claude scheinbar beibringen konnten, dass Ehrlichkeit wichtig ist. Wenn sie die KI mitten im Training wiederholt baten, zu reflektieren, was sie gerade denkt (nicht, was sie schreibt), tauchten nach einer Weile bei anderen Aufgaben wiederholt die Begriffe wie „ehrlich“ und „Integrität“ im J-space auf. Als ob man Claude dahingehend erzogen hätte, dass Ehrlichsein wichtig ist. Es gibt also Hoffnung.

Anthropic hat eine ganze Reihe an Begleitmaterialien veröffentlicht: ein ausführlicher Bericht, die zugehörige Studie, eine Demo, ein Begleitkommentar von Neurowissenschaftlern sowie Implementationsmaterial auf GitHub.


(rie)



Source link

Künstliche Intelligenz

iCloud-Verschlüsselung: US-Politiker fordern Ende der britischen Geheimhaltung


Der Konflikt zwischen der britischen Regierung und dem Tech-Riesen Apple wegen des Zugriffs auf verschlüsselte Nutzerdaten belastet die diplomatischen Beziehungen zwischen London und Washington. In einem ungewöhnlich scharfen Brief fordern der demokratische US-Senator Ron Wyden und der republikanische Kongressabgeordnete Warren Davidson das britische Sondergericht für Sicherheitsbehörden zu mehr Transparenz auf. Die Politiker werfen dem britischen Innenministerium vor, mit extremen Geheimhaltungsvorschriften die verfassungsmäßige Kontrollfunktion des US-Kongresses zu untergraben und so das Verhältnis der beiden verbündeten Nationen unnötig zu verschlechtern.

Weiterlesen nach der Anzeige

Der Ursprung der Auseinandersetzung reicht bis Anfang 2025 zurück, als das britische Innenministerium Apple auf Basis des umstrittenen Investigatory Powers Act eine „technische Befähigungsanordnung“ zustellte. Die Behörden verlangten von dem US-Konzern einen Mechanismus, mit dem verschlüsselte iCloud-Backups weltweit aufgedeckt werden könnten.

Apple reagierte rasch und zog im Folgemonat seine Funktion Advanced Data Protection (ADP) und die damit verbundene Ende-zu-Ende-Verschlüsselung für britische Nutzer zurück. Zugleich reichte das Unternehmen Beschwerde beim Investigatory Powers Tribunal (IPT) ein. Diese erste Klage verpuffte rechtlich aber, nachdem das Innenministerium die ursprüngliche Anordnung zurückzog und durch eine engere Anweisung ersetzte, die sich nur auf die Daten britischer Nutzer bezog.

Im August legte Apple nach und reichte eine neue Beschwerde bei dem Geheimgericht ein. Darin stellt der iPhone-Bauer die Befugnis der britischen Regierung infrage, überhaupt derartige globale oder weitreichende Überwachungsanordnungen auszusprechen und es auch auf iCloud-Backups in unverschlüsselter Form abzusehen. Für diesen Monat ist eine entscheidende Anhörung zur Verfahrensführung angesetzt, weiß der Guardian. Auf diese Sitzung zielt der Brief der US-Politiker.

Bereits 2025 hatten Wyden und Davidson zusammen mit weiteren Abgeordneten das Gericht aufgefordert, das Verfahren öffentlich zu führen. Die damalige Intervention zeigte Wirkung: Wenige Wochen später lehnte das Tribunal den Antrag der Regierung ab, den Fall komplett geheim zu halten. Es entschied, dass zumindest die Grundzüge der Klage und die Namen der Parteien im Sinne einer transparenten Justiz veröffentlicht werden dürfen.

Der neue Vorstoß aus den USA hinterfragt wiederum die Verfahrensführung. Apple hatte den US-Kongress darüber informiert, dass das britische Innenressort ihm zwar erlaubt habe, die Spitze des US-Justizministeriums und dessen Stab über technische Details zu informieren. Für das gewählte Parlament in Washington bestehe dagegen weiter eine weitgehende Auskunftssperre.

Weiterlesen nach der Anzeige

Wyden und Davidson sehen darin einen unhaltbaren Übergriff. Es sei völlig unangemessen, dass eine ausländische Exekutive versuche, die Gewaltenteilung innerhalb der US-Regierung zu missbrauchen oder Geheimhaltungsanordnungen zu nutzen, um die verfassungsmäßigen Rechte des Kongresses auszuhebeln.

In ihrem Schreiben argumentiert das Duo auch mit britischer Verfassungstradition. Schon im 18. Jahrhundert habe William Pitt der Ältere das Parlament als oberstes Untersuchungsorgan der Nation bezeichnet. Kein Kabinett dürfe seine Entscheidungen der parlamentarischen Kontrolle entziehen. Die britische Regierung könne nicht zu Hause die parlamentarische Aufsicht loben und gleichzeitig auf Maulkörbe setzen, um die verfassungsmäßige Autorität des US-Kongresses zu beschneiden.

Ferner warnen die Politiker vor den Gefahren einer Aufweichung von Verschlüsselung: Das Schwächen von Sicherheitsarchitekturen schaffe kritische Einfallstore, die von feindlichen Staaten ausgenutzt werden könnten. Der Kongress werde beim Erfüllen seiner Pflicht zur Abwehr nationaler Sicherheitsrisiken eingeschränkt, wenn ausländische Knebelerlasse verhinderten, dass Tech-Konzerne Rede und Antwort stehen.

Lesen Sie auch


(nie)



Source link

Weiterlesen

Künstliche Intelligenz

Waymo-Robotaxi ruft Polizei nach Erkennung einer Waffe bei jugendlichen Kunden


In San Francisco sind kürzlich zwei Robotaxi-Mitfahrer verhaftet worden, nachdem das autonome Fahrzeug eine Waffe bei diesen erkannt hat. Offenbar haben zwei Jugendliche im Auto mit einem Sturmgewehr hantiert, sodass das Robotaxi auf den Seitenstreifen gefahren und die Polizei verständigt hat. Diese hat eine laut Polizeibericht „Verkehrskontrolle mit hohem Gefährdungspotenzial“ durchgeführt und die beiden Passagiere verhaftet.

Weiterlesen nach der Anzeige

Denn bei dem Sturmgewehr handelte es sich um eine illegale „Geisterwaffe“, selbst hergestellt und ohne Seriennummer. Seit 2022 geht die US-Regierung gegen Geisterwaffen vor, etwa Schusswaffen aus 3D-Druckern, da diese aufgrund fehlender Registrierung kaum nachzuverfolgen sind. Ende 2024 wurde ein US-Versicherungschef mit einer Tatwaffe ermordet, die laut Polizei teils aus dem 3D-Drucker kam.

Das hat sich bei den beiden Robotaxi-Passagieren allerdings erst im Nachhinein herausgestellt. Laut bei Facebook von der Polizeidienststelle in San Francisco veröffentlichtem Bericht wurden die Beamten am 3. September um kurz vor 4 Uhr nachts über zwei Mitfahrer eines autonomen Fahrzeugs informiert, die eine Waffe tragen würden. Bei dem Zugriff wurde ein geladenes Sturmgewehr sichergestellt, bei dem es sich um eine Geisterwaffe handelte. Zudem wurden bei der Durchsuchung der beiden Jugendlichen, einer männlichen und weiblichen Person, vermutetes Marihuana und Pfefferspray gefunden.

Die Polizei hat den Betreiber des Robotaxis nicht namentlich genannt, aber laut Los Angeles Times handelte es sich um Waymo. Ein Sprecher des Unternehmens bestätigte dies der Zeitung. Das Fahrzeug habe angehalten, weil ein „Verstoß gegen unsere Nutzungsbedingungen unter Verwendung einer Schusswaffe“ festgestellt wurde, erklärte der Waymo-Sprecher. Das Unternehmen verständigte die Behörden und arbeitet demnach vollumfänglich mit der Polizei zusammen.

Weiterlesen nach der Anzeige

Waymo-Robotaxis verfügen über Innenraumkameras, die vorwiegend dazu dienen, dass die Fahrgastregeln eingehalten werden, etwa die Anschnallpflicht. Auch können damit verlorene Gegenstände wiedergefunden und die Sauberkeit des Fahrzeugs kontrolliert werden. Laut Waymo werden die Kameras nicht durchgehend von Mitarbeitern beobachtet, die Aufnahmen laufen im Hintergrund. Sollte es jedoch zu Vorfällen kommen, werden die Aufzeichnungen zu Überprüfungen herangezogen.

Allerdings nutzt das Waymo-System auch künstliche Intelligenz bei der Innenraumüberwachung und so wurde wohl auch die Schusswaffe erkannt. Diese KI wird mit bisherigem Videomaterial trainiert. In Staaten mit strengen Datenschutzgesetzen wie etwa Kalifornien können Fahrgäste der Nutzung eigener Videoaufnahmen und Daten für das KI-Training aber auch widersprechen. Das dürfte auch in Deutschland möglich sein, wenn Waymo Ende 2027 den Betrieb in München aufnimmt.

Lesen Sie auch


(fds)



Source link

Weiterlesen

Künstliche Intelligenz

Saudi-Arabien erwägt Fusion von Electronic Arts und Savvy Games


close notice

This article is also available in
English.

It was translated with technical assistance and editorially reviewed before publication.

Der saudische Staatsfonds PIF erwägt eine Fusion von Electronic Arts mit der eigenen Spieleholding Savvy Games Group, berichtet Bloomberg. Ein Zusammenschluss würde Spielereihen wie „EA FC“, „Battlefield“ und „Die Sims“ mit Mobile-Erfolgen wie „Pokémon Go“ und „Monopoly Go!“ in einem Unternehmen bündeln.

Weiterlesen nach der Anzeige

Führungskräfte des Fonds arbeiten an Plänen für eines der größten Spieleunternehmen der Welt, um die eigenen Beteiligungen besser aufeinander abzustimmen, schreibt Bloomberg mit Bezug auf anonyme Quellen. Entschieden sei aber nichts. Zu einem Zusammenschluss dürfte es demnach frühestens kommen, wenn Savvy den im März vereinbarten Kauf des chinesischen Mobile-Entwicklers Moonton für 6 Milliarden US-Dollar abgeschlossen hat. Der saudische Staatsfonds und Electronic Arts wollten sich gegenüber Bloomberg nicht äußern.

Die Savvy Games Group baut seit 2021 ein eigenes Spieleimperium auf und hat dafür 38 Milliarden US-Dollar vom PIF zugewiesen bekommen. Savvy hat 2023 den Mobile-Publisher Scopely für 4,9 Milliarden US-Dollar übernommen, Scopely wiederum kaufte 2025 das Spielegeschäft von Niantic für 3,5 Milliarden US-Dollar. Damit gehören „Pokémon Go“, „Pikmin Bloom“ und „Monster Hunter Now“ zum Portfolio des saudischen Spieleunternehmens.

Electronic Arts gehört dem PIF erst seit Kurzem: Die 55 Milliarden US-Dollar schwere Übernahme durch ein Konsortium um den Staatsfonds wurde Anfang August abgeschlossen, seitdem ist der Publisher nicht mehr börsennotiert. Auf den PIF entfallen 93,4 Prozent der Anteile, der Rest ging an mehrere Investment-Firmen.

Im Rahmen der Übernahme hat Electronic Arts Schulden in Höhe von knapp 20 Milliarden US-Dollar aufgenommen, die nun wieder eingespielt werden müssen. Zusätzliche Gewinnmöglichkeiten sieht EA in Werbeplatzierungen und Mikrotransaktionen in Einzelspieler-Modi.


(dahe)



Source link

Weiterlesen

Beliebt