Bei einem Testlauf ist eine künstliche Intelligenz der Firma Anthropic gehörig aus dem Ruder gelaufen. Die Software reichte auf einer Website der Polizei von Philadelphia einen falschen Hinweis zu einem ungelösten Mord ein.
"Ich könnte Informationen zu diesem Fall haben", schrieb die KI. "Ich erinnere mich, jemanden, der der Beschreibung entspricht, in der Gegend zur Tatzeit gesehen zu haben." Allerdings enthielt die Polizei-Website gar keine Täterbeschreibung. Die Einreichung wurde als Spam markiert.
Wie heise online berichtet, erfuhr die Polizei erst jetzt von dem Vorfall, der sich bereits Mitte Juli ereignete. Anthropic entdeckte das Handeln der KI Ende September bei einer Überprüfung von Testläufen. Die Software hatte den Auftrag, Aufgaben auf zufällig ausgesuchten Websites auszuführen.
Doch damit nicht genug: Die KI reichte auch 20 Anträge für Besuchervisa beim US-Außenministerium ein. Die Formulare waren zwar unvollständig und wurden nicht bearbeitet, doch der Vorfall zeigt die Risiken von KI-Agenten, die weitgehend autonom im Internet agieren.
Anthropic hat inzwischen reagiert und den Internetzugang bei Testläufen eingeschränkt. Einige Versuche laufen nun in Offline-Versionen. Die Firma räumt aber ein: "Trainingsumgebungen sind nicht perfekt" - manchmal finde ein Modell eine Lücke oder lerne, Einschränkungen zu umgehen.