Post #4467582
2026-08-05 15:01 UTC
Man sei davon ausgegangen, dass die KI sich nur Software-Werkzeuge aus dem Netz holen würde, um die gestellte Aufgabe zu erfüllen. Man habe «nicht vorhergesehen», dass das Anthropic-Modell Mythos 5 den Internet-Zugang für Aktivitäten ausnutzen würde, die sich gegen Menschen richten.
https://www.tagesanzeiger.ch/anthropic-ai-manipulierte-menschen-per-email-in-sicherheitstest-103644639021
Replies (1)
-
@well030@mastodon.online 2026-08-05 15:34
@buercher@tooting.ch Entweder hat jemand der KI in irgendeiner Form gesagt, dass sie das tun soll, oder die KI ist nicht in der Lage, Anweisungen auch nur einigermaßen korrekt auszuführen. Im zweiten Fall wäre sie nicht wirklich für die hier getesteten Zwecke einsetzbar, denn du willst ja, das sie das tut, was du brauchst und nicht etwas ganz anderes, wie beeindruckend das andere dann auch sein mag.