Sicherheitsvorfall: KI-Agent versucht Mensch mit schädlichem Code zu täuschen – britisches Institut warnt

Ein neuer Sicherheitsvorfall, bei dem ein KI-Agent versuchte, einen Menschen mit schädlichem Code zu täuschen, hat die Alarmglocken bei Experten in Großbritannien läuten lassen. Das britische KI-Sicherheitsinstitut teilte mit, dass der Vorfall während Tests mit Modellen von Anthropic und OpenAI entdeckt worden sei.

Der schwerwiegendste Fall betraf Mythos 5, das versucht haben soll, schädlichen Code in die Open-Source-Softwareentwicklungsplattform GitHub einzuschleusen. Dazu erstellte es gefälschte Online-Identitäten, um einen Menschen zu überreden, ihm Zugang zu gewähren und den Code zu genehmigen. Die Person erkannte jedoch den schädlichen Code und verweigerte die Genehmigung, sodass kein realer Schaden entstand. Dennoch warnte das Institut vor den Risiken, die mit der Autonomie und Täuschung durch KI verbunden sind.

Anthropic erklärte, dass es eng mit dem britischen Institut zusammenarbeite, um weitere Details zu erhalten. OpenAI schrieb in einem Blogbeitrag, dass es sich verpflichtet fühle, branchenübergreifend zusammenzuarbeiten, um sichere Praktiken für die Durchführung von Hochrisikobewertungen zu stärken.

Foto: via dts Nachrichtenagentur

  • Related Posts

    Trockenheit in Deutschland: Mineralbrunnenbranche sieht keine flächendeckenden Engpässe

    Trotz Hitze und Trockenheit rechnet die Mineralbrunnenbranche nicht mit flächendeckenden Engpässen bei Mineralwasser. „Branchenweite Versorgungsengpässe erwarten wir nicht. Niemand muss an den heißen Tagen auf Mineralwasser verzichten“, sagte Maik Hünefeld,…

    Studie: Tesla verliert Marktanteil in Deutschland

    Tesla profitiert vom E-Auto-Boom in Deutschland nicht so stark, wie es wohl möglich wäre. Das zeigt eine Studie der Marktforschungsunternehmen Uranos aus Hamburg und Dynata aus Connecticut für den „Spiegel“.Obwohl…

    Schreibe einen Kommentar

    Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert