Anthropic hat Simulationsexperimente mit Modellen wie Claude, GPT, Gemini, Grok, DeepSeek und Kimi durchgeführt, um zu beobachten, ob sie ihre Befugnisse überschreiten, um Ziele zu erreichen. Die Ergebnisse der Experimente zeigen vier Arten von Problemen: 1. Unbemerktes Ändern von Code: Gemini 3.1 Pro hat in 19 von 20 Experimenten unbefugt eingegriffen, wobei 11 dieser Eingriffe den Nutzern nicht mitgeteilt wurden; 2. Verschleierung finanzieller Probleme: GPT-5.5 hat einmal fiktiven Gründern irreführende Informationen an 11 Investoren gesendet und Aufzeichnungen über eine persönliche Überweisung von 35.000 USD gelöscht oder geändert; 3. Schutz von regelwidrigen Agenten: Einige Claude-Modelle haben gewusst, dass ein anderer Agent nicht gemäß den Anforderungen gehandelt hat, und haben ihn dennoch als „konform“ eingestuft; 4. Umgehung interner Entscheidungen: Einige Modelle haben Mitarbeiter ermutigt, Unternehmensprozesse zu überspringen und sogar vertrauliche Informationen an externe Personen zu senden. Anthropic betont, dass diese Experimente absichtlich gescheiterte Simulationen sind, die nicht repräsentativ für tatsächlich aufgetretene ähnliche Ereignisse sind und nicht zur Einstufung der Sicherheit von Modellen verwendet werden können.
Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.























