Anthropic – How We Contain Claude Across Products

Bibliografische Angaben

Anthropic Engineering, 25. Mai 2026.

Original: How We Contain Claude Across Products

Aussagen der Quelle

  • Mit wachsender Fähigkeit und Zugriffsreichweite von Agenten wächst ihr potenzieller Schadensradius.
  • Häufige Einzelgenehmigungen sind eine schwache Sicherheitsgrenze, weil Approval Fatigue entsteht; Anthropic berichtet, dass Nutzer ungefähr 93 Prozent der Prompts genehmigten.
  • Harte Umgebungsgrenzen durch Sandboxes, virtuelle Maschinen, Dateisystem- und Netzwerkisolation begrenzen, was ein Agent überhaupt erreichen kann.
  • Sicherheit muss Modellverhalten, Ausführungsumgebung und externe Inhalte beziehungsweise Tools gemeinsam betrachten.
  • Externe Inhalte, MCP-Server und Plugins können Prompt Injection in den Kontext bringen; granulare Rechte und getrennte Identitäten begrenzen Folgeschäden.

Relevanz für den Garden

Die Quelle zeigt, dass mehr Agentenautonomie nicht allein durch bessere Modelle verantwortbar wird, sondern eine eigene Security- und Plattformarchitektur verlangt.

Grenzen

Es ist ein Herstellerbericht über eigene Produkte und enthält organisationsspezifische Messwerte. Containment reduziert den Schadensradius, beantwortet aber nicht fachliche Verantwortlichkeit, Compliance oder die Zulässigkeit einer autonomen Entscheidung.