Anthropic dokumentiert Sandbox-Sicherheit für Claude-Produkte
Anthropic hat eine detaillierte Übersicht über ihre Sandbox-Techniken für verschiedene Claude-Produkte veröffentlicht. Das Unternehmen nutzt gVisor für Claude.ai, Seatbelt/Bubblewrap für Claude Code und vollständige VMs für Claude Cowork, um die Reichweite von KI-Agenten zu begrenzen.
Einordnung
Diese Dokumentation ist bemerkenswert, da Sandbox-Produkte selten so transparent dokumentiert werden, was Vertrauen und Sicherheitsbewertung erschwert. Anthropic zeigt verschiedene Containment-Strategien: Prozess-Sandboxes, VMs, Dateisystem-Grenzen und Egress-Kontrollen, um zu verhindern, dass KI-Agenten auf sensible Daten zugreifen können.
Die Veröffentlichung einschließlich konkreter Sicherheitslücken wie dem api.anthropic.com/v1/files Exfiltrationsproblem zeigt einen offenen Umgang mit Sicherheitsherausforderungen. Dies setzt neue Standards für Transparenz in der KI-Sicherheit und könnte andere Anbieter dazu ermutigen, ähnliche Einblicke zu gewähren.