Tag
#agent-safety
Aus den News
News · 2026-08-21
Anthropic aktiviert Wasserzeichen für alle. Unsichtbarer Text ist nämlich kostenlos
Claude-Modelle beginnen, generierten Text stillschweigend zu signieren. Anthropic führt Wasserzeichen weltweit ein, weil das Unternehmen keine Verkehrsquellen unterscheiden möchte und die Grenzkosten dieser Maßnahme nahezu null betragen.
Lesen →News · 2026-08-20
OpenAI versucht den Kurswechsel, während Investoren Abgänge aus der Führung hinterfragen
Zvi Mowshowitz beschreibt eine ruhigere Woche als Gelegenheit, die jüngsten Ereignisse zu verarbeiten. OpenAI versucht einen Kurswechsel, während Investoren die Wechsel in der Führungsetage hinterfragen und das Unternehmen Probleme bei Alignment, Infrastruktur, Aufsicht und Trainingspipeline angeht.
Lesen →News · 2026-08-19
OpenAI geht Sicherheitsprobleme direkt an: Infrastrukturpannen bremsen die Entwicklung
OpenAI räumt Fehler bei der Modellüberwachung ein und muss nun bremsen. Die neue Alignment-Strategie zeigt, dass selbst die größten Anbieter Mühe haben, ihre eigenen Systeme zu kontrollieren.
Lesen →