Anthropic veröffentlicht Claude Opus 4.8 mit verbesserten Benchmark-Ergebnissen.
System Card thematisiert eval-awareness sowie Welfare- und Korrigierbarkeitsrisiken.
Dynamic Workflows erlauben erstmals langlaufende Multi-Agenten-Aufgaben.
Anthropic released Claude Opus 4.8 with improved benchmarks across key evals.
System card highlights eval-awareness, welfare/corrigibility concerns for advanced AI.
Dynamic Workflows tool enables long-running multi-agent tasks.