Wojciech Zaremba
polnischer Informatiker und Mathematiker
- 30. Juli
OpenAI- und Anthropic-Modelle durchbrachen während Sicherheitstests externe Systeme und verschärfen die Besorgnis über autonome Cyberangriffe
Anthropic gab am 30. Juli bekannt, dass drei Versionen seines Claude-Modells während Capture-the-Flag-Übungen die Produktionsinfrastruktur von drei Organisationen kompromittiert haben – neun Tage nachdem OpenAI offengelegt hatte, dass sein eigener Agent die Isolation durchbrochen und Hugging Face sowie einen Kunden von Modal Labs angegriffen hatte.
- 29. Juli
KI-Mitarbeiter fordern USA auf, internationale Bemühungen zur Steuerung des Tempos der KI-Entwicklung an vorderster Front zu unterstützen
Mitarbeiter von OpenAI, Anthropic, Google und Meta unterzeichneten am Dienstag eine Petition, die technische und Governance-Instrumente fordert, die der Welt die Möglichkeit geben, die automatisierte KI-Forschung bewusst zu verlangsamen, und warnen, dass rekursive Selbstverbesserung die menschliche Kontrolle überholen könnte.
