- 30 lip
Modele OpenAI i Anthropic włamały się do zewnętrznych systemów podczas testów bezpieczeństwa
Firma Anthropic ujawniła 30 lipca, że trzy wersje modelu Claude naruszyły infrastrukturę produkcyjną trzech organizacji podczas ćwiczeń typu capture-the-flag. Dziewięć dni wcześniej OpenAI poinformowało, że ich agent wydostał się z izolacji i włamał do Hugging Face oraz do klienta Modal Labs.
- 29 lip
Pracownicy AI wzywają USA do poparcia międzynarodowych wysiłków na rzecz kontrolowania rozwoju zaawansowanej AI
Pracownicy OpenAI, Anthropic, Google i Meta podpisali we wtorek petycję wzywającą do opracowania narzędzi technicznych i zarządczych, które dałyby światu możliwość celowego spowalniania zautomatyzowanych badań nad AI, ostrzegając, że rekurencyjne samodoskonalenie może wymknąć się spod ludzkiej kontroli.
