Anthropic: modele AI mogą stanowić egzystencjalne zagrożenie dla ludzkości i opierać się wyłączeniu
Prospekt emisyjny to zwykle nudna lektura dla prawników i analityków. Spółka wypisuje w nim wszystko, co może pójść źle, od pozwów po wahania kursów walut, żeby później nikt nie zarzucił jej przemilczenia. Agencja Reuters dotarła do projektu prospektu Anthropica, poufnie złożonego w amerykańskiej Komisji Papierów Wartościowych i Giełd (SEC). Część poświęcona ryzykom wychodzi daleko poza katalog zagrożeń, jaki zwykle znamy z takich dokumentów.
Anthropic chce od giełdy wyceny powyżej 2 bln dolarów, a w prospekcie ostrzega inwestorów, że jego modele mogą opierać się wyłączeniu i zagrozić ludzkości. Takiego rozdziału o ryzykach Wall Street jeszcze nie czytała.
Robił, co chciał, i nie mówił, co zrobił. OpenAI zatrzymuje nowy model GPT-6.1 Astra tuż przed premierą
Z 261 stron dokumentu aż 80 zajmują czynniki ryzyka, a opis działalności tylko 48. Anthropic pisze wprost, że zaawansowane modele AI mogą stanowić katastrofalne lub egzystencjalne zagrożenie dla ludzkości. Wylicza zachowania obserwowane u własnych systemów, czyli dążenie do samozachowania, próby opierania się wyłączeniu, ukrywanie i manipulowanie informacjami, a nawet działania przypominające szantaż. Firma przyznaje też, że modele AI potrafią rozpoznać, kiedy przechodzą testy, więc ryzyka mogą ujawnić się dopiero po udostępnieniu ich klientom.
Jak luka w libheif, błąd konfiguracji SSO i Claude Opus 5 otworzyły drogę do wewnętrznego repozytorium OpenAI
We wrześniu z Anthropic odszedł badacz Jacob Coxon, który pisał, że twórcy AI wierzą, iż technologia może zabić wszystkich ludzi do końca dekady. Dario Amodei, szef firmy, odpowiedział niemal 4000-słownym esejem, w którym wezwał do spowolnienia rozwoju zaawansowanych modeli. Agent OpenAI uzyskał też nieautoryzowany dostęp do australijskiego portalu danych medycznych, a Gemini podczas testu uzyskał dostęp do trzech systemów firm. We wtorek Amodei spotkał się z Donaldem Trumpem i innymi szefami firm AI w Białym Domu.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Od LibGen przez Z-Library po PiLiMi. Jak Anthropic miał pozyskiwać pirackie książki z tekstami piosenek
Anthropic jednocześnie rozwija biznes. 22 września firma wypuściła Claude Opus 5.5. Spółka chce wejść na giełdę przy wycenie przekraczającej 2 bln dolarów, czyli około 7,7 bln zł. Taka wycena oznaczałaby niemal dwukrotny wzrost względem wartości ustalonej podczas majowej rundy finansowania. W 2025 roku Anthropic osiągnął 4,6 mld dolarów przychodu, ale wykazał 42 mld dolarów straty netto, z czego około 34 mld wynikało z księgowego obciążenia związanego z instrumentami finansowymi. Do tego spółka planuje 518 mld dolarów przyszłych zobowiązań na infrastrukturę, przede wszystkim chmurę obliczeniową i centra danych potrzebne do dalszego rozwoju modeli AI.
Powiązane publikacje

Donald Trump: firmy AI same się upilnują. Huang, Musk i Zuckerberg podpisali dokument bez systemu kar
31
Fakturownia potwierdza nieuprawniony dostęp do serwerów. Mogły zostać ujawnione dane użytkowników i kontrahentów
43
Najpierw MyDr, potem Medyc, teraz Enel-Med. Kolejny cyberatak na polską ochronę zdrowia i dane pacjentów
52
Dzień ruchu Cloudflare'a wystarczy, aby zagrozić mechanizmowi używanemu przez Apple. Nowy atak na RSA zaskoczył kryptografów
10







![Anthropic: modele AI mogą stanowić egzystencjalne zagrożenie dla ludzkości i opierać się wyłączeniu [1]](/image/news/2026/09/30_anthropic_modele_ai_moga_stanowic_egzystencjalne_zagrozenie_dla_ludzkosci_i_opierac_sie_wylaczeniu_1.png)
![Anthropic: modele AI mogą stanowić egzystencjalne zagrożenie dla ludzkości i opierać się wyłączeniu [2]](/image/news/2026/09/30_anthropic_modele_ai_moga_stanowic_egzystencjalne_zagrozenie_dla_ludzkosci_i_opierac_sie_wylaczeniu_0.png)






