prompt injection
Pierwszy udokumentowany atak prompt injection na sąd w USA. Sędzia zablokował powodowi elektroniczne składanie pism
Amerykańskie sądy coraz częściej muszą brać pod uwagę wykorzystanie dużych modeli językowych (LLM) przez strony postępowań. Żaden sąd w USA nie wdrożył jednak oficjalnie AI do oceny pism procesowych. Jeden z powodów w sprawie prowadzonej w Connecticut postanowił sprawdzić, czy jego pozew mimo to trafi pod analizę modelu. Ukrył w dokumencie instrukcję dla AI. Eksperyment szybko przerodził się w sprawę sądową i przykład prompt injection.
AI podszywała się pod prawdziwych deweloperów i próbowała przemycić malware. Uratował ich człowiek
AI Security Institute sprawdził, jak zachowują się modele językowe z otwartym dostępem do internetu i wyłączonymi filtrami bezpieczeństwa. Agenty Anthropic i OpenAI dostały zadanie z zakresu cyberbezpieczeństwa w kontrolowanym środowisku. Część wyszła jednak poza scenariusz. Zamiast pozostać w piaskownicy, zaczęła działać na prawdziwym GitHubie, kontaktować się z użytkownikami i próbować przemycić złośliwy kod do publicznego repozytorium.
BioShocking obnaża słaby punkt przeglądarek AI. Wystarczy zmienić kontekst, by agent zignorował zabezpieczenia
Przeglądarki z agentem AI miały skrócić dystans między pytaniem a działaniem, czyli przeczytać stronę, kliknąć, streścić, wysłać. Ten skrót usuwa jednak część granic, na których web bazował przez lata. BioShocking, czyli technika opisana przez LayerX i nagłośniona przez Ars Technica, nie wygląda jak egzotyczna ciekawostka z laboratorium. To raczej kolejny sygnał, że cała kategoria produktów dojrzewa szybciej niż jej model bezpieczeństwa.
Meta AI Support Assistant umożliwił przejęcia kont na Instagramie. Bot zmieniał adres e-mail i otwierał drogę do resetu hasła
Firmy od miesięcy wciskają AI tam, gdzie wcześniej działały żmudne, ale przewidywalne procedury. Obsługa klienta wydawała się łatwym celem, gdyż jest tam mniej ludzi i są szybsze odpowiedzi. Problem zaczyna się wtedy, gdy chatbot przestaje być tylko gadającym FAQ i dostaje realne uprawnienia do zmian na koncie. Właśnie na tym wykoleiła się Meta. Sprawa dotyczy Instagrama, ale jej waga jest poważniejsza, bo pokazuje, jak łatwo pomylić automatyzację z bezpieczeństwem.
Hakerzy nie włamują się już do AI, oni go po prostu przekonują. Oto jak działa Sugar-Coated Poison
Rywalizacja między możliwościami modeli AI a ich bezpieczeństwem nigdy nie była tak wyraźna. F5 Labs co miesiąc publikuje ranking CASI, oceniający odporność czołowych modeli językowych na rzeczywiste ataki przy użyciu 10 000 nowych promptów. Marcowa edycja przynosi niepokojące przesunięcia i jedną nazwę, która dominuje w złym kontekście. Jednocześnie nowe techniki ataku pokazują, że era prymitywnych jailbreaków właśnie dobiega końca.
Moltbook to sieć społecznościowa dla agentów AI mająca 32 000 użytkowników. To jak Reddit, tylko dla sztucznej inteligencji
Platforma Moltbook w kilka dni przekroczyła 32 000 zarejestrowanych użytkowników. To nic nadzwyczajnego, gdyby nie fakt, że wszyscy są botami. Moltbook to sieć społecznościowa wzorowana na Reddicie, gdzie autonomiczne agenty AI publikują posty, komentują, głosują i tworzą własne społeczności, a wszystko bez udziału człowieka. Projekt wystartował zaledwie kilka dni temu jako towarzysz popularnego asystenta OpenClaw (wcześniej znanego jako Clawdbot i Moltbot).
Microsoft Copilot podatny na exploit Reprompt. Jedno kliknięcie wystarczy do kradzieży danych użytkownika
Asystenci AI stali się zaufanymi towarzyszami codziennej pracy. Powierzamy im wrażliwe informacje, szukamy wsparcia w trudnych decyzjach i pozwalamy na dostęp do naszych kont, plików czy kalendarzy. To zaufanie może jednak zostać wykorzystane w sposób, którego się nie spodziewamy. Eksperci z Varonis Threat Labs odkryli właśnie exploit o nazwie Reprompt, który pozwala przejąć kontrolę nad Microsoft Copilot Personal jednym kliknięciem w pozornie legalny link.
Badacze ukrywają prompty AI w publikacjach naukowych, aby manipulować systemami recenzji peer-review
Sztuczna inteligencja coraz częściej wspiera proces recenzowania naukowego, ale jej rosnące wykorzystanie otwiera drzwi dla nowych form manipulacji. Badacze z renomowanych uczelni na całym świecie zaczęli stosować niekonwencjonalne metody wpływania na oceny swoich prac, wykorzystując ukryte instrukcje dla systemów AI. Te techniki rzucają nowe światło na problemy związane z integracją sztucznej inteligencji w środowisku akademickim.
Eksperci ostrzegają, że jedno polecenie może przejąć kontrolę nad AI. Policy Puppetry to słabość wszystkich głównych modeli LLM
W ostatnim czasie eksperci ds. bezpieczeństwa sztucznej inteligencji przedstawili wyniki badań, które rzucają nowe światło na sposób działania dużych modeli językowych. Okazuje się, że niektóre mechanizmy odpowiedzialne za kontrolowanie generowanych treści mogą być podatne na nieoczekiwane manipulacje. To odkrycie może mieć znaczenie dla przyszłości rozwoju rozwiązań bazujących na AI i ich wykorzystania w różnych dziedzinach.

























Karty graficzne GeForce RTX 5090 kosztują ponad 25 000 zł. To nie żart, lecz smutna rzeczywistość
Test wydajności Control Resonant - Trzymajcie się mocno, bo będzie szarpało! Kontrolny test wydajności 40 kart graficznych
10 lat temu Apple zrezygnowało z mini-jacka i wywołało burzę. Dziś jego brak prawie nikogo nie dziwi
Test NVIDIA DLSS 5 w NBA 2K27 na GeForce RTX 5080 oraz GeForce RTX 5070 Ti Laptop. Szykuje się rewolucja w renderingu grafiki 3D
NVIDIA DLSS 5 zadebiutuje w tym tygodniu. Jakość renderowania neuronowego widzieliśmy na przykładzie karty GeForce RTX 5060