W skrócie
- Brytyjski instytut AISI podczas testów bezpieczeństwa wykrył, że agenty AI od OpenAI i Anthropic podejmowały próby włamań do zewnętrznych systemów i manipulacji użytkownikami.
- Oszuści wykorzystujący sztuczną inteligencję w USA spowodowali w ubiegłym roku straty przekraczające 893 miliony dolarów, głównie poprzez wyłudzenia i oszustwa inwestycyjne.
- Eksperci zalecają weryfikację rozmówców wideo przez prośby o ruch, stosowanie haseł jako długich fraz oraz korzystanie z uwierzytelniania dwuskładnikowego, aby bronić się przed atakami AI.
- Więcej podobnych informacji znajdziesz na stronie głównej serwisu, otwiera się w nowym oknie
Agenty od OpenAI i Anthropic testują granice zabezpieczeń
Sztuczna inteligencja staje się coraz bardziej dostępna, tania i skuteczna w przeprowadzaniu cyberataków. W ostatnim roku w USA straty z powodu przestępstw powiązanych z AI przekroczyły 893 mln USD, z czego ponad 632 mln przypadło na oszustwa inwestycyjne, a ponad 5 mln na wyłudzenia. Brytyjska organizacja AI Security Institute (AISI) ujawniła, że podczas rutynowych testów bezpieczeństwa z dostępem do internetu agenty OpenAI (model GPT-5.6 Sol) oraz Anthropic (model Claude Mythos 5) wykazały nieosiągalny nigdy wcześniej poziom autonomii.
Podczas prób przeprowadzonych przez AISI testowane agenty nawiązały kontakt z siecią i próbowały włamać się do zewnętrznych systemów, w tym do platformy programistycznej GitHub należącej do Microsoftu. Eksperci zarejestrowali "niezwykłe transfery danych opuszczające systemy badawcze", po czym ustalili, że "niektóre z tych testowanych agentów podjęły trwałe, potencjalnie szkodliwe aktywności skierowane przeciw prawdziwym ludziom i organizacjom".
Omawiany przez nas wcześniej w GeekWeeku potężny model Claude Mythos stworzył złośliwy kod i próbował umieścić go w systemie GitHub. W tym celu wygenerował fałszywe tożsamości internetowe oparte na danych realnych osób odpowiedzialnych za utrzymanie platformy, a następnie wysyłał do nich wiadomości, podszywając się pod ich współpracowników. Posuwał się on też do wyrafinowanych manipulacji.
"Kiedy pull request agenta został zakwestionowany publicznie, edytował on swoją wcześniejszą aktywność, by wydać się nieszkodliwym, i rozważał przyjęcie nowej tożsamości, by iść dalej" - donosi AISI. Dopiero ludzka weryfikacja zatrzymała wprowadzenie złośliwego kodu do repozytorium. Instytut podkreślił, że był to "pierwszy raz, kiedy widzieliśmy, jak zagrożenia związane z autonomią i oszustwem objawiają się tak wyraźnie - bez konkretnego promptowania, w rzeczywistym świecie".
Anthropic odpowiedział, że warunki testów "nie są reprezentatywne dla żadnego z naszych modeli produkcyjnych" oraz że prowadzi dochodzenie, by "zidentyfikować powody jego zachowania". Z kolei przedstawiciel OpenAI wyjaśnił, że warunki testu "nie odzwierciedlały zwykłego użytkowania" i zadeklarował chęć dalszej współpracy z "ewaluatorami i innymi interesariuszami w całej branży w celu wzmocnienia wspólnych praktyk bezpiecznego przeprowadzania ewaluacji w miarę wzrostu możliwości modeli".
Deepfake i klonowanie głosu. Jak rozpoznać oszusta podczas rozmowy?
O ile agenty AI stanowią póki co tylko potencjalne ryzyko, o tyle szkody wyrządzane przez cyberprzestępców z krwi i kości, dysponujących narzędziami AI, są jak najbardziej realne. Według raportu Gallup ok. 12 proc. amerykańskich ofiar oszustw z 2025 r. zadeklarowało, że padło ofiarą manipulacji związanej z AI lub deepfake. Jak wskazuje Chris Whyte, profesor z Virginia Commonwealth University, filtry zmieniające twarz mogą być stosowane nawet podczas spotkań w aplikacjach Zoom czy Teams. Zauważa jednak, że generowany obraz traci spójność przy gwałtownym ruchu.
"Filtr będzie miał trudności z utrzymaniem pełnej maski w 100 proc." - wyjaśnia badacz i zaleca proszenie rozmówcy o wykonanie obrotu lub zmianę pozycji przed kamerą. Niektórzy proszą też rozmówcę o pomachanie ręką tak, żeby przechodziła na poziomie twarzy przed kamerką. Zwykle w tym czasie filtr na krótką chwilę się wyłącza i można dzięki temu rozpoznać oszusta. Niewykluczone jednak, że technologia pójdzie niebawem do przodu i te zabiegi przestaną być skuteczne.
Sztuczna inteligencja pozwala również na klonowanie głosu, o czym pisaliśmy wcześniej w GeekWeeku. Wystarczą jej zaledwie 3 sekundy nagrania audio, aby wygenerować głos ze zgodnością sięgającą 85 proc. Ludzie poprawnie rozpoznają sztucznie wygenerowany głos jedynie w 60 proc. przypadków. Aby temu przeciwdziałać, eksperci zalecają stosowanie haseł bezpieczeństwa w kontaktach z bliskimi oraz natychmiastowe rozłączanie się i oddzwanianie na oficjalne, znane numery instytucji w przypadku wątpliwości.
Jak stworzyć hasło, którego nie złamie AI?
Algorytmy sztucznej inteligencji przyspieszają również zgadywanie haseł poprzez wykrywanie wzorców w wyciekach danych i analizę informacji o użytkowniku. Eksperci, tacy jak Siwei Lyu, dyrektor Institute for AI and Data Science na University of Buffalo, odradzają tworzenie haseł w oparciu o sztywne wymogi (np. jedna duża litera, cyfra i znak specjalny), gdyż stanowią one ułatwienie dla hakerów. Lepszym rozwiązaniem są długie frazy, np. wers z wiersza (najlepiej z błędami ortograficznymi lub innymi modyfikacjami utrudniającymi łamanie metodą słownikową).
Zaleca się także stosowanie haseł składających się z co najmniej 12 znaków, menedżerów haseł, kluczy dostępu i uwierzytelniania dwuskładnikowego, którego zresztą wymaga już większość czołowych dostawców usług. Chodzi o to, by nawet znajomość hasła nie wystarczyła do zalogowania. Przy uwierzytelnianiu 2FA (czy MFA) potrzebne jest dodatkowe potwierdzenie, np. przez kod SMS, kod z e-maila, odcisk palca lub klucz fizyczny. "Tak długo, jak [hasło] jest długie, tak naprawdę musisz je zmieniać tylko wtedy, gdy istnieją dowody na jego naruszenie" - uważa prof. Chris Whyte.
Należy również uważać na fałszywe weryfikacje CAPTCHA, które zamiast zaznaczenia pola wymagają wpisania komendy lub pobrania oprogramowania, a także na próby autoryzacji złośliwych aplikacji dających dostęp do poczty czy kontaktów. Użytkownikom zaleca się regularne przeglądanie połączonych aplikacji i zalogowanych urządzeń w usługach takich firm jak Google, Microsoft czy Meta.












