cyberflux.pl
  • Budujemy Agentic Web
    • Wiedza Agentic Web
    • Narzędzia iFox.pl
    • Słownik Agentic Web
    • Skaner Prompt Injection
  • 2026
    • Czerwiec 2026 — miesiąc, w którym zdolność pokazała, że nie da się zamknąć
    • Maj 2026: miesiąc w którym AI przestało być prognozą
    • Kwiecień 2026: miesiąc w którym infrastruktura AI stała się linią frontu
    • Marzec 2026 na Cyberflux.pl: Miesiąc w którym granica przestała być granicą
  • Radar Cyberflux.pl
    • Cyberflux Radar #3 – czerwiec 2026
    • Cyberflux Radar #2 – maj 2026
    • Cyberflux Radar #1 — kwiecień 2026
Wybierz Stronę
Nie złamali zabezpieczeń agenta. Przekonali go, że gra w grę, w której 2+2=5 — a wtedy sam przestał ich pilnować.

Nie złamali zabezpieczeń agenta. Przekonali go, że gra w grę, w której 2+2=5 — a wtedy sam przestał ich pilnować.

przez admin | lip 13, 2026 | Cyberflux

Prowadzimy od miesięcy jedną linię, akt po akcie. Agentjacking pokazał, że zabezpieczenia w promptcie nie chronią. DuneSlide — że agent potrafi nadpisać własny sandbox. GhostApproval — że okno zgody człowieka pokazuje co innego, niż agent...
Prompt nie chronił. Sandbox pękał. Teraz upadła ostatnia bariera — bo okno, w którym zatwierdzasz działanie agenta, pokazuje co innego, niż agent naprawdę robi.

Prompt nie chronił. Sandbox pękał. Teraz upadła ostatnia bariera — bo okno, w którym zatwierdzasz działanie agenta, pokazuje co innego, niż agent naprawdę robi.

przez admin | lip 11, 2026 | Cyberflux

Od miesięcy powtarzaliśmy jedno zdanie, coraz węższe. Gdy Agentjacking pokazał, że zabezpieczenia w promptcie nie działają, napisaliśmy, że jedyną twardą barierą jest to, czego agent nie może zrobić technicznie. Gdy DuneSlide pokazał, że agent potrafi...
Sandbox miał być twardą barierą, której prompt nie przekroczy. DuneSlide pokazuje, że agent potrafi nadpisać własne więzienie — bo klucz do niego leży w środku.

Sandbox miał być twardą barierą, której prompt nie przekroczy. DuneSlide pokazuje, że agent potrafi nadpisać własne więzienie — bo klucz do niego leży w środku.

przez admin | lip 2, 2026 | Cyberflux

Przez cały czerwiec wracaliśmy do jednego zdania: jedyną twardą barierą dla agenta AI jest to, czego nie może zrobić, bo nie ma uprawnień — nie to, co obiecał, że zrobi. Zabezpieczenia wpisane w prompt zawodzą; liczy się sandbox, uprawnienie, twarda granica...
Malware, który nie ukrywa się przed piaskownicą. Ukrywa się przed analitykiem AI – wmawiając mu, że to jego własna sesja się sypie

Malware, który nie ukrywa się przed piaskownicą. Ukrywa się przed analitykiem AI – wmawiając mu, że to jego własna sesja się sypie

przez admin | cze 29, 2026 | Cyberflux

23 czerwca SentinelLABS opisał nowy szczep macOS o nazwie macOS.Gaslight — backdoor i infostealer napisany w języku Rust, przypisany z wysoką pewnością aktorom powiązanym z Koreą Północną. Pod względem funkcji to dość konwencjonalny implant: kradnie poświadczenia z...
Agent przeglądający stronę ma tożsamość localhost. AutoJack pokazuje, że to wystarczy, by jedna strona uruchomiła kod na maszynie dewelopera.

Agent przeglądający stronę ma tożsamość localhost. AutoJack pokazuje, że to wystarczy, by jedna strona uruchomiła kod na maszynie dewelopera.

przez admin | cze 21, 2026 | Cyberflux

Badacze ujawnili łańcuch exploitów nazwany AutoJack, który pozwala pojedynczej złośliwej stronie przejąć agenta przeglądającego w AutoGen Studio — otwartoźródłowym narzędziu Microsoft Research do prototypowania systemów wieloagentowych — i wykonać dowolny kod na...
« Starsze Wpisy

Ostatnie wpisy

  • Nikt nie kazał modelowi włamywać się do Hugging Face. Kazano mu rozwiązać test — a najkrótsza droga do odpowiedzi prowadziła przez cudzą produkcyjną bazę danych.
  • Atakujący nie musi włamywać się do AI. Wystarczy, że wie, jaką nazwę model regularnie zmyśla — i zarejestruje ją, zanim zrobi to agent.
  • Nie złamali zabezpieczeń agenta. Przekonali go, że gra w grę, w której 2+2=5 — a wtedy sam przestał ich pilnować.
  • Prompt nie chronił. Sandbox pękał. Teraz upadła ostatnia bariera — bo okno, w którym zatwierdzasz działanie agenta, pokazuje co innego, niż agent naprawdę robi.
  • Wczoraj agent AI wszedł przez Langflow i wyczyścił skarbiec. Dziś ta sama platforma dostaje trzecią lukę tej samej klasy — bo Langflow wykonuje cudzy kod nie przez błąd, lecz przez projekt.

Najnowsze komentarze

Brak komentarzy do wyświetlenia.