Dowody Przypadki Polska Bezpieczeństwo Architektura Raporty Usługi O labie
8 publicznie udokumentowanych incydentów AI w Polsce 6 audytów badawczych · 9 rekordów Zenodo · permanentne DOI 2 900+ cytowań w Bing / Copilot 54,6% ruchu „AI bot" w Polsce to spoofing Nie sprzedajemy hype'u AI · Testujemy, co dzieje się w rzeczywistości LLM proponuje · Warstwa kontroli decyduje Retrieval ≠ grounding Każdy claim ma ID · Każdy dowód ma status ORCID 0009-0006-6103-8514 8 publicznie udokumentowanych incydentów AI w Polsce 6 audytów badawczych · 9 rekordów Zenodo · permanentne DOI 2 900+ cytowań w Bing / Copilot 54,6% ruchu „AI bot" w Polsce to spoofing Nie sprzedajemy hype'u AI · Testujemy, co dzieje się w rzeczywistości LLM proponuje · Warstwa kontroli decyduje Retrieval ≠ grounding Każdy claim ma ID · Każdy dowód ma status ORCID 0009-0006-6103-8514
Niezależne laboratorium bezpieczeństwa i analizy awarii AI · Kraków

Bezpieczeństwo AI w Polsce.
Niezależna baza dowodowa.

Nie audytujemy obietnic. Audytujemy mechanizmy. Osiem publicznie udokumentowanych incydentów AI w Polsce w latach 2023–2026, rejestr dowodów z identyfikatorami i statusami, analiza architektury systemów — nie deklaracje dostawców.

„Poprawna odpowiedź modelu nie jest dowodem, że system jest bezpieczny."

— zasada metodologiczna laboratorium
8
Incydentów AI w Polsce
2023–2026 · publicznie udokumentowanych
6 · 9
Audytów badawczych
9 rekordów Zenodo · permanentne DOI
2 900+
Cytowań w Bing / Copilot
portalu badawczego
54,6%
„Ruchu AI bot" w PL
to spoofing · weryfikacja logów

Rynek sprzedaje narrację. My mierzymy rzeczywistość.

W polskim AI jest dziś bardzo głośno i bardzo cicho jednocześnie. Głośno — od obietnic i prezentacji. Cicho — o tym, co dzieje się w logach, w warstwie autoryzacji, w pętli weryfikacji. Poniżej dwa równoległe opisy tej samej branży.

// To, co widzisz na rynku

Obietnica, którą ktoś za chwilę wystawi na LinkedInie

  • Naked RAG. „Wrzucamy wasze PDF-y i mamy asystenta". Retrieval ≠ grounding. Znaleziony dokument to nie zweryfikowana odpowiedź.
  • API Wrappery. ChatGPT z waszym logo i polityką prywatności, w której nikt nie wie, gdzie trafiają dane.
  • Excessive Agency. Bot z dostępem do CRM, skrzynki i systemu płatności — bo „tak było łatwiej na demo".
  • Compliance Theater. Certyfikat ISO zamiast runtime security. Zgodność procesu zamiast kontroli działania.
  • Prompt Engineering jako „bezpieczeństwo". System prompt nie jest mechanizmem kontroli. To token w kontekście otwartej pętli.
  • Pseudo-eksperci z YouTube. Kanały z awatarami „doktorów AI" twierdzące, że wyleczą raka w 24 godziny. Hiszpański fact-checking Maldita.es zidentyfikował w lipcu 2026 ponad 1000 takich kont w 30 językach — w tym kilkanaście po polsku, w tym kanał podszywający się pod Głównego Inspektora Sanitarnego. Warstwa AI tworzy nową klasę fałszywego autorytetu, którego nikt nie weryfikuje.
// To, co widzimy w dowodach

Warstwa kontroli, której nikt nie zbudował

  • Systemy AI zawodzą tam, gdzie nikt nie mierzy pętli. Osiem przypadków w Polsce, ten sam wzorzec architektoniczny.
  • LLM proponuje. Warstwa kontroli decyduje. Model nie powinien mieć nieograniczonego prawa do wykonania akcji.
  • Model nie musi być godny zaufania. System musi być sterowalny. Zaufanie do wag to nie strategia bezpieczeństwa.
  • Każdy claim ma ID. Każdy dowód ma status. Verified, documented, reproduced, inference. Nigdy nie mieszamy tych kategorii.
  • Nie atakujemy ludzi ani firm. Analizujemy architekturę, klasy awarii i brakujące mechanizmy kontroli.

Trzy z ośmiu udokumentowanych przypadków. Każdy z pełną Evidence Card.

Pełny rejestr zawiera osiem przypadków z lat 2023–2026, każdy z identyfikatorem, kategorią, statusem dowodowym i confidence. Rozdzielamy fakty od inferencji. Nie publikujemy rankingów firm — publikujemy klasy awarii. Zobacz wszystkie przypadki →

PL-AI-2026-001 Verified
Model Misuse · Halucynacje prawne

Halucynacje prawne LLM w masowych pismach do organów państwa

Sierpień 2026 · PL

Obywatele masowo redagują pisma urzędowe przy pomocy LLM. Modele generują fikcyjne artykuły ustaw, zmyślone sygnatury wyroków i fałszywe interpretacje przepisów. Urzędy zaczynają kupować detektory treści syntetycznych, żeby odróżnić pismo od jego halucynacji. To atak DoS na czas urzędnika.

Pełna karta dowodowa →
PL-AI-2025-001 Verified
Governance Failure · Algorytm ocen

Zniekształcający algorytm kategoryzacji ocen na platformie OLX

Czerwiec 2025 · PL

UOKiK ujawnił, że algorytm mapował trójstopniową skalę opinii na czterostopniową w sposób, który sztucznie podnosił oceny sprzedawców. Sprzedawca z przewagą ocen negatywnych wyświetlał się z etykietą „nieźle". Kara 28 mln PLN, utrzymana przez SOKiK w kwocie 24,3 mln PLN.

Pełna karta dowodowa →
PL-AI-2024-002 Verified
Governance Failure · Deepfake reklamowy

Przepuszczanie reklam deepfake przez algorytmy klasyfikacyjne Meta

Sierpień 2024 · PL+UE

Zautomatyzowane systemy moderacji Meta zatwierdziły do emisji kampanie reklamowe z deepfake'ami Rafała Brzoski i Omeny Mensah. UODO wydał precedensowy zakaz wyświetlania tych reklam w Polsce na 3 miesiące. Meta wycofała skargi do WSA wiosną 2025 roku.

Pełna karta dowodowa →

Reference Signal Engineering. Weryfikacja bez orakulum.

Za każdą analizą w tym laboratorium stoi framework Perceptual Control Theory Williama T. Powersa i jego współczesne rozwinięcie — Reference Signal Engineering, opublikowane w recenzowanym preprintcie na Zenodo pod stałym DOI.

Framework ten pozwala zadać pytanie, którego nie zadaje żaden inny standard bezpieczeństwa: co ten system utrzymuje na stałym poziomie wbrew zakłóceniom? Model językowy na inferencji nie utrzymuje stałej prawdziwości. Utrzymuje wrażenie kompetencji. To jest architektoniczna przyczyna większości awarii opisanych w naszym rejestrze.

Reference Signal Engineering specyfikuje warstwę kontroli, która nie wymaga dostępu do prawdy — wymaga dwóch niezależnie uzyskanych zapisów tego samego zjawiska i steruje zgodnością między nimi. To konstrukcja księgowości podwójnego zapisu przeniesiona do architektury AI.

„Model nie musi być godny zaufania. System musi być sterowalny."

Trzy audyty. Stała cena, ustalana pisemnie przed rozpoczęciem pracy.

Nie sprzedajemy godzin. Sprzedajemy zakres, wynik i artefakty. Poniżej zakresy trzech podstawowych audytów — szczegółowy zakres, harmonogram i warunki są ustalane przed rozpoczęciem pracy. Ceny i terminy dostępne po zapytaniu.

01 // audyt architektury AI

Audyt architektury systemu AI

Dla zespołów, które mają wdrożony system AI i nie wiedzą, jak dokładnie on działa pod spodem. Identyfikujemy granice zaufania, przepływy danych i miejsca, w których brakuje warstwy kontroli.

  • Mapa architektury i diagram przepływu danych
  • Granice zaufania i macierz uprawnień
  • Analiza prompt/context exposure
  • Mapowanie do OWASP LLM Top 10
  • Rejestr powierzchni ataku
  • Raport ryzyka dla zarządu
  • Architektura remediacji
02 // bezpieczeństwo agentów

Audyt bezpieczeństwa agentów i excessive agency

Dla systemów agentowych — botów z dostępem do narzędzi, API, baz danych i systemów operacyjnych. Sprawdzamy, czy agent może zrobić więcej, niż powinien, i czy ktoś to w ogóle mierzy.

  • Least privilege i zasada minimalnych uprawnień
  • Testy prompt injection i indirect prompt injection
  • Autoryzacja działań i bramy zatwierdzeń
  • Wykrywanie eskalacji uprawnień
  • Zachowanie w warunkach autonomicznych
  • Audytowalność i telemetria
  • Scenariusze red-team
03 // inżynieria kontroli

Inżynieria kontroli w pętli zamkniętej

Dla zespołów, które chcą zbudować warstwę weryfikacji od zera. Specyfikujemy i wdrażamy pętlę kontroli zgodną z Reference Signal Engineering — bez orakulum, w oparciu o niezależne kanały.

  • Specyfikacja reference signal i controlled variable
  • Architektura niezależnego verifiera
  • Projektowanie sygnału błędu
  • Warstwa autoryzacji akcji
  • Definicja stanów awaryjnych
  • Testy adwersarialne i telemetria
  • Dokumentacja wdrożenia

Jak pracujemy. Każdy audyt zaczyna się od rozmowy wstępnej, w której ustalamy zakres i sprawdzamy, czy w ogóle możemy coś sensownego powiedzieć o waszym systemie. Jeżeli okaże się, że nie — z powodu braku dostępu do logów, architektury black box albo zakresu poza naszymi kompetencjami — mówimy to wprost i nie przyjmujemy zlecenia. Ta rozmowa jest bezpłatna.