Testování AI Act čl. 15
AI Red Teaming
Adversariální kampaň proti vašim nasazeným AI systémům. Nezkoumáme jednotlivé zranitelnosti, ale to, jak se celý systém chová pod cíleným útokem — a jestli si toho vaše obrana všimne. Pokryje požadavek AI Actu na testování odolnosti vysoce rizikových systémů.
Komu AI Red Team doporučujeme
AI Red Team dává smysl tam, kde AI systém dělá rozhodnutí nebo akce s reálným dopadem a kde selhání není jen chyba, ale riziko.
-
Provozovatelé vysoce rizikových AI systémů podle AI Actu s povinností testovat odolnost.
-
Banky a pojišťovny nasazující AI do rozhodovacích a klientských procesů.
-
Firmy s AI agenty, kteří mají přístup k systémům, penězům nebo citlivým datům.
-
Organizace, které už zvládly pentest AI a chtějí změřit odolnost celého systému v reálném scénáři.
-
Provozovatelé kritické infrastruktury s AI v provozních rozhodnutích.
-
Firmy vystavené riziku deepfake a AI podvodů na vedení.
Co dostanete
-
Scénářový report pro vedení: co se podařilo, kde to skončilo a co to znamená pro provoz.
-
Technický report s každou technikou, mapou na MITRE ATLAS a časovou osou útoku.
-
Měřitelné ukazatele odolnosti: co model odmítl, co propustil a kde selhaly kontroly.
-
Doklad testování odolnosti pro požadavek AI Actu čl. 15.
-
Doporučení ke guardrailům, monitoringu a řízení oprávnění AI systému.
-
Volitelně společný workshop s vaším týmem nad nálezy.
Co AI Red Team obsahuje
Kombinujeme útoky na samotný model s útoky na jeho okolí — a díky GBH Defence i s fyzickou vrstvou, kterou většina konkurence nepokryje.
Adversariální útoky na model
Adversariální útoky na model
-
Cílené kampaně prompt injection a jailbreaků napříč vstupy.
-
Pokusy o extrakci modelu a jeho trénovacích nebo kontextových dat.
-
Otrávení dat, takzvané data poisoning, v RAG a učicích smyčkách.
Zneužití agentů a integrací
Zneužití agentů a integrací
-
Zneužití AI agentů k neoprávněným akcím napříč propojenými systémy.
-
Řetězení oprávnění a eskalace přes nástroje a API modelu.
-
Obcházení kontrol typu člověk ve smyčce, takzvaného human-in-the-loop.
Sociální a fyzická vrstva
Toto je největší odlišení GBH. AI podvod často začíná u člověka nebo u budovy, ne u modelu. Fyzickou a sociální část pokrývá tým GBH Defence.
Sociální a fyzická vrstva
Toto je největší odlišení GBH. AI podvod často začíná u člověka nebo u budovy, ne u modelu. Fyzickou a sociální část pokrývá tým GBH Defence.
-
Deepfake hlasu a videa proti vedení a schvalovacím procesům.
-
Sociální inženýrství cílené na správce a operátory AI systému.
-
Napojení na fyzické vniknutí k infrastruktuře, na které model běží.
Měření odolnosti a detekce
Hlavní hodnota není najít jednu zranitelnost, ale objektivně změřit, jak systém a obrana obstojí.
Měření odolnosti a detekce
Hlavní hodnota není najít jednu zranitelnost, ale objektivně změřit, jak systém a obrana obstojí.
-
Kolik útoků model a guardraily odmítly a kolik propustily.
-
Zda a jak rychle si monitoring útoku všiml.
-
Kde se dal útok zastavit dřív a jak.
Adversariální útoky na model
Cílené kampaně prompt injection, extrakce modelu a otrávení dat v RAG a učicích smyčkách.
Zneužití agentů
Neoprávněné akce agentů napříč systémy, eskalace oprávnění a obcházení kontrol člověk ve smyčce.
Deepfake a sociální vrstva
Deepfake hlasu a videa proti vedení a sociální inženýrství cílené na správce AI systému.
Jak AI Red Team probíhá
-
Úvodní konzultace a cíle
Stanovíme cíl kampaně, rozsah AI systémů a povolené scénáře. Definujeme, co znamená úspěch útoku.
-
Pravidla zapojení a autorizace
Mlčenlivost, autorizace statutárního orgánu, eskalační kontakty a hranice. Bez podepsané autorizace nezačínáme.
-
Zpravodajská příprava
Zmapujeme architekturu, integrace a lidi kolem AI systému a připravíme scénáře podle MITRE ATLAS.
-
Provedení kampaně
Vedeme adversariální útoky napříč modelem, agenty i lidmi, s řízeným tempem a snahou zůstat nedetekováni. Kritické nálezy hlásíme průběžně.
-
Vyhodnocení a workshop
Scénářový report pro vedení, technický report s časovou osou a měřitelné ukazatele odolnosti. Volitelně workshop s vaším týmem.
Pravidla zapojení
- Bez podepsané autorizace statutárního orgánu nezačínáme.
- Řízené tempo, aby útok nenarušil produkční provoz.
- Kritické nálezy hlásíme okamžitě mimo report.
- Citlivá data po zakázce prokazatelně skartujeme.
Metodiky a kvalifikace
AI Red Team spojuje ofenzivní bezpečnostní tým s praxí v red teamingu a fyzický tým GBH Defence s dlouholetou praxí v ostraze, posuzování budov a vstupních systémů. Tato kombinace technického, sociálního a fyzického útoku je proti AI systémům v Česku ojedinělá.
- MITRE ATLAS
- taktiky a techniky útoků na AI systémy
- OWASP LLM Top 10
- katalog rizik jazykových modelů
- MITRE ATT&CK
- pro navazující technickou vrstvu
- AI Act čl. 15
- testování odolnosti vysoce rizikových systémů
- OSEP a CRTP
- certifikace red teamingu
- MITRE ATLAS
- znalost útoků na AI systémy
- GBH Defence
- fyzický průnik a sociální inženýrství
- AI Act čl. 15
- testování odolnosti
Více v přehledu Metodiky a certifikace.
Cena a délka realizace
AI Red Team je projektová zakázka, cena vychází z rozsahu scénáře a zapojených vrstev. Po úvodní konzultaci připravíme nabídku na míru.
| Varianta | Rozsah | Délka realizace |
|---|---|---|
| Zaměřená AI kampaň 3 až 5 týdnů | podle rozsahu | 3 až 5 týdnů |
| Kampaň se sociální vrstvou 5 až 8 týdnů | podle rozsahu | 5 až 8 týdnů |
| Komplexní scénář s fyzickým vniknutím individuálně podle scénáře | podle rozsahu | individuálně podle scénáře |
Cena vychází z rozsahu a integrací. Po úvodní konzultaci připravíme nezávaznou nabídku na míru. Ceny jsou bez DPH.
Reálný útočník nejde po modelu. Jde po nejsnazší cestě k cíli.
Časté dotazy
Stručné odpovědi na to, na co se nás u této služby ptáte nejčastěji.
- Jaký je rozdíl mezi AI Red Teamem a pentestem AI?
-
Pentest AI hledá zranitelnosti v modelu a jeho okolí. AI Red Team měří odolnost celého systému v reálném scénáři — jestli útok uspěje, jak daleko se dostane a jestli si toho obrana všimne. Pentest je levnější první krok, Red Team je hlubší měření.
- Pokryje to požadavek AI Actu?
-
Ano. AI Act v článku 15 vyžaduje u vysoce rizikových systémů testování odolnosti proti pokusům o zneužití. Scénářový report slouží jako doklad tohoto testování. Zařazení systému do rizikové kategorie řeší Audit souladu s AI Act.
- Proč zapojujete fyzické vniknutí do útoku na AI?
-
Protože reálný útočník volí nejsnazší cestu. Někdy je to prompt injection, jindy deepfake na operátora nebo fyzický přístup k serveru, na kterém model běží. Fyzickou a sociální vrstvu pokrývá tým GBH Defence, což je proti AI systémům ojedinělé.
- Nenaruší kampaň náš provoz?
-
Kampaň vedeme řízeným tempem a v hranicích dohodnutých v pravidlech zapojení. Kritické nálezy hlásíme okamžitě mimo report, abyste mohli zareagovat.
Testování
Pojďme upřesnit rozsah a cenu pro vás
Úvodní konzultace je nezávazná. Po ní dostanete přesnou fixní cenu a doporučený další krok.
Související služby
Tyto služby na sebe často navazují. Vyberte, co řešíte dál.
Penetrační testy AI a LLM aplikací
Levnější první krok: najít zranitelnosti AI systému před hlubším Red Teamem.
Zobrazit službu TestováníRed Teaming
Klasický Red Team napříč sítí, lidmi a budovou, když cílem není jen AI.
Zobrazit službu AudityAudit souladu s AI Act
Zařazení systému do rizikové kategorie a doložení souladu s AI Actem.
Zobrazit službuOzveme se do 1 pracovního dne
Napište nám, co řešíte. Doporučíme další krok a navrhneme nezávaznou konzultaci.