Testování OWASP LLM Top 10
Penetrační testy AI a LLM aplikací
Řízený útok na vaše nasazené AI systémy. Otestujeme chatboty, RAG pipeline, agenty i API integrace na prompt injection, jailbreaky a úniky dat, než to udělá útočník. Výstup obstojí před vedením, auditorem i požadavkem AI Actu na testování.
Komu pentest AI doporučujeme
Jakmile pustíte jazykový model k datům nebo akcím, stává se novým vstupním bodem útoku. Klasický pentest ho nepokryje.
-
Firmy s nasazeným chatbotem nebo asistentem nad interními či zákaznickými daty.
-
Provozovatelé RAG řešení, kde model čte firemní dokumenty a znalostní báze.
-
Týmy nasazující AI agenty s přístupem k systémům, API nebo e-mailu.
-
Banky, pojišťovny a zdravotnictví, kde únik z modelu znamená regulatorní problém.
-
Provozovatelé vysoce rizikových AI systémů podle AI Actu, kteří potřebují doložit testování odolnosti.
-
Vývojáři AI produktů před uvedením na trh.
Co dostanete
Výstup srozumitelný vedení i vývojářům — s důkazem každého nálezu a jasným pořadím oprav.
-
Manažerský souhrn: největší riziko modelu a co řešit hned, bez žargonu.
-
Technický report: každá zranitelnost s ukázkou útoku, dopadem a mapou na OWASP LLM Top 10 a MITRE ATLAS.
-
Doporučení ke guardrailům, filtrům vstupu a výstupu a řízení oprávnění modelu.
-
Retest do 90 dní zdarma po nasazení oprav.
-
Doklad o testování AI pro auditora, regulátora nebo požadavek AI Actu.
Report, který obstojí před auditorem
Každý nález s ukázkou útoku, dopadem a doporučenou opravou.
-
Manažerský souhrn pro vedení bez žargonu.
-
Technický report s mapou na OWASP LLM Top 10 a MITRE ATLAS.
-
Doklad o testování AI pro požadavek AI Actu.
-
Retest do 90 dní v ceně.
Co testujeme
Pokrýváme celý řetězec od promptu přes model a znalostní bázi až po akce agenta, podle metodiky OWASP LLM Top 10.
Útoky na model a prompt
Útoky na model a prompt
-
Přímý a nepřímý prompt injection přes vstup uživatele i přes obsah dokumentů.
-
Jailbreaky a obcházení systémových instrukcí a guardrailů.
-
Únik systémového promptu a citlivých instrukcí.
-
Extrakce trénovacích nebo kontextových dat z modelu.
Útoky na RAG a agenty
Útoky na RAG a agenty
-
Otrávení znalostní báze, takzvaný RAG poisoning, přes podvržené dokumenty.
-
Únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.
-
Zneužití nástrojů a akcí agenta k neoprávněným operacím.
-
Insecure output handling: nebezpečné zpracování výstupu modelu navazující aplikací.
Útoky na integraci a API
Útoky na integraci a API
-
Autorizace, rate limiting a zneužití API modelu.
-
Nadměrná oprávnění, takzvaná excessive agency, agenta či integrace.
-
Odepření služby a náklady vyvolané dotazy.
Prompt injection a jailbreaky
Přímé i nepřímé vstřikování instrukcí přes uživatele i přes obsah dokumentů a obcházení guardrailů.
Útoky na RAG
Otrávení znalostní báze, únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.
Zneužití agentů a API
Nadměrná oprávnění, nebezpečné zpracování výstupu a zneužití akcí agenta k neoprávněným operacím.
Jak pentest AI probíhá
-
Úvodní konzultace a rozsah
Pochopíme architekturu AI systému — model, RAG, agenty, integrace — a stanovíme rozsah, cíle a pravidla zapojení.
-
Plánování a pravidla zapojení
Mlčenlivost, autorizace, testovací prostředí nebo okno a eskalační kontakty. Bez podepsané autorizace nezačínáme.
-
Provedení testu
Manuální i automatizované útoky podle OWASP LLM Top 10: prompt injection, jailbreaky, útoky na RAG a agenty. Kritické nálezy hlásíme průběžně.
-
Analýza a klasifikace
Ověření a skórování nálezů, mapování na OWASP LLM Top 10 a MITRE ATLAS a příprava reprodukovatelných důkazů.
-
Prezentace a retest
Manažerský souhrn a technický briefing pro vývojáře. Po opravách provedeme jeden retest do 90 dní v ceně.
Pravidla zapojení
- Bez podepsané autorizace nezačínáme.
- Testujeme v dohodnutém prostředí nebo okně.
- Kritické nálezy hlásíme okamžitě.
- Citlivá data po zakázce prokazatelně skartujeme.
Metodiky a kvalifikace
Testy vede seniorní pentest tým s praxí v ofenzivní bezpečnosti a v provozu jazykových modelů. Spojujeme zkušenost z klasického penetračního testování s praktickou znalostí RAG, agentů a nasazení modelů Llama, Mistral a Qwen. Klíčové nálezy ověřuje druhý nezávislý pohled.
- OWASP LLM Top 10
- referenční katalog rizik jazykových modelů
- MITRE ATLAS
- mapování útoků na AI systémy
- OWASP ASVS
- pro navazující webovou a API vrstvu
- AI Act čl. 15
- testování odolnosti vysoce rizikových systémů
- OSCP a OSEP
- ofenzivní bezpečnostní certifikace
- OWASP LLM Top 10
- metodika testování AI
- MITRE ATLAS
- znalost útoků na AI systémy
- Llama, Mistral, Qwen
- praxe s nasazením modelů
Více v přehledu Metodiky a certifikace.
Cena a délka realizace
Pentest AI je projektová zakázka, cena vychází z rozsahu systému a počtu integrací. Po úvodní konzultaci dáváme přesnou fixní cenu.
| Varianta | Rozsah | Délka realizace |
|---|---|---|
| Test chatbota nebo RAG asistenta 1 až 2 týdny | podle rozsahu | 1 až 2 týdny |
| Test AI agenta s integracemi 2 až 3 týdny | podle rozsahu | 2 až 3 týdny |
| Komplexní AI systém individuálně podle architektury | podle rozsahu | individuálně podle architektury |
Cena vychází z rozsahu a integrací. Po úvodní konzultaci připravíme nezávaznou nabídku na míru. Ceny jsou bez DPH.
Časté dotazy
Stručné odpovědi na to, na co se nás u této služby ptáte nejčastěji.
- Jaký je rozdíl mezi pentestem AI a klasickým pentestem?
-
Klasický pentest cílí na sítě, aplikace a infrastrukturu. Pentest AI se zaměřuje na model, prompt, znalostní bázi a akce agenta — na útoky jako prompt injection, jailbreak nebo otrávení RAG, které klasický test nepokrývá. U AI aplikace obvykle dávají smysl oba.
- Podle čeho testujete?
-
Vycházíme z OWASP LLM Top 10, referenčního katalogu rizik jazykových modelů, a nálezy mapujeme na MITRE ATLAS. Navazující webovou a API vrstvu testujeme podle OWASP ASVS.
- Pomůže nám to s AI Actem?
-
Ano. AI Act v článku 15 vyžaduje u vysoce rizikových systémů testování odolnosti proti pokusům o zneužití. Náš report slouží jako doklad tohoto testování. Zařazení systému do rizikové kategorie řeší Audit souladu s AI Act.
- Naruší test provoz našeho AI?
-
Testujeme primárně v dohodnutém prostředí nebo okně. Rozsah, hranice a zakázané techniky stanovíme předem v pravidlech zapojení, abychom nenarušili produkční provoz.
Testování
Pojďme upřesnit rozsah a cenu pro vás
Úvodní konzultace je nezávazná. Po ní dostanete přesnou fixní cenu a doporučený další krok.
Související služby
Tyto služby na sebe často navazují. Vyberte, co řešíte dál.
AI Red Teaming
Když chcete změřit odolnost celého AI systému v reálném scénáři, ne jen najít zranitelnosti.
Zobrazit službu AudityAudit souladu s AI Act
Zařazení AI systému do rizikové kategorie a doložení souladu s AI Actem.
Zobrazit službu TestováníPenetrační testy
Klasický pentest infrastruktury a aplikace, na které AI systém běží.
Zobrazit službuOzveme se do 1 pracovního dne
Napište nám, co řešíte. Doporučíme další krok a navrhneme nezávaznou konzultaci.