Testování OWASP LLM Top 10

Penetrační testy AI a LLM aplikací

Řízený útok na vaše nasazené AI systémy. Otestujeme chatboty, RAG pipeline, agenty i API integrace na prompt injection, jailbreaky a úniky dat, než to udělá útočník. Výstup obstojí před vedením, auditorem i požadavkem AI Actu na testování.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Komu pentest AI doporučujeme

Jakmile pustíte jazykový model k datům nebo akcím, stává se novým vstupním bodem útoku. Klasický pentest ho nepokryje.

  • Firmy s nasazeným chatbotem nebo asistentem nad interními či zákaznickými daty.

  • Provozovatelé RAG řešení, kde model čte firemní dokumenty a znalostní báze.

  • Týmy nasazující AI agenty s přístupem k systémům, API nebo e-mailu.

  • Banky, pojišťovny a zdravotnictví, kde únik z modelu znamená regulatorní problém.

  • Provozovatelé vysoce rizikových AI systémů podle AI Actu, kteří potřebují doložit testování odolnosti.

  • Vývojáři AI produktů před uvedením na trh.

Inženýři sledují provoz privátní AI v bezpečném prostředí

Co dostanete

Výstup srozumitelný vedení i vývojářům — s důkazem každého nálezu a jasným pořadím oprav.

  • Manažerský souhrn: největší riziko modelu a co řešit hned, bez žargonu.

  • Technický report: každá zranitelnost s ukázkou útoku, dopadem a mapou na OWASP LLM Top 10 a MITRE ATLAS.

  • Doporučení ke guardrailům, filtrům vstupu a výstupu a řízení oprávnění modelu.

  • Retest do 90 dní zdarma po nasazení oprav.

  • Doklad o testování AI pro auditora, regulátora nebo požadavek AI Actu.

Vzorový report penetračního testu GBH Cyber
Vzorový report penetračního testu GBH Cyber

Report, který obstojí před auditorem

Každý nález s ukázkou útoku, dopadem a doporučenou opravou.

  • Manažerský souhrn pro vedení bez žargonu.

  • Technický report s mapou na OWASP LLM Top 10 a MITRE ATLAS.

  • Doklad o testování AI pro požadavek AI Actu.

  • Retest do 90 dní v ceně.

Co testujeme

Pokrýváme celý řetězec od promptu přes model a znalostní bázi až po akce agenta, podle metodiky OWASP LLM Top 10.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Útoky na model a prompt

  • Přímý a nepřímý prompt injection přes vstup uživatele i přes obsah dokumentů.

  • Jailbreaky a obcházení systémových instrukcí a guardrailů.

  • Únik systémového promptu a citlivých instrukcí.

  • Extrakce trénovacích nebo kontextových dat z modelu.

Útoky na RAG a agenty

  • Otrávení znalostní báze, takzvaný RAG poisoning, přes podvržené dokumenty.

  • Únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.

  • Zneužití nástrojů a akcí agenta k neoprávněným operacím.

  • Insecure output handling: nebezpečné zpracování výstupu modelu navazující aplikací.

Útoky na integraci a API

  • Autorizace, rate limiting a zneužití API modelu.

  • Nadměrná oprávnění, takzvaná excessive agency, agenta či integrace.

  • Odepření služby a náklady vyvolané dotazy.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Prompt injection a jailbreaky

Přímé i nepřímé vstřikování instrukcí přes uživatele i přes obsah dokumentů a obcházení guardrailů.

Abstraktní síť uzlů s vyznačenou cestou útoku

Útoky na RAG

Otrávení znalostní báze, únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.

Detail stránky reportu s doporučeným postupem nápravy

Zneužití agentů a API

Nadměrná oprávnění, nebezpečné zpracování výstupu a zneužití akcí agenta k neoprávněným operacím.

Jak pentest AI probíhá

Penetrační tester pracuje u notebooku a monitorů v moderní kanceláři
  1. Úvodní konzultace a rozsah

    Pochopíme architekturu AI systému — model, RAG, agenty, integrace — a stanovíme rozsah, cíle a pravidla zapojení.

  2. Plánování a pravidla zapojení

    Mlčenlivost, autorizace, testovací prostředí nebo okno a eskalační kontakty. Bez podepsané autorizace nezačínáme.

  3. Provedení testu

    Manuální i automatizované útoky podle OWASP LLM Top 10: prompt injection, jailbreaky, útoky na RAG a agenty. Kritické nálezy hlásíme průběžně.

  4. Analýza a klasifikace

    Ověření a skórování nálezů, mapování na OWASP LLM Top 10 a MITRE ATLAS a příprava reprodukovatelných důkazů.

  5. Prezentace a retest

    Manažerský souhrn a technický briefing pro vývojáře. Po opravách provedeme jeden retest do 90 dní v ceně.

Pravidla zapojení

  • Bez podepsané autorizace nezačínáme.
  • Testujeme v dohodnutém prostředí nebo okně.
  • Kritické nálezy hlásíme okamžitě.
  • Citlivá data po zakázce prokazatelně skartujeme.

Metodiky a kvalifikace

Testy vede seniorní pentest tým s praxí v ofenzivní bezpečnosti a v provozu jazykových modelů. Spojujeme zkušenost z klasického penetračního testování s praktickou znalostí RAG, agentů a nasazení modelů Llama, Mistral a Qwen. Klíčové nálezy ověřuje druhý nezávislý pohled.

OWASP LLM Top 10
referenční katalog rizik jazykových modelů
MITRE ATLAS
mapování útoků na AI systémy
OWASP ASVS
pro navazující webovou a API vrstvu
AI Act čl. 15
testování odolnosti vysoce rizikových systémů
OSCP a OSEP
ofenzivní bezpečnostní certifikace
OWASP LLM Top 10
metodika testování AI
MITRE ATLAS
znalost útoků na AI systémy
Llama, Mistral, Qwen
praxe s nasazením modelů

Více v přehledu Metodiky a certifikace.

Cena a délka realizace

Pentest AI je projektová zakázka, cena vychází z rozsahu systému a počtu integrací. Po úvodní konzultaci dáváme přesnou fixní cenu.

Ceník služby
Varianta Rozsah
Test chatbota nebo RAG asistenta 1 až 2 týdny podle rozsahu
Test AI agenta s integracemi 2 až 3 týdny podle rozsahu
Komplexní AI systém individuálně podle architektury podle rozsahu

Cena vychází z rozsahu a integrací. Po úvodní konzultaci připravíme nezávaznou nabídku na míru. Ceny jsou bez DPH.

Časté dotazy

Stručné odpovědi na to, na co se nás u této služby ptáte nejčastěji.

Jaký je rozdíl mezi pentestem AI a klasickým pentestem?

Klasický pentest cílí na sítě, aplikace a infrastrukturu. Pentest AI se zaměřuje na model, prompt, znalostní bázi a akce agenta — na útoky jako prompt injection, jailbreak nebo otrávení RAG, které klasický test nepokrývá. U AI aplikace obvykle dávají smysl oba.

Podle čeho testujete?

Vycházíme z OWASP LLM Top 10, referenčního katalogu rizik jazykových modelů, a nálezy mapujeme na MITRE ATLAS. Navazující webovou a API vrstvu testujeme podle OWASP ASVS.

Pomůže nám to s AI Actem?

Ano. AI Act v článku 15 vyžaduje u vysoce rizikových systémů testování odolnosti proti pokusům o zneužití. Náš report slouží jako doklad tohoto testování. Zařazení systému do rizikové kategorie řeší Audit souladu s AI Act.

Naruší test provoz našeho AI?

Testujeme primárně v dohodnutém prostředí nebo okně. Rozsah, hranice a zakázané techniky stanovíme předem v pravidlech zapojení, abychom nenarušili produkční provoz.

Testování

Pojďme upřesnit rozsah a cenu pro vás

Úvodní konzultace je nezávazná. Po ní dostanete přesnou fixní cenu a doporučený další krok.

Související služby

Tyto služby na sebe často navazují. Vyberte, co řešíte dál.

Ozveme se do 1 pracovního dne

Napište nám, co řešíte. Doporučíme další krok a navrhneme nezávaznou konzultaci.