Testování OWASP LLM Top 10

Penetrační testy AI a LLM aplikací

Řízený test nasazeného AI systému. Prověří chatbot, RAG, agenty i API integrace proti prompt injection, jailbreakům a úniku dat. Report popíše důkaz, dopad a doporučenou opravu každého potvrzeného nálezu.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Komu pentest AI doporučujeme

Jakmile pustíte jazykový model k datům nebo akcím, stává se novým vstupním bodem útoku. Klasický pentest ho nepokryje.

  • Firmy s nasazeným chatbotem nebo asistentem nad interními či zákaznickými daty.

  • Provozovatelé RAG řešení, kde model čte firemní dokumenty a znalostní báze.

  • Týmy nasazující AI agenty s přístupem k systémům, API nebo e-mailu.

  • Banky, pojišťovny a zdravotnictví, kde únik z modelu znamená regulatorní problém.

  • Provozovatelé vysoce rizikových AI systémů podle AI Actu, kteří potřebují doložit testování odolnosti.

  • Vývojáři AI produktů před uvedením na trh.

Inženýři sledují provoz privátní AI v bezpečném prostředí

Co dostanete

Výstup srozumitelný vedení i vývojářům — s důkazem každého nálezu a jasným pořadím oprav.

  • Manažerský souhrn: největší riziko modelu a co řešit hned, bez žargonu.

  • Technický report: každá zranitelnost s ukázkou útoku, dopadem a mapou na OWASP LLM Top 10 a MITRE ATLAS.

  • Doporučení ke guardrailům, filtrům vstupu a výstupu a řízení oprávnění modelu.

  • Retest do 90 dní zdarma po nasazení oprav.

  • Doložitelný záznam o rozsahu, průběhu a výsledku testování AI systému.

Vzorový report penetračního testu GBH Cyber
Vzorový report penetračního testu GBH Cyber

Report s dohledatelným důkazem každého nálezu

Každý nález s ukázkou útoku, dopadem a doporučenou opravou.

  • Manažerský souhrn pro vedení bez žargonu.

  • Technický report s mapou na OWASP LLM Top 10 a MITRE ATLAS.

  • Záznam o rozsahu a výsledku testování pro další posouzení souladu.

  • Retest do 90 dní v ceně.

Co testujeme

Pokrýváme celý řetězec od promptu přes model a znalostní bázi až po akce agenta, podle metodiky OWASP LLM Top 10.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Útoky na model a prompt

  • Přímý a nepřímý prompt injection přes vstup uživatele i přes obsah dokumentů.

  • Jailbreaky a obcházení systémových instrukcí a guardrailů.

  • Únik systémového promptu a citlivých instrukcí.

  • Extrakce trénovacích nebo kontextových dat z modelu.

Útoky na RAG a agenty

  • Otrávení znalostní báze, takzvaný RAG poisoning, přes podvržené dokumenty.

  • Únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.

  • Zneužití nástrojů a akcí agenta k neoprávněným operacím.

  • Insecure output handling: nebezpečné zpracování výstupu modelu navazující aplikací.

Útoky na integraci a API

  • Autorizace, rate limiting a zneužití API modelu.

  • Nadměrná oprávnění, takzvaná excessive agency, agenta či integrace.

  • Odepření služby a náklady vyvolané dotazy.

Penetrační tester zkouší prompt injection proti firemnímu chatbotu

Prompt injection a jailbreaky

Přímé i nepřímé vstřikování instrukcí přes uživatele i přes obsah dokumentů a obcházení guardrailů.

Abstraktní síť uzlů s vyznačenou cestou útoku

Útoky na RAG

Otrávení znalostní báze, únik dat mezi tenanty a obcházení řízení přístupu ke zdrojům.

Detail stránky reportu s doporučeným postupem nápravy

Zneužití agentů a API

Nadměrná oprávnění, nebezpečné zpracování výstupu a zneužití akcí agenta k neoprávněným operacím.

Jak pentest AI probíhá

Penetrační tester pracuje u notebooku a monitorů v moderní kanceláři
  1. Úvodní konzultace a rozsah

    Pochopíme architekturu AI systému — model, RAG, agenty, integrace — a stanovíme rozsah, cíle a pravidla zapojení.

  2. Plánování a pravidla zapojení

    Mlčenlivost, autorizace, testovací prostředí nebo okno a eskalační kontakty. Bez podepsané autorizace nezačínáme.

  3. Provedení testu

    Manuální i automatizované útoky podle OWASP LLM Top 10: prompt injection, jailbreaky, útoky na RAG a agenty. Kritické nálezy hlásíme průběžně.

  4. Analýza a klasifikace

    Ověření a skórování nálezů, mapování na OWASP LLM Top 10 a MITRE ATLAS a příprava reprodukovatelných důkazů.

  5. Prezentace a retest

    Manažerský souhrn a technický briefing pro vývojáře. Po opravách provedeme jeden retest do 90 dní v ceně.

Pravidla zapojení

  • Bez podepsané autorizace nezačínáme.
  • Testujeme v dohodnutém prostředí nebo okně.
  • Kritické nálezy hlásíme okamžitě.
  • Citlivá data po zakázce prokazatelně skartujeme.

Naše kvalifikace

Test propojuje klasické penetrační postupy s kontrolou modelu, RAG, agentů a jejich oprávnění. Konkrétní složení týmu, doložitelnou zkušenost a způsob nezávislého ověření nálezů uvedeme v nabídce.

OWASP LLM Top 10
referenční katalog rizik jazykových modelů
MITRE ATLAS
mapování útoků na AI systémy
OWASP ASVS
pro navazující webovou a API vrstvu
AI Act čl. 15
testování odolnosti vysoce rizikových systémů
PTES
řízení rozsahu a důkazů testu
OWASP LLM Top 10
metodika testování AI
MITRE ATLAS
znalost útoků na AI systémy
Llama, Mistral, Qwen
typické rodiny modelů v rozsahu testu

Více v přehledu Metodiky testování.

Z čeho aktuální informace vycházejí

Právní a regulatorní informace jsme naposledy zkontrolovali 4. srpna 2026. Jde o praktický přehled, nikoli právní stanovisko.

Cena a délka realizace

Pentest AI je projektová zakázka, cena vychází z rozsahu systému a počtu integrací. Po úvodní konzultaci dáváme přesnou fixní cenu.

Ceník služby
Varianta Rozsah
Test chatbota nebo RAG asistenta 1 až 2 týdny podle rozsahu
Test AI agenta s integracemi 2 až 3 týdny podle rozsahu
Komplexní AI systém individuálně podle architektury podle rozsahu

Cena vychází z rozsahu a integrací. Po úvodní konzultaci připravíme nezávaznou nabídku na míru. Ceny jsou bez DPH.

Časté dotazy

Stručné odpovědi na to, na co se nás u této služby ptáte nejčastěji.

Jaký je rozdíl mezi pentestem AI a klasickým pentestem?

Klasický pentest cílí na sítě, aplikace a infrastrukturu. Pentest AI se zaměřuje na model, prompt, znalostní bázi a akce agenta — na útoky jako prompt injection, jailbreak nebo otrávení RAG, které klasický test nepokrývá. U AI aplikace obvykle dávají smysl oba.

Podle čeho testujete?

Vycházíme z OWASP LLM Top 10, referenčního katalogu rizik jazykových modelů, a nálezy mapujeme na MITRE ATLAS. Navazující webovou a API vrstvu testujeme podle OWASP ASVS.

Pomůže nám to s AI Actem?

U systému, na který se článek 15 vztahuje, může report posloužit jako jeden z podkladů k doložení testování odolnosti. Nenahrazuje ale posouzení rizikové kategorie ani ostatních povinností podle AI Actu.

Naruší test provoz našeho AI?

Testujeme primárně v dohodnutém prostředí nebo okně. Rozsah, hranice a zakázané techniky stanovíme předem v pravidlech zapojení, abychom nenarušili produkční provoz.

Testování

Pojďme upřesnit rozsah a cenu pro vás

Úvodní konzultace je nezávazná. Po ní dostanete přesnou fixní cenu a doporučený další krok.

Související služby

Tyto služby na sebe často navazují. Vyberte, co řešíte dál.

Ozveme se do 1 pracovního dne

Napište nám, co řešíte. Doporučíme další krok a navrhneme nezávaznou konzultaci.