Prompt injection a jailbreaky
Podvržená instrukce schovaná ve vstupu nebo v načteném dokumentu dokáže systém přesvědčit, aby porušil vlastní pravidla.
Nezávisle prověříme váš AI nebo LLM systém dřív, než dostane citlivá data nebo pravomoc rozhodovat samostatně. Dostanete zdokumentované nálezy, jejich závažnost a nápravný plán, ne dojem z prezentace.
Žádný obecný checklist. Testujeme scénáře, které dávají smysl pro váš systém, vaše data a vaše oprávnění.
Podvržená instrukce schovaná ve vstupu nebo v načteném dokumentu dokáže systém přesvědčit, aby porušil vlastní pravidla.
Odkud systém bere odpovědi, jestli odděluje uživatele od sebe navzájem a jestli si nepůjčuje data, ke kterým nemá mít přístup.
Co smí systém udělat bez zeptání: rozsah nástrojů, jejich oprávnění a místo, kde má poslední slovo zůstat na člověku.
Cesty, kterými by mohla citlivá data uniknout ven, nebo kterými by si někdo mohl vypůjčit identitu vašeho uživatele či firmy.
Cílem není seznam obav, ale konkrétní rizika s důkazem, opravou a novým ověřením, že oprava drží.
Společně určíme, které systémy, scénáře a přístupy u vašeho nasazení dává smysl testovat.
Testy provádíme cíleně, ne plošně, a každý nález podložíme důkazem, ne dojmem.
Předáme nálezy seřazené podle závažnosti, s doporučením, co opravit, a ověříme, že oprava zabrala.
Ozveme se s návrhem rozsahu a dalším krokem. Mluvíte přímo s institutem, ne s obchodním oddělením.