# Čo je prompt injection?

> Prompt injection je manipulácia systému generatívneho AI prostredníctvom inštrukcií, ktoré spôsobia, že model prepíše zamýšľané inštrukcie aplikácie alebo s nimi vstúpi do konfliktu.

- Kanonická URL: https://yellowcube.eu/sk/glossary/prompt-injection/
- Vydavateľ: Yellow Cube
- Jazyk: sk
- Kontakt: hello@yellowcube.eu

## Obsah

Využíva ťažkosť spoľahlivo oddeľovať dôveryhodné usmernenia od nedôveryhodného obsahu v kontexte modelu. Priama injekcia pochádza od interagujúceho používateľa; nepriama injekcia je zasadená v obsahu, ktorý systém neskôr spracúva, ako webová stránka, e-mail, dokument, obrázok, výsledok nástroja alebo záznam získavania.

Dôsledok závisí menej od samotného textu než od aplikácie okolo modelu. Izolovaný asistent môže produkovať nechcenú odpoveď, zatiaľ čo agent s prístupom k súkromným údajom, povereniam alebo externým nástrojom by mohol zverejniť informácie alebo iniciovať neautorizované akcie. Obrany preto majú predpokladať, že vytvorený obsah môže ovplyvniť model a limitovať, čo je akémukoľvek výslednému výstupu povolené robiť.

### Kľúčové body

- **Hranice dôvery:** Identifikovať každú cestu, ktorá pridáva text, obrázky, získané záznamy alebo výstup nástroja do kontextu, a označovať externý obsah ako nedôveryhodný aj keď sa objavuje vnútri známeho dokumentu.
- **Redukcia dopadu:** Dať modelom a nástrojom identity najmenších oprávnení, oddeliť citlivé údaje, obmedziť dostupné akcie, validovať argumenty nástrojov a vyžadovať nezávislé schválenie pre operácie s vysokým dopadom.
- **Detekcia a testovanie:** Cvičiť priame, nepriame, kódované, viacjazyčné, multimodálne a viackrokové prípady; logovať model, prompt, získaný obsah, volania nástrojov a autorizačné rozhodnutia potrebné na vyšetrenie výsledkov.
- **Dôležité obmedzenie:** Systémové prompty, vstupné filtre, oddeľovače a modelovo-založené detektory môžu redukovať riziko, ale neposkytujú univerzálnu hranicu injekcie promptu. Aplikácia musí zostať bezpečná, keď model nasleduje nepriateľské inštrukcie alebo produkuje nepriateľský výstup.

### Súvisiace pojmy

[Data poisoning](<https://yellowcube.eu/sk/glossary/data-poisoning/>) · [Princíp najmenších oprávnení](<https://yellowcube.eu/sk/glossary/least-privilege/>) · [AI red teaming](<https://yellowcube.eu/sk/glossary/ai-red-teaming/>) · [Bezpečnosť agentickej AI](<https://yellowcube.eu/sk/glossary/agentic-ai-security/>)

### Zdroje

[NIST AI 100-2 E2025, Adversarial Machine Learning Taxonomy](https://csrc.nist.gov/pubs/ai/100/2/e2025/final) · [OWASP LLM01:2025 Prompt Injection](https://genai.owasp.org/llmrisk/llm01-prompt-injection/) · [MITRE ATLAS](https://atlas.mitre.org/)

## Uvedenie zdroja a rozsah

Táto verzia Markdown sa generuje z rovnakých schválených záznamov ako kanonická stránka HTML. Pri citovaní použite kanonickú URL.

