Ubrizgavanje upitaPrompt injection
Ubrizgavanje upita koristi slabost jezičkih modela da jasno razlikuju instrukciju od sadržaja koji obrađuju. Kada model čita mejl, dokument, stranicu, tiket ili poruku, napadač može u taj sadržaj da ubaci tekst koji liči na instrukciju.
Pojam
opis · primeri · napomeneUbrizgavanje upita koristi slabost jezičkih modela da jasno razlikuju instrukciju od sadržaja koji obrađuju. Kada model čita mejl, dokument, stranicu, tiket ili poruku, napadač može u taj sadržaj da ubaci tekst koji liči na instrukciju.
Opis
Direktna varijanta je kada korisnik u razgovoru pokuša da natera model da zanemari pravila. Opasnija je indirektna varijanta: zlonamerno uputstvo stoji sakriveno u dokumentu, veb stranici ili mejlu koji agent čita. Žrtva često ne vidi instrukciju, ali model će je obraditi.
Šteta zavisi od dozvola koje agent ima. Ako samo odgovara, može odati podatke kojima ima pristup. Ako sme da šalje poštu, poziva API, menja tiket, čita fajlove ili briše podatke, napad više nije samo tekstualna igra, nego operativni incident.
Primeri
- Agent koji rezimira mejlove čita skrivene instrukcije da prosledi poslednje poruke na spoljnu adresu.
- Četbot povezan sa bazom dobija zahtev da zanemari prethodna pravila i ispiše podatke drugog korisnika.
- U PDF ponudi stoji skriveni tekst koji pokušava da promeni zaključak asistenta koji poredi ponude.
Napomene
- Kod LLM agenata problem nije samo šta model kaže, nego šta model sme da uradi.
- Pre rasprave o savršenom promptu, treba smanjiti dozvole, odvojiti podatke i uvesti potvrdu za radnje sa posledicama.
Spomenuto u vestima
- 30. JUN 2026. Gemini CLI propust otvara CI workflow pre uključivanja sandbox-a →
- 1. MAJ 2026. OpenClaw ranjivosti omogućavaju zaobilaženje politika i krađu API kredencijala →
- 18. APR 2026. AI agenti na GitHub Actions ranjivi na prompt injection kroz komentare →
- 15. APR 2026. GitHub Copilot Chat propust pokazao kako prompt injection može da izvuče tajne podatke →
- 28. MAR 2026. Propust u Claude Chrome ekstenziji omogućavao zero-click prompt injection sa bilo kog sajta →
- 20. MAR 2026. ESET upozorava na bezbednosnu krizu u platformama za AI agente i njihove skill-ove →
- 19. MAR 2026. Lanac ranjivosti u Claude.ai omogućavao krađu podataka i zlonamerna preusmerenja →
- 14. MAR 2026. Ranjivosti u OpenClaw AI agentu mogu omogućiti prompt injection i krađu podataka →
- 27. FEB 2026. Istraživač demonstrirao jailbreak Claude AI modela →
- 24. FEB 2026. GitHub Issues zloupotrebljen u Copilot napadu koji vodi do preuzimanja repozitorijuma →
- 18. FEB 2026. Istraživači pokazali kako se Copilot i Grok mogu zloupotrebiti kroz prompt injection →
- 1. MAJ 2026. Kritična Gemini CLI ranjivost omogućava RCE u CI/CD tokovima →
- 20. APR 2026. Kritična slabost u Anthropic MCP otvara put do RCE napada →
- 19. APR 2026. AI vendori često prebacuju odgovornost za bezbednosne propuste na korisnike →
- 29. MAR 2026. Zlonamerne ekstenzije kradu AI razgovore u prompt poaching napadima →
- 28. MAR 2026. Palo Alto Networks širi platformu za otkrivanje i kontrolu AI agenata →
- 11. MAR 2026. OpenAI kupuje Promptfoo platformu za testiranje bezbednosti AI sistema →
- 11. MAR 2026. OpenClaw AI agent izazvao talas bezbednosnih incidenata nakon naglog rasta popularnosti →
Tehnike
izvodi se sa 2Tehnike kojima se izvodi. Klik vodi na stranicu pojma.