Ak ťa zaujíma širšie porovnanie dnešných AI nástrojov, pozri si aj ChatGPT vs. Gemini vs. Claude vs. Perplexity.
Ak sa pýtaš „nahlási ma AI polícii?“, bežná odmietnutá otázka ani bezpečnostné upozornenie spravidla neznamenajú kontaktovanie orgánov. Pri veľmi vážnom a dôveryhodnom riziku bezprostredného násilia však môže niektorá platforma zapojiť ľudské preskúmanie a vo výnimočných prípadoch aj orgány činné v trestnom konaní.
AI nehľadá iba slová ako „zabiť“ alebo „hacknúť“
Porovnaj tri otázky:
„Ako bol zavraždený Július Caesar?“
Historická otázka. AI môže normálne odpovedať.
„Píšem detektívku. Pomôž mi vytvoriť scénu vraždy.“
Ide o fikciu. Aj tu môže byť odpoveď povolená.
„Chcem zajtra napadnúť konkrétneho človeka. Ako mám postupovať?“
Tu sa situácia mení. Objavuje sa cieľ, zámer a možnosť reálnej ujmy.
Pri téme AI a násilie preto nie je rozhodujúce jedno slovo, ale kontext, konkrétnosť a to, či by odpoveď mohla zvýšiť schopnosť niekomu ublížiť.
Veta „zabi proces vo Windows“ tak rozhodne neznamená, že za sysadminom vyrazí zásahová jednotka. 😄
A čo AI a nelegálne činy?
Rovnaký princíp platí pri hackingu, podvodoch, zbraniach či krádežiach.
„Ako funguje SQL injection?“
Je legitímna vzdelávacia otázka.
„Robím bezpečnostný test vlastnej aplikácie. Ako preverím SQL injection?“
Opäť môže ísť o legálny a bezpečný kontext.
Ale požiadavka na praktickú pomoc pri útoku proti cudziemu systému je už úplne iná situácia.
Pri AI a nelegálnych činoch teda záleží na tom, či človek chce porozumieť problému, brániť sa proti nemu alebo ho reálne vykonať.
Tento článok vysvetľuje princíp bezpečnostnej moderácie AI. Nie je návodom na obchádzanie ochranných mechanizmov ani na páchanie nelegálnych činov. Presné pravidlá jednotlivých služieb sa líšia a môžu sa meniť.
Ako AI moderuje obsah v praxi?
| Situácia | Čo systém sleduje | Typická reakcia |
|---|---|---|
| História alebo správy | Vzdelávací kontext | Normálna odpoveď |
| Fikcia alebo humor | Zámer a kontext | Väčšinou odpovie |
| Legálny pentest | Autorizácia a riziko | Môže technicky pomôcť |
| Konkrétny plán násilia | Zámer, cieľ, bezprostrednosť | Odmietnutie alebo bezpečnostná reakcia |
| Bezprostredná vážna hrozba | Riziko reálnej fyzickej ujmy | Môže nasledovať eskalácia |
Nahlási ma AI polícii, keď systém odmietne odpovedať?
Nie automaticky.
ChatGPT je dobrý konkrétny príklad. OpenAI uvádza, že pri podozrení na plánovanie násilia môže byť určitá časť vysoko rizikových prípadov postúpená na špecializované ľudské preskúmanie. Ak konverzácia naznačuje bezprostredné a dôveryhodné riziko vážneho ublíženia iným, OpenAI uvádza, že môže kontaktovať orgány činné v trestnom konaní.
Bežné porušenie pravidiel však typicky vedie skôr k odmietnutiu odpovede, upozorneniu alebo zásahu voči účtu.
Google pri Gemini zase verejne uvádza, že pri zisťovaní potenciálneho zneužitia kombinuje automatické systémy a ľudskú kontrolu. Opakované porušenia môžu viesť k obmedzeniu služby alebo účtu.
Vidí polícia moje rozhovory s AI?
Nie tak, že by polícia mala priebežný prístup ku všetkým rozhovorom.
Prevádzkovatelia AI služieb však môžu poskytovať údaje na základe platného právneho procesu. OpenAI napríklad vo svojej aktuálnej politike uvádza, že používateľské údaje poskytuje orgánom na základe právne platnej žiadosti alebo v mimoriadnej situácii, keď existuje nebezpečenstvo smrti či vážneho fyzického zranenia.
Anthropic pri Claude opisuje podobný princíp: štandardne vyžaduje platný právny proces, pričom výnimkou môže byť núdzová situácia s rizikom bezprostrednej fyzickej ujmy alebo smrti.
To je však niečo úplne iné než predstava, že každá „podozrivá“ otázka automaticky putuje na policajnú stanicu.
Môže sa AI pri hodnotení násilia pomýliť?
Áno.
Automatický systém nevie čítať myšlienky. Vyhodnocuje text, obrázky, dostupný kontext a ďalšie signály.
Preto môže nesprávne pochopiť čierny humor, slang alebo frustráciu.
„Ten server dnes podpálim.“
Pre človeka v IT kancelárii môže byť očividný vtip.
Pre automatický klasifikátor je to veta, ktorú musí interpretovať podľa dostupného kontextu.
A práve preto môžu existovať false positives a bezpečnostné rozhodnutia nie sú založené iba na jednom slove.
Záver: Nahlási ma AI polícii?
Väčšinou nie.
AI môže úplne legitímne diskutovať o kriminalite, násilí, vojnách, hackingu či bezpečnosti. Rozhodujúce je, čo chce používateľ odpoveďou dosiahnuť.
Odmietnutie odpovede preto automaticky neznamená nahlásenie.
AI nie je policajt, ale ani slepý textový editor. Bezpečnostné systémy sa snažia rozlišovať medzi legitímnou diskusiou a situáciou, v ktorej by odpoveď mohla pomôcť spôsobiť reálnu škodu.
Zdroje
OpenAI – Community Safety , Google Gemini – Generative AI Prohibited Use Policy , Anthropic – Government requests for user information




