Zmáčkni ESC pro ukončení

Co nezadávat do AI chatu? Pět typů údajů, které si raději nechte pro sebe

AI chat dokáže opravit text, shrnout dokument nebo pomoci s formulací e-mailu. Při jeho používání však lze velmi snadno zkopírovat do okna i něco, co tam vůbec nemělo být: heslo z konfigurace, celou lékařskou zprávu nebo obchodní údaje klienta. Riziko nezávisí jen na tom, zda poskytovatel používá konverzace k trénování modelu.

Do běžného AI chatu neposílejte hesla a přístupové klíče, celé doklady totožnosti, identifikovatelné zdravotní záznamy, cizí osobní údaje bez oprávnění ani důvěrné firemní dokumenty. Před odesláním odstraňte jména, čísla, interní adresy a další rozpoznatelné údaje. Nastavení soukromí mohou omezit konkrétní způsoby využití dat, nejsou však náhradou za rozhodnutí, co službě vůbec zpřístupníte.

1. Hesla, obnovovací kódy a přístupové klíče

Heslo k e-mailu, PIN, jednorázový ověřovací kód, soukromý kryptografický klíč ani API token nemají být součástí požadavku na opravu kódu nebo konfigurace. I když potřebujete poradit s přihlášením, k vysvětlení problému zpravidla stačí typ chyby, název služby a anonymizovaný popis postupu.

Pokud do konverzace omylem vložíte skutečný přístupový klíč, považujte ho za potenciálně vyzrazený. Podle typu služby ho zrušte nebo vyměňte, zkontrolujte související přístupy a řiďte se bezpečnostním postupem organizace. Smazání zprávy nemusí znamenat okamžité odstranění každé technické kopie ze všech míst.

Při ukázce konfigurace použijte zástupnou hodnotu, například „TESTOVACI_KLIC“, nikoli poslední čtyři znaky skutečného tokenu. Ani částečné údaje není nutné bezdůvodně zveřejňovat. Pokud asistenta používáte přes externí aplikaci, zajímejte se také o to, kdo provozuje tuto další vrstvu.

2. Občanský průkaz, pas a kompletní bankovní dokumenty

Fotografie občanského průkazu spojuje obličej, jméno, datum narození a další identifikátory. Pro běžný dotaz na postup při vyřizování dokladu ji nepotřebujete. Stejně tak není vhodné kopírovat kompletní bankovní výpis s čísly účtů, adresou, obchodníky a poznámkami u transakcí, když chcete pouze vysvětlení jedné položky.

Bezpečnější je přepsat z dokumentu jen obecnou formulaci nebo vytvořit modelový příklad. To, že služba dokáže zpracovat přílohu, automaticky neznamená, že je vhodným místem pro ukládání dokladů totožnosti. Při nezbytném pracovním použití se řiďte schváleným postupem, smluvními podmínkami a pravidly ochrany dat.

Ani začernění dokumentu nemusí být vždy dostačující. Název souboru, metadata, čísla objednávek nebo kombinace zbývajících polí mohou osobu nepřímo identifikovat. Kontrolujte proto nejen viditelný text, ale i to, co je součástí nahrávané přílohy.

3. Lékařské zprávy se jménem a rodným číslem

AI vám může pomoci vysvětlit obecný lékařský pojem, ale rozpoznatelné zdravotní dokumenty představují citlivý materiál. Pokud potřebujete objasnit výraz z výsledku, zvažte, zda nestačí anonymizovaná věta bez jména, rodného čísla, adresy a údajů ukazujících na konkrétní osobu.

Odpověď chatu zároveň nepovažujte za definitivní diagnózu. Národní centrum kybernetické bezpečnosti Spojeného království upozorňuje, že jazykové modely mohou uvádět nesprávné informace jako fakta. Při naléhavých příznacích, rozhodování o lécích nebo nejasném výsledku je potřeba vyhledat přiměřenou zdravotní pomoc, nikoli se spoléhat na přesvědčivě znějící text.

Zdravotní údaje jiné osoby jsou z hlediska jejího soukromí ještě citlivější. Samotné tvrzení, že chcete pomoci členu rodiny nebo kolegovi, nenahrazuje oprávnění odeslat jeho dokumenty službě třetí strany.

4. Osobní údaje zákazníků a kolegů

Při návrhu odpovědi zákazníkovi nemusíte do chatu vložit celé CRM. Většinou stačí popis situace bez jména, telefonu, e-mailu, přesné adresy, historie objednávek a poznámek o klientovi. Zaměstnavatel může mít pravidla, která používání veřejných nástrojů AI s interními údaji zakazují nebo podmiňují schválením.

Při hromadném zpracování údajů je riziko vyšší: nahraný soubor může obsahovat skryté sloupce, komentáře a osobní identifikátory. Před nahráním jej otevřete a zkontrolujte v celém rozsahu. Smyslem anonymizace je zabránit identifikaci, nikoli jen nahradit jméno iniciálami, pokud jsou ostatní údaje jednoznačné.

Při ochraně osobních údajů se posuzuje také právní důvod zpracování, účel, nezbytnost a smluvní vztah s poskytovatelem. Univerzální pravidlo „když vypnu trénování, mohu nahrát cokoli“ proto neplatí.

5. Důvěrné smlouvy, interní kód a obchodní tajemství

Nezveřejněná cenová nabídka, zdrojový kód se zabudovanými klíči, klientská smlouva nebo obchodní plán se mohou dostat do chatu při nevinném pokusu o gramatickou úpravu. Před odesláním si ověřte, zda jste vůbec oprávněni sdílet obsah s externím dodavatelem. Dohoda o mlčenlivosti nebo interní bezpečnostní politika mohou rozsah povoleného použití omezovat.

K jazykové korektuře často stačí krátká upravená ukázka bez názvu firmy, obchodních podmínek a identifikátorů. U kódu odstraňte tokeny, přihlašovací údaje, skutečné URL interních systémů a zákaznické záznamy v databázi. V organizaci je vhodné používat pouze schválenou službu s vyhodnocenými podmínkami práce s daty.

Znamená vypnuté trénování, že je všechno soukromé?

Ne. Ochrana dat má více vrstev: zda se obsah používá k trénování, jak se uchovává, kdo k němu má přístup, zda existují bezpečnostní kontroly a co se odesílá dalším nástrojům. OpenAI například vysvětluje rozdíl mezi běžnými konverzacemi, vypnutím vylepšování modelů a dočasným chatem. Funkce a pravidla uchovávání dat se přitom mohou měnit, proto je třeba řídit se aktuálními podmínkami konkrétní služby.

Vypnutí trénování může být užitečnou volbou, ale neodstraňuje obchodní závazky, pravidla GDPR ani riziko, že uživatel zpřístupní údaje někomu, komu je poslat neměl. Soukromý režim prohlížeče také není totéž co soukromý režim AI služby.

Jak připravit dotaz bez citlivých údajů?

Začněte tím, že pojmenujete cíl: „Vysvětli mi, co znamená tento obecný termín,“ nebo „Navrhni zdvořilou odpověď na opožděnou objednávku.“ Poté vložte jen informace potřebné pro konkrétní úkol. Skutečné hodnoty nahraďte obecnými, ale zachovejte strukturu problému.

Před odesláním zkontrolujte celý obsah včetně příloh. Pokud údaje nelze účinně anonymizovat a bez nich nelze úkol vyřešit, zvažte použití autorizovaného nástroje nebo jiného postupu. Nejúčinnějším bezpečnostním krokem často bývá to, že se zbytečné údaje do konverzace vůbec nedostanou.

Zdroje

  1. OpenAI – Data Controls FAQ (nastavení využití konverzací a dočasných chatů) – https://help.openai.com/en/articles/7730893
  2. OpenAI – How your data is used to improve model performance (rozdíly mezi službami a využitím obsahu) – https://openai.com/policies/how-your-data-is-used-to-improve-model-performance/
  3. UK National Cyber Security Centre – AI and cyber security: what you need to know (chyby modelů a bezpečnostní rizika) – https://www.ncsc.gov.uk/guidance/ai-and-cyber-security-what-you-need-to-know

Gabriel Čatár

Zajímají mě věci, se kterými se setkáváme každý den, ale často nevíme, jak vlastně fungují. Od technologií a financí přes praktické návody až po zajímavosti ze světa. Na Offpitchi se věnuji tématům, u kterých stojí za to jít trochu více do hloubky, ověřit si fakta a vysvětlit je jednoduchým způsobem. Mým cílem je, aby si čtenář z každého článku odnesl něco užitečného.