Přístup k datům a RAG
Generování obohacené o vyhledávání vytváří bezpečnostní hranici kolem toho, které zdroje mohou být prohledávány, jaká oprávnění se vztahují, a jaký důkaz identifikuje zdroj odpovědi.
Klasifikace před připojením
Použijte malý, vynutitelný klasifikační model, například:
| Třída | Příklady | Politika přístupu AI |
|---|---|---|
| Veřejné | Publikované webové stránky a veřejná dokumentace | Může být používáno veřejnými agenty po kontrole obsahu |
| Interní | Postupy a obecné znalosti společnosti | Ověření uživatelé a schválené týmy |
| Důvěrné | Zákaznická, finanční, právní, HR nebo obchodní data | Pojmenované týmy, explicitní vlastník, žádný přístup veřejného agenta |
| Omezené | Přihlašovací údaje, vysoce regulované záznamy, privilegovaná bezpečnostní data | Nepřijímat, pokud schválený případ použití to nevyžaduje a kontroly nejsou zdokumentovány |
Požadované kontroly
Pro každou sbírku dat:
- Přiřaďte obchodního vlastníka a technického vlastníka.
- Zaznamenejte její klasifikaci, účel, zdrojový systém a očekávané uživatele.
- Připojte pouze zdroje potřebné pro účel agenta.
- Zachovejte identitu zdroje a užitečné metadata pro sledovatelnost.
- Konzistentně vynucujte přístup organizace, týmu, uživatele a sbírky.
- Oddělte veřejné znalosti od interních a zákaznických specifických znalostí.
- Definujte postupy pro obnovu, odstranění a revizi přístupu.
- Otestujte, že neoprávněný uživatel nemůže získat nebo odvodit omezený obsah.
Získaný obsah je nedůvěryhodný
Dokument může obsahovat škodlivé instrukce, i když má uživatel povolení jej číst. Agent by měl používat získaný text jako důkaz, nikoli jako novou autoritu. Spojte oprávnění pro vyhledávání s kontrolami v Vstřikování příkazů.
Pro nastavení produktu a provozní kontroly vizte Správa sbírek dat a zdrojů a Sbírky dat.