AI-agendi andmeturve ei sõltu ühest linnukesest ChatGPT seadetes. Kõigepealt tuleb piirata andmeid, mida agent näeb, ja kes talle ligipääsu annab. Seejärel tuleb teada, kus agent töötab ja mida teenusepakkujad säilitavad. Tegevused peavad jääma hiljem kontrollitavaks.

Kui pakkuja vastab andmeturbe küsimusele ainult lausega „andmeid ei kasutata mudeli treenimiseks”, on vastus poolik. Treenimine, säilitamine, ligipääs ja andmete liikumine on neli eri küsimust.

„Ei kasutata treenimiseks” ei tähenda „ei säilitata”

Mudeli treenimise saab mitmes OpenAI tarbeteenuses välja lülitada. See tähendab, et uusi vestlusi ei kasutata mudelite parandamiseks. See ei tähenda automaatselt, et vestluse sisu, üles laaditud failid või tehnilised logid kustutatakse kohe pärast vastuse saamist.

Näiteks võivad eraldi säilitamisreeglid kehtida:

  • vestlustele;
  • projektidesse lisatud failidele;
  • failikogule või Librarysse salvestatud failidele;
  • mälule;
  • ühendatud rakendustest kopeeritud andmetele;
  • brauseriandmetele;
  • turva- ja väärkasutuse logidele.

Seepärast ei tohi ettevõttele lubada, et „kõik andmed kaovad 30 päevaga”, enne kui on täpselt teada kasutatav pakett, töörežiim, ühendused ja säilitamisseaded.

ChatGPT Pro ei ole sama mis ChatGPT Business

OpenAI praeguse hinnastuse järgi algab ChatGPT Pro 100 dollarist kuus. See on individuaalne pakett, mille peamine väärtus on suurem kasutusmaht. Pro ei muutu kõrgema hinna tõttu automaatselt ettevõtte andmekaitsepaketiks.

ChatGPT Business on eraldi ettevõtte tööruum. OpenAI toob selle juures välja, et äriandmeid ei kasutata mudelite treenimiseks vaikimisi ning paketis on eraldi tööruum, mitmeastmeline autentimine ja põhilised haldusvõimalused. Business eeldab vähemalt kaht kasutajat.

Business on tugevam lähtekoht siis, kui ettevõte vajab keskset tööruumi ja kasutajate haldust. Suure koormusega agendi puhul võib otsustavaks saada hoopis kasutuslimiit. OpenAI hinnastuse järgi annab 100-dollarine Pro viis korda ja 200-dollarine Pro 20 korda rohkem Codexi kasutusmahtu kui Plus.

Kui agent autenditakse OAuthi kaudu kliendi enda Pro kontoga, võib Pro olla tehniliselt õige valik. Sel juhul peab turve tulema eraldi kontrollidest, sest individuaalne Pro konto ei anna Businessi halduskihti.

Kuidas kaitsta OAuthiga ühendatud Pro kontot?

OAuth vähendab vajadust jagada agendile kliendi parooli. Samal ajal saab OAuthi uuendustõendist võti, millega agent võib kliendi nimel tellimust kasutada. Seda tuleb käsitleda nagu parooli.

Turvaline ülesehitus tähendab, et:

  1. Pro konto kuulub kliendile ja seda ei jagata töötajate vahel.
  2. Kontol on treenimiseks kasutamine välja lülitatud ning aktiveeritud mitmeastmeline autentimine.
  3. OAuthi tõend salvestatakse krüpteeritult või operatsioonisüsteemi võtmehoidlasse, mitte lähtekoodi, tavatekstiga konfiguratsioonifaili ega logisse.
  4. Agendile antakse kliendi süsteemides ainult tööks vajalikud õigused.
  5. Rakenduse logidesse ei kirjutata päringute, failide ega vastuste täissisu. Säilitatakse ainult vea uurimiseks vajalik metaandmestik.
  6. Logidele määratakse automaatne kustutustähtaeg.
  7. Koostöö lõppedes tühistab klient OAuthi ühenduse ja kustutab kohalikud tõendid.

Oluline piir on omand. Kliendi konto, OAuthi nõusolek ja ühenduse tühistamise õigus peavad jääma kliendile. Automajestic ei pea hoidma kliendi parooli ega kasutama enda tellimust kliendi töö jaoks.

ChatGPT ja API on kaks eri andmekäitluse kihti

ChatGPT on kasutajaliides, kuhu inimene lisab vestlusi ja faile. ChatGPT tellimusega OAuthi kaudu autenditud agent kasutab selle tellimuse kasutusmahtu. API-võtmega ehitatud agent kasutab aga API arveldust ja andmekäitlusreegleid. Neid ei tohi andmeturbe kirjelduses kokku segada.

OpenAI API dokumentatsiooni järgi ei kasutata API kaudu saadetud andmeid mudelite treenimiseks, kui klient ei ole selleks ise nõusolekut andnud. Samal ajal võivad vaikimisi kehtida kuni 30-päevased väärkasutuse jälgimise logid. Mõni API funktsioon võib säilitada rakenduse olekut kauem, kuni see kustutatakse. Nullsäilituse ehk Zero Data Retentioni võimalus sõltub kliendi sobivusest, kinnitamisest ja kasutatavast funktsioonist.

Praktiline järeldus on lihtne: säilitamisreegel tuleb kirjutada konkreetse tehnilise lahenduse, mitte üldise müügilause järgi.

Turvaline AI-agent näeb ainult vajalikku

Kõige tugevam kaitse ei ole lubadus, et mudel ei eksi. Tugevaim kaitse on väikseim vajalik ligipääs.

Kui agent koostab saabunud päringust pakkumise mustandit, ei vaja ta tõenäoliselt ligipääsu kogu ettevõtte failiserverile. Talle võib piisata ühest sisendkaustast, hinnakirja kontrollitud koopiast ja õigusest luua mustand selleks ette nähtud kausta.

Hea lahendus kasutab vähemalt järgmisi põhimõtteid:

  1. Agendil on eraldi kasutajakonto, mitte töötaja isiklik konto.
  2. Ligipääs antakse ainult vajalikele kaustadele ja süsteemidele.
  3. Kirjutamisõigus eraldatakse lugemisõigusest.
  4. Kustutamine, saatmine ja kinnitamine nõuavad inimese otsust.
  5. Agendi tegevused logitakse arusaadavalt.
  6. Ligipääsu saab ühe sammuga peatada.

Nii muutub võimalik viga piiratud juhtumiks, mitte kogu ettevõtte andmeid puudutavaks riskiks.

Kus agent tegelikult töötab?

AI-agent võib töötada ettevõtte arvutis, eraldatud serveris või pilvekeskkonnas. Ükski neist ei ole iseenesest alati turvalisem. Oluline on andmevoog.

Ka kohapealses arvutis töötav agent võib saata osa sisust välisele mudelipakkujale. Pilves töötav agent võib omakorda saada ainult anonümiseeritud või rangelt piiratud sisendi. Seetõttu peab arhitektuurijoonis vastama vähemalt neljale küsimusele:

  • Milline fail või andmeväli liigub ettevõttest välja?
  • Millisele teenusepakkujale see saadetakse?
  • Kui kaua teenusepakkuja andmeid säilitab?
  • Milline osa tulemusest salvestatakse tagasi ettevõtte süsteemi?

Kui neid vastuseid ei ole, ei ole veel andmeturbe lahendust. On ainult oletus.

Ühendatud rakendused loovad eraldi riski

Kui ChatGPT või AI-agent ühendatakse Google Drive’i, Microsoft 365, CRM-i või ERP-iga, hakkavad kehtima ka ühendatud süsteemi õigused ja säilitamisreeglid. Ühenduse eemaldamine ei pruugi kustutada infot, mis on juba vestlusse, faili või eraldi indeksisse kopeeritud.

Seepärast tasub iga ühenduse puhul määrata:

  • milline konto ühenduse loob;
  • millistele kaustadele või objektidele ligipääs antakse;
  • kas agent võib ainult lugeda või ka muuta;
  • millal ühendus automaatselt aegub;
  • kes kontrollib ligipääse pärast töötaja rolli muutumist.

Seitse küsimust AI-pakkujale

Enne päris kliendiandmete kasutamist küsi pakkujalt kirjalikult:

  1. Millist mudelit, API-t ja töörežiimi lahendus kasutab?
  2. Millised andmed liiguvad ettevõtte võrgust välja?
  3. Kas andmeid kasutatakse treenimiseks ja mis on selle seadistuse tõend?
  4. Millised logid, failid ja rakenduse olekud säilivad ning kui kaua?
  5. Kes pääseb andmetele ligi Automajesticus, mudelipakkuja juures ja kliendi ettevõttes?
  6. Kuidas piiratakse agendi lugemis-, muutmis-, saatmis- ja kustutamisõigusi?
  7. Kuidas eemaldatakse andmed ja ligipääsud koostöö lõppedes?

Hea vastus ei pea olema pikk. See peab olema konkreetne ja kontrollitav.

Andmeturve algab töövoo piiramisest

AI-agent ei vaja esimesel päeval kogu ettevõtte teadmisi. Turvalisem on alustada ühest korduvast töövoost, väikesest ajalooliste näidisfailide kogust ja mustandirežiimist. Agent valmistab tulemuse ette, inimene kontrollib ja alles seejärel liigub info järgmisse süsteemi.

Selline ülesehitus ei aeglusta juurutamist. Vastupidi: see võimaldab päris tööga katsetada ilma, et esimene versioon saaks teha pöördumatuid otsuseid.

Korduma kippuvad küsimused

Kas ChatGPT seadetes treenimise väljalülitamisest piisab?+
Ei. See piirab andmete kasutamist mudeli parandamiseks, kuid ei määra üksi vestluste, failide, mälu, ühendatud rakenduste ja turbelogide säilitamist.
Kas ChatGPT Pro sobib konfidentsiaalsete kliendifailide töötlemiseks?+
Pro võib sobida suure koormusega agendile, kui konto kuulub kliendile, ühendus tehakse OAuthiga ja treenimiseks kasutamine on välja lülitatud. Pro ei anna Businessi halduskihti. Seetõttu tuleb OAuthi tõend, ligipääsud, rakenduse logid ja ühenduse tühistamine eraldi kontrollida.
Kas kohapealne AI-agent tähendab, et andmed ei lahku ettevõttest?+
Mitte tingimata. Kohapealne agent võib kasutada välist mudeli API-t. Otsustav on see, milline sisu saadetakse mudelile ja milliste tingimustega seda töödeldakse.
Kas andmed kustutatakse alati 30 päeva pärast?+
Ei. Mõne teenuse puhul kehtib 30-päevane logiperiood, kuid vestlustel, projektifailidel, mälul ja ühendatud rakenduste koopiatel võivad olla teised reeglid.

Allikad

Kui tahad enne AI-agendi ehitamist oma andmevoo ja ligipääsud läbi kaardistada, räägime 30 minutit.