Данни в публичен AI: къде отива договорът за десет минути, статия на Мариела Славенова, собственик на Маринекст ЕйАй

Данни в публичен AI: къде отива договорът за десет минути

Служителят ви обобщава клиентски договор с AI за десет минути. Спестява половин час, връща се към следващата задача и забравя за него. Договорът обаче не е забравил за никого: копие от него вече е на сървър, който не е ваш.

Повечето разговори за AI и данни се въртят около това дали инструментът е „сигурен“. По-важният въпрос е друг: къде отива информацията, след като напусне компанията ви, и кой може да я види след това.

Ето същината, преди подробностите: когато подадете фирмени данни в публичен AI, вие ги изнасяте от контрола си. При безплатните и личните планове тези данни по подразбиране могат да се използват за обучение на модела, а веднъж попаднали там, не се връщат. Затова въпросът не е дали да ползвате AI, а какво никога не бива да минава през публичен инструмент.

Важното накратко

  • При безплатните и личните планове на популярните AI инструменти разговорите по подразбиране могат да се използват за обучение на модела. При бизнес и корпоративните планове, както и през API, това не се случва по подразбиране.
  • Изтриването е с уговорка. Може да спрете обучението отсега нататък, но данни, вече попаднали в завършено обучение, не могат да бъдат извадени обратно.
  • По GDPR вие сте администратор на данните на клиенти, служители и кандидати. Отговорността кои данни напускат компанията е ваша, не на инструмента.
  • Правилото, което пести най-много главоболия, е кратко: чувствителните и личните данни не влизат в публичен AI без корпоративна среда и ясни вътрешни правила.

Какво всъщност се случва с данните, след като ги подадете?

Отговорът зависи от един избор, който повечето хора не осъзнават, че правят: с какъв план ползват инструмента.

При безплатните и личните планове разговорите по подразбиране могат да послужат за обучение на бъдещи версии на модела. Това е официалната позиция на OpenAI за потребителския ChatGPT: съдържанието се използва за подобряване на моделите, освен ако изрично не изключите тази настройка. Същият принцип важи за повечето публични инструменти.

При бизнес, корпоративните и образователните планове, както и при достъпа през API, положението е обратно: по подразбиране данните не се използват за обучение. При OpenAI например данните, изпратени през API, не се използват за обучение по подразбиране още от 2023 г. Разликата не е в технологията. Тя е в договора и в плана.

Има и втора уговорка, която се пропуска най-често. Изключването на обучението действа занапред. Данни, които вече са влезли в завършено обучение на модел, не могат да бъдат извадени обратно, колкото и пъти да натиснете „изтрий“. Изтритият разговор напуска акаунта ви и се насрочва за окончателно премахване в рамките на около месец, но това е различно от това дали вече е послужил за обучение.

Важи и още едно разграничение, което често се разминава с представите на хората. Публичните инструменти са облачни: данните напускат вашата мрежа и отиват на чужди сървъри. Локалните или частните AI среди работят обратното, като държат информацията в рамка, която контролирате. За чувствителни данни това не е дребен детайл, а основен избор.

Разликата дали данните ви обучават чужд модел не е техническа. Тя е в плана, който ползвате, и в настройката, която почти никой не е отварял. Ако темата ви интересува в детайл, разгледал съм къде отиват данните в ChatGPT отделно.

Един и същ файл, две различни съдби

Представете си, че служител трябва да обобщи оферта към клиент. Една задача, но изходът зависи изцяло от това през какъв достъп минава файлът.

По първия път служителят отваря безплатния личен ChatGPT в браузъра и поставя офертата. Няма договор между вашата компания и доставчика, разговорът по подразбиране може да послужи за обучение, а данните напускат контрола ви още в момента на поставянето.

По втория път същият служител ползва корпоративен план или API с подписан договор за обработка на данни. Задачата е абсолютно същата, резултатът за служителя изглежда еднакъв, но данните не обучават чужд модел и остават в рамка, за която отговаряте.

Един и същ файл, един и същ въпрос към AI, две напълно различни съдби за информацията. Разликата не се вижда на екрана. Тя е в акаунта и в договора зад него.

Кои данни никога не бива да минават през публичен AI?

Не всяка задача носи риск. Обобщаването на публична статия е безобидно. Проблемът започва, когато информацията е чужда, поверителна или лична.

Ето какво не бива да влиза в публичен AI инструмент:

  • Клиентски договори, оферти и фактури. Това е чужда търговска информация, поверена ви под условие.
  • Лични данни на служители и кандидати. Автобиографии, ЕГН, адреси, оценки, здравна информация.
  • Вътрешна кореспонденция и търговски тайни. Стратегии, цени, ноу-хау, изходен код.
  • Идентификатори и пароли. Достъпи, ключове, токени.
  • Специални категории лични данни. Здраве, етнос, вероизповедание и други, които GDPR защитава с най-строгите правила.

Простото правило: ако не бихте изпратили информацията на непознат по имейл, не я подавайте и на публичен AI.

Как това правило се превръща в защита на цялата фирмена информация съм описала в текста за защита на фирмените данни.

Какво изисква GDPR, когато служител подаде лични данни?

Тук темата спира да е за удобство и става за отговорност. Когато данните са лични, влиза в сила GDPR, и ролите са ясни.

Вие сте администратор на личните данни на вашите клиенти, служители и кандидати. Публичният инструмент, на който служителят подава тези данни, става техен обработващ, но без договор за обработка на данни между вас и доставчика. Това само по себе си е пропуск.

Освен това ви трябва законово основание да обработвате тези данни по този начин, а специалните категории лични данни имат отделна, по-строга защита. Ако данните напускат Европейския съюз към сървър в трета държава, влизат и правилата за международно предаване.

Отговорността по GDPR е ваша и остава ваша. Не можете да я прехвърлите на инструмента, нито на служителя, който е натиснал „изпрати“. Именно затова вътрешното правило е по-евтино от последствието.

Това не е теоретично. Италианският надзорен орган още през 2023 г. временно ограничи ChatGPT именно заради опасения за защита на личните данни. Европейските регулатори следят как публичните AI инструменти обработват лични данни.

GDPR не пита кой инструмент сте избрали. Пита дали сте останали администратор на данните, които сте поверили на някого другиго.

„Но ние просто дебъгвахме“: какво научи Samsung

През 2023 г. Samsung отвори достъп до ChatGPT за свои инженери. За по-малко от месец, в три отделни случая, поверителна информация напусна компанията през чата: единият инженер постави изходен код на база данни, за да търси решение на проблем, друг подаде транскрипция на вътрешно фирмено съвещание, за да си направи протокол. Малко след това Samsung забрани генеративния AI на служителите си.

Причината не беше злонамереност. Беше удобство. И щом кодът вече е на чужд сървър, той не може да бъде върнат обратно.

Никой от служителите на Samsung не е искал да навреди. Точно това е рискът: изтичането изглежда като продуктивност.

Разликата между Samsung и повечето компании не е в това колко често се случва подобно нещо, а в това, че Samsung го е забелязал навреме. Повечето организации нямат тази видимост и научават за проблема едва когато вече е късно. Именно този тип неофициална употреба е сред най-подценяваните рискове от AI в бизнеса.

Значи да забраним AI на екипа?

Не. Това е грешният извод.

Забраната изглежда като контрол, но прави обратното. Тя не премахва употребата, а я изтласква в сянка: същите хора продължават да ползват AI, само че вече от личните си акаунти и без ваша видимост. Проблемът, който искате да решите, просто изчезва от погледа ви.

Правилният отговор е в три части.

Първо, дайте на екипа безопасна среда: корпоративен план или API, където данните не обучават чужд модел.

Второ, запишете ясно кои данни не влизат никъде навън.

Трето, обучете хората защо, а не само какво, защото правило без разбиране се заобикаля. Тази AI грамотност на екипа е това, което държи правилото живо в ежедневието.

Тези три неща заедно са част от петте стълба на AI готовността, които подреждат готовността по хора, процеси, данни, управление и технологии.

Забраната не премахва употребата. Тя само я скрива от вас.

Често задавани въпроси

Ако изтрия разговора, данните изтриват ли се?

Изтритият разговор напуска акаунта ви и се насрочва за окончателно премахване в рамките на около месец. Това обаче е различно от обучението: данни, които вече са влезли в завършено обучение на модел, не могат да бъдат извадени обратно. Затова превенцията тежи повече от изтриването.

Безопасно ли е, ако изключа обучението в настройките?

По-добре е, но не е пълно решение. Настройката действа занапред и покрива само вашия акаунт. Тя не спира колега, който ползва личния си профил, нито друг инструмент. За чувствителни данни ползвайте корпоративна среда или API с договор, а не потребителския интерфейс.

Каква е разликата между публичен и корпоративен AI?

Планът и договорът. При бизнес, корпоративните и API достъпа данните по подразбиране не се използват за обучение и е възможен договор за обработка на данни. При безплатния и личния план тези гаранции липсват, а обучението често е включено по подразбиране.

Кои данни са най-рискови?

Личните данни на хора: клиенти, служители и кандидати, особено специалните категории по GDPR като здравна информация. Веднага след тях са търговските тайни и изходният код.

Откъде да започнем?

От списък, не от софтуер. Кои инструменти се ползват, какви данни минават през тях и кой има право да ги ползва. Бърза начална снимка на състоянието дава самооценката AI Ready Score, а след нея идват едно кратко правило и обучение на екипа.

Границата се тегли преди инцидента, не след него

Данните, които напускат компанията през един отворен раздел в браузъра, рядко се връщат. Но това не е присъда, а въпрос на граница.

Компаниите, които теглят тази граница предварително, ползват AI спокойно и с предимство. Останалите я научават от инцидент, обикновено със скъпа поука.

Ако искате екипът ви да знае точно какво може и какво не може да подава, обучението какво не даваме на AI минава през това с примери от български бизнес, без код и без жаргон.


Аз съм Мариела Славенова, основател на Marinext AI и създател на AI Ready Standard, стандарт за AI готовност на бизнеса. Помагам на организации да заменят удобните митове с ясни числа и работещи системи.

Table of Contents

ОЩЕ ОТ БЛОГА

Потопете се в света на AI с Мариела

Почти всеки разговор с потенциален клиент започвам с въпроса: Знаете ли каква е разликата между автоматизация на бизнес процеси и AI агент? И в следващите

Един адвокат в Ню Йорк подава становище до съда с шест позовавания на предишни дела. Делата изглеждат истински: имена, цитати, номера. Само че нито едно

Маркетинг специалистът ви пише текст за кампания с ChatGPT. Счетоводителят проверява формула. Един от търговците подготвя оферта. Никой не е питал, никой не е забранявал,

Служителят ви обобщава клиентски договор с AI за десет минути. Спестява половин час, връща се към следващата задача и забравя за него. Договорът обаче не

В петък следобед някой във фирмата ви пуска клиентски договор в ChatGPT, за да го обобщи за десет минути преди срещата. Никой не е написал

За съжаление лятната ваканция вече приключи. Моето лято не мина съвсем в почивка. През последните два месеца доразвих един личен проект, който първоначално подготвих за