The article's title on a dark background

Czy kiedykolwiek zastanawiało Cię, jak AI staje się coraz inteligentniejsza i każdego dnia udziela Ci lepszych odpowiedzi? To naturalne, ponieważ modele AI uczą się co sekundę, wykorzystując petabajty danych do nauki i doskonalenia. Skąd jednak biorą te dane? Co dzieje się z informacjami, które przesyłasz do ChatGPT, i czy korzystanie z AI jest w ogóle bezpieczne? W tym artykule rozkładamy ten temat na zrozumiałe zagadnienia i omawiamy zasady bezpiecznego korzystania z AI.

Źródła danych dla AI, czyli jak AI pozyskuje Twoje dane za Twoimi plecami

Twórcy modeli AI zazwyczaj mówią o wyjątkowych funkcjach tworzonych przez siebie narzędzi i o jeszcze większych możliwościach, które AI będzie mogła nam zaoferować w niedalekiej przyszłości. Nie są jednak tak rozmowni, gdy chodzi o ujawnianie źródeł danych wykorzystywanych do trenowania modeli. Zwykle można usłyszeć ogólne stwierdzenia, takie jak "Publicznie dostępne dane z internetu", "Licencjonowane od stron trzecich" czy "Dane własne", ale co to właściwie znaczy?

"Publicznie dostępne dane z internetu" to dane, które możesz znaleźć po prostu za pomocą wyszukiwarek. Obejmuje to dane ze stron internetowych i platform społecznościowych. Na przykład AI je posiada, jeśli kiedykolwiek coś opublikowałeś na Instagramie. Możesz usunąć posty lub zdjęcia ze swojego profilu, ale nie spowoduje to automatycznie usunięcia ich ze zbiorów danych wykorzystywanych przez AI.

Z drugiej strony, aby zdobyć tak dużą ilość danych, trzeba prowadzić web scraping przez całą dobę oraz mieć odpowiednią infrastrukturę i wykwalifikowany personel. Czasem samodzielne zdobycie wszystkich potrzebnych danych jest trudne, dlatego firmy mogą kupować informacje od innych firm specjalizujących się w web scraping. Innymi słowy, twórcy AI uzyskują licencje od stron trzecich. Jakie dokładnie mogą to być dane? Każde, jakie tylko możesz sobie wyobrazić. Takie bazy danych mogą zawierać nawet szczegóły z raportów medycznych lub dane lokalizacyjne. Problem polega na tym, że niektóre firmy nie są szczególnie wybiórcze przy tworzeniu zbiorów danych i mogą sprzedawać nawet wyciekłe, zhakowane lub w inny sposób nielegalnie pozyskane dane wrażliwe.

"Dane własne" to dane, które firmy same zbierają i generują. Obejmują treści tworzone przez Ciebie jako użytkownika oraz dane, które przesyłasz. Nie chodzi tylko o wpisywane zapytania czy przesyłane obrazy. Modele AI gromadzą również inne dane, takie jak identyfikator Twojego komputera, dane kontaktowe, historia wyszukiwania, dane o interakcjach z produktami i inne.

Na szczęście możesz kontrolować tę część, przynajmniej do pewnego stopnia. Wiele zależy tu od konkretnego modelu, z którego korzystasz. Na przykład Copilot, Jasper i Poe zbierają identyfikatory urządzeń oraz dane używane do śledzenia użytkowników. Dane te mogą później trafić w ręce brokerów danych lub pomagać w wyświetlaniu ukierunkowanych reklam w aplikacjach. Jasper idzie jeszcze dalej, zbierając dane o interakcjach z produktem, reklamach i inne dane dotyczące użytkowania, czyli wszystkie szczegóły aktywności w aplikacji.

ChatGPT wygląda na nieco bardziej godny zaufania niż inne narzędzia, ponieważ zbiera tylko 10 rodzajów danych z 35 możliwych. Nie śledzi danych ani nie korzysta z reklam stron trzecich w aplikacji. Możesz używać tymczasowych czatów z funkcją automatycznego usuwania albo poprosić o usunięcie danych osobowych. Nadal może jednak przechowywać Twoje czaty na swoich serwerach. Możesz ręcznie wyłączyć tę funkcję. Z drugiej strony nie jest jasne, czy działa ona wstecz w odniesieniu do starszych czatów.

Oczywiście nie można pominąć DeepSeek. Ten chiński model AI od pierwszego dnia po uruchomieniu zmienił zasady gry i może wydawać się stosunkowo bezpieczny, ponieważ zbiera tylko 11 rodzajów danych. Jest jednak poważny sygnał ostrzegawczy: DeepSeek przechowuje historię czatów użytkowników. Istnieje nie tylko ryzyko włamania na serwery i kradzieży Twoich danych, lecz także ryzyko, że Twoje dane trafią w ręce chińskiego rządu. W Chinach władze kontrolują internet, a firmy i dostawcy są zobowiązani do udostępnienia danych na żądanie. Poza tym, według Hacker News, DeepSeek już wcześniej mierzył się z wyciekami danych. W rezultacie ujawniono ponad milion czatów, kluczy API i innych danych wrażliwych.

Ciekawostka: Amazon, Samsung i wiele banków zakazały swoim pracownikom używania narzędzi AI do pracy. Samsung zrobił to po tym, jak pracownik przesłał fragment wrażliwego kodu. Skala tego zdarzenia wciąż pozostaje niewiadomą, ale Samsung obawia się niejasnego losu ujawnionych danych. Amazon postanowił unikać AI, gdy okazało się, że przykłady odpowiedzi ChatGPT przypominały wewnętrzne dane Amazon.

Jak się chronić?

Jeśli już myślisz o wyrzuceniu wszystkich gadżetów i zamieszkaniu w lesie, spokojnie – nie ma takiej potrzeby. Kilka prostych, ale skutecznych zasad może pomóc Ci chronić dane przed gromadzeniem i wykorzystywaniem przez AI wbrew Twojej woli:

  • Sprawdzaj uprawnienia instalowanych aplikacji i używanych botów AI. Jeśli aplikacja prosi o zbyt wiele uprawnień, przechowuje Twoje informacje albo nie daje możliwości zażądania usunięcia danych, rozważ całkowite usunięcie jej z urządzenia i skorzystanie z bezpieczniejszej alternatywy. Ta rada dotyczy szczególnie aplikacji, które proszą o uprawnienia niepotrzebne do prawidłowego działania. Na przykład edytor wideo z pewnością potrzebuje dostępu do galerii, ale dlaczego miałby potrzebować dostępu do kontaktów lub geolokalizacji? Pomyśl o tym.
  • Podczas instalowania aplikacji zezwalaj na jak najmniejszą liczbę uprawnień. Jeśli możesz czegoś zabronić, a aplikacja nadal działa poprawnie, zrób to.
  • Nie zaznaczaj pól bez zastanowienia – przed zainstalowaniem aplikacji lepiej przeczytać Politykę prywatności, Warunki świadczenia usług i inne dokumenty, aby wiedzieć, jak dana aplikacja będzie postępować z Twoimi danymi oraz czy może ujawniać informacje stronom trzecim.
  • Sprawdzaj kraj pochodzenia aplikacji, które zamierzasz pobrać. Pamiętaj, że kraje takie jak Chiny mają surową cenzurę, a działające tam firmy i dostawcy muszą współpracować z rządem na żądanie, w tym udostępniać dane użytkowników. Jeśli Ci to nie odpowiada, unikaj takich narzędzi.
  • Instaluj wyłącznie oficjalne aplikacje z autoryzowanych sklepów i unikaj zhakowanych lub nieoficjalnych wersji. Takie aplikacje mogą być pułapką na Twoje dane.
  • Uważaj na to, co publikujesz w internecie. Jeśli lubisz na bieżąco informować obserwujących w mediach społecznościowych o swoim życiu, nigdy przypadkowo nie ujawniaj danych osobowych.
  • Zachowaj ostrożność podczas korzystania z publicznego Wi-Fi lub darmowych proxy. Mogą one służyć do pozyskiwania Twoich danych. Najlepiej całkowicie ich unikaj. Jeśli musisz użyć sieci publicznej, rozważ dodanie VPN dla bezpieczeństwa. Rzetelni dostawcy, tacy jak ZoogVPN, pomogą Ci w kwestiach połączenia związanych z lokalizacją i ochronią Twoje dane. Jeśli szukasz proxy, DataImpulse pomoże Ci zapewnić płynny dostęp na całym świecie bez nadmiernego obciążania portfela. Poza tym, gdy korzystasz z proxy, działają one jako pośrednicy między Tobą a serwerem, do którego wysyłasz żądanie. Proxy łączą się w Twoim imieniu, chroniąc Cię przed bezpośrednim kontaktem. Dzięki temu Twoje dane pozostają bezpieczne, ponieważ aplikacje i boty widzą informacje proxy. To dodatkowo zwiększa Twoje bezpieczeństwo.
  • Nie przesyłaj do chatbotów AI danych wrażliwych, takich jak klucze API, hasła, kody PIN, skany dokumentów, dane kart kredytowych ani innych danych finansowych.

Podsumowanie

W erze AI celem są dane, a bezpieczeństwo wchodzi na nowy poziom. Poza tym nawet jeśli nie korzystasz z AI, nadal może ona mieć Twoje dane za pośrednictwem innych aplikacji i innymi drogami. Dlatego ważne jest, aby nauczyć się korzystać z botów, asystentów i aplikacji bez narażania swoich wrażliwych informacji. Możesz także używać dodatkowych narzędzi, takich jak proxy. Ponieważ wysyłają żądania w Twoim imieniu, Twoje dane pozostają ukryte, co utrudnia ich gromadzenie i wykorzystywanie. DataImpulse jest gotowe Cię wspierać, oferując uczciwą cenę $1 za 1 GB oraz całodobowe wsparcie ludzi 24/7 (bez botów AI), dzięki czemu możesz skupić się wyłącznie na swoich zadaniach bez martwienia się o bezpieczeństwo i prywatność. Aby rozpocząć, kliknij przycisk "Wypróbuj teraz" w prawym górnym rogu ekranu lub napisz do nas na adres [email protected].

Share article: