소셜 미디어 플랫폼의 인공지능은 사용자의 콘텐츠를 학습합니다. 이를 (경우에 따라) 막는 방법은 다음과 같습니다.

소셜 미디어 플랫폼은 사용자의 콘텐츠를 인공지능 모델 학습에 활용합니다. 데이터를 보호하고 이러한 활용을 제한하기 위해 취할 수 있는 조치에 대해 알아보세요.

가장 중요한 사항들

  • 대부분의 소셜 미디어 플랫폼은 로그인을 인공지능 모델 학습을 위한 데이터 사용에 대한 동의로 간주하므로, 많은 경우 이러한 학습에서 제외되기가 어렵거나 불가능합니다.
  • LinkedIn, Snapchat, Twitch, X와 같은 플랫폼 사용자는 전용 개인 정보 보호 또는 보안 설정을 통해 자신의 데이터에 대한 AI 학습을 중지할 수 있습니다.
  • 페이스북, 인스타그램, 레딧, 틱톡과 같은 주요 플랫폼은 AI 학습에서 직접 제외되는 옵션을 제공하지 않으며, 계정을 삭제하는 것이 유일한 해결책인 경우가 많습니다.

아마존 소유의 트위치는 최근 라이브 스트림, 주문형 비디오, 채팅 내용이 AI 모델 학습에 사용되는 것을 사용자가 선택적으로 거부할 수 있도록 하겠다고 발표해 화제가 되었습니다 . 당연히 많은 비판을 받았지만 , 트위치는 이러한 측면에서 비교적 온건한 소셜 미디어 플랫폼일 수 있다는 분석이 나왔습니다. 대부분의 소셜 미디어 앱은 사용자의 데이터를 기반으로 AI를 학습시키지만, 간단한 토글 버튼 하나로 거부할 수 있는 옵션을 제공하는 앱은 드뭅니다.

소셜 미디어 플랫폼의 인공지능은 사용자의 콘텐츠를 학습합니다. 이를 (경우에 따라) 막는 방법은 다음과 같습니다.

요즘 거의 모든 소셜 미디어 플랫폼은 사용자의 데이터가 정확히 어떻게 사용되는지 파악하기 매우 어렵게 만들어 놓았습니다. 구글의 제미니와 같은 생성형 AI 모델은 유튜브 알고리즘처럼 (여전히 머신러닝 기반이지만) 기존의 기능과 혼합되어 사용되는 경우가 많습니다 . 소셜 앱이 논란이 되고 있는 이러한 생성형 AI에 관여하고 있는지 개인정보 처리방침을 샅샅이 뒤져 확인하는 것은 대부분의 변호사조차도 꺼릴 만한 일입니다.

내 데이터가 어떻게 사용되는지 알아낸다고 해도, 많은 사이트는 데이터 수집 거부 옵션을 제공하지 않습니다. 제가 살펴본 모든 사이트 중 AI 학습에 사용되는 사이트는 데이터 수집 동의 양식을 제공하지 않았습니다. 즉, 오늘 로그인하면 해당 기술 기업들은 사용자가 학습 데이터에 포함되는 것에 동의한 것으로 간주합니다. 하지만 소셜 미디어 사이트에서 AI 학습을 거부할 수 있는 방법이 있다면, 아래 알파벳 순서로 정리된 목록에서 확인하실 수 있습니다.

BLUESKY

어떤 종류의 학습을 진행하시나요? 공식적으로 블루스카이는 AI 모델을 직접 학습시키지는 않습니다. 하지만 개발 과정에서 AI를 활용하고 AI 기반 기능을 구축하고 있습니다 . 블루스카이는 탈중앙화된 AT 프로토콜을 사용하기 때문에 사용자의 게시물(그리고 차단한 사용자 등 다른 많은 데이터 )이 공개됩니다. 따라서 거의 모든 사람이 사용자의 게시물을 수집하여 AI 학습에 활용할 수 있습니다.

이 문제를 해결하려면 어떻게 해야 할까요? 사실 특별히 할 일은 없습니다. 블루스카이는 사용자의 게시물을 AI 학습에 사용하지 않기 때문입니다. 하지만 제3자가 사용자의 데이터를 수집하는 것이 걱정된다면 블루스카이에 게시물을 올리는 것을 중단하는 것이 좋습니다.

Facebook

어떤 종류의 훈련을 하고 있는 걸까요? 어쩌면 더 쉬운 질문은 "페이스북은 어떤 데이터를 AI 훈련에 사용하지 않는 걸까?"일지도 모릅니다. 작은 나라의 GDP에 해당하는 금액을 들여 실현되지도 않은 메타버스 프로젝트를 진행했던 페이스북의 모회사 메타는 이제 AI에 집중하며 오픈AI , 앤스로픽, 구글 같은 기업들을 따라잡기 위해 고군분투하고 있습니다. 페이스북의 AI 훈련 데이터 사용 정책은 매우 광범위하여 페이스북 게시물, 사진, 상호작용뿐 아니라 제3자 중개업체를 통해 수집한 데이터와 "온라인에서 이용 가능한 정보"까지 포함합니다. 이 표현이 너무 포괄적이어서 페이스북이 수집한 데이터 중 사용하지 않을 데이터가 무엇인지 상상하기조차 어렵습니다. 페이스북은 친구나 가족과의 개인 메시지만 AI 훈련에 사용하지 않는다고 밝히고 있지만, "대화 참여자 중 본인이 해당 메시지를 AI 시스템과 공유하기로 선택한 경우는 예외"라고 덧붙였습니다.

이 문제를 해결하려면 어떻게 해야 할까요? 안타깝게도 유럽 연합에 거주하지 않는 한 , 페이스북은 사용자의 데이터를 활용한 AI 학습을 거부할 수 있는 옵션을 제공하지 않습니다. 다만, 법적으로 의무가 있는 경우에 한해, AI 도구의 답변에 사용자의 개인 식별 정보가 포함된 특정 상황에 대해서는 예외를 적용합니다. 이러한 경우, 페이스 북에 신고 할 수 있으며, 페이스북은 이를 검토하여 조치를 취할지 여부를 결정합니다.

하지만 Meta는 페이스북의 AI 도구와 상호작용하는 것을 사용자의 상호작용 기록을 바탕으로 향후 AI 모델을 학습시키는 데 동의하는 것으로 간주한다는 점을 기억해야 합니다. 따라서 개인 정보가 수집되었는지 확인하려는 시도조차도 더 많은 정보 유출에 노출될 수 있습니다. 결국 페이스북과의 관계에서 이기는 유일한 방법은 참여하지 않는 것 같습니다 . 다만 페이스북 계정을 삭제하더라도 페이스북이 사용자의 데이터를 이용해 AI를 학습시키는 것을 완전히 막을 수는 없다는 점을 유념해야 합니다. 계정을 삭제하면 페이스북 계정에서 직접 데이터에 접근하는 것만 차단될 뿐입니다.

인스타그램

어떤 종류의 교육을 진행하고 계신가요? 인스타그램은 페이스북의 모회사인 메타 소유이기 때문에, 많은 정책들이 앞서 페이스북에 대해 논의했던 내용과 유사합니다. 하지만 인스타그램 자체에도 몇 가지 문제가 있는데, 예를 들어 '뮤즈' 기능은 한때 사용자들이 인공지능을 이용해 다른 사람의 이미지를 동의 없이 합성할 수 있도록 허용했다가, 그 위험성을 깨닫고 곧바로 삭제했습니다.

이런 상황을 막으려면 어떻게 해야 할까요? 페이스북과 마찬가지로, AI 답변에 개인 정보가 포함된 것을 발견하면 이의를 제기 할 수 있고, EU에 거주하는 경우 학습 자체를 거부할 수도 있습니다. 아니면, 인스타그램 계정을 삭제하거나 최소한 비공개로 설정하는 방법밖에 없습니다.

링크드인

어떤 종류의 교육을 진행하고 계신가요? 링크드인은 마이크로소프트 소유이며, 마이크로소프트는 인공지능 분야에 적극적으로 참여하고 있는 것으로 알려져 있습니다( 물론 오락 목적으로만 사용해야 합니다). 따라서 링크드인이 사용자의 데이터를 AI 학습에 활용할 가능성을 경계해야 합니다. 링크드인의 공식 정책 에 따르면 , 사용자의 게시물, 댓글, 프로필 정보, 자기소개, 그룹 활동 등 다양한 유형의 데이터가 AI 모델 학습에 사용될 수 있습니다. 특히 링크드인은 작년에 다이렉트 메시지(DM)를 이용해 AI를 학습시켰다는 의혹으로 소송을 당했는데, 링크드인은 이 의혹을 부인했습니다. 이러한 문제들은 AI 봇의 보안 과 데이터 활용 방식에 대한 의문을 제기합니다.

이 문제를 해결하려면 어떻게 해야 할까요? LinkedIn은 대부분의 회사와 마찬가지로 "사전 동의를 구하는" 방식을 사용하지만, 적어도 사용자가 권한을 철회할 수 있도록 허용합니다. LinkedIn에서 설정 및 개인 정보 > 데이터 개인 정보 > LinkedIn에서 내 데이터를 사용하는 방법 > 생성형 AI 개선을 위한 데이터 로 이동하세요 . 여기에서 기본적으로 활성화되어 있는 "콘텐츠 제작 AI 모델 학습에 내 데이터 사용"이라는 토글 스위치를 찾을 수 있습니다. 이 스위치를 끄세요. 참고: 이 기능은 LinkedIn에서 수집된 데이터에만 적용되며, 더 넓은 Microsoft 생태계에는 적용되지 않습니다.

레딧

레딧은 어떤 종류의 학습을 진행하고 있을까요? 상황은 복잡합니다. 레딧은 자체적으로 AI 모델을 학습시키지는 않지만, 오픈AI 와 구글 과 계약을 맺고 자사 데이터를 활용해 이들의 모델을 학습시키고 있습니다. 이러한 모델들을 더 자세히 비교하려면, 제미니가 챗GPT에서 아직 부족한 기능들을 살펴보세요 . 레딧은 이러한 계약 종료를 고려하고 있는 것으로 알려져 있습니다 (적어도 다른 많은 기업들과 마찬가지로 AI가 검색 점유율을 잠식하면서 트래픽이 감소했기 때문입니다). 하지만 AI 모델은 이러한 계약이 공식화되기 훨씬 이전부터 레딧 데이터를 기반으로 학습되어 왔기 때문에, 공식적인 파트너십을 종료한다고 해서 AI 기업들이 공개적으로 이용 가능한 데이터를 최대한 많이 수집하는 것을 막을 수 있을지는 단정하기 어렵습니다.

이 문제를 해결하려면 어떻게 해야 할까요? 레딧 계정을 삭제하고 게시물 작성을 완전히 중단하는 것 외에는 할 수 있는 일이 없습니다. 레딧은 현재 AI 학습을 비활성화하는 도구를 제공하지 않습니다. 설령 그런 도구가 있다고 하더라도, AI 기업들은 이미 오래전부터 공개적으로 이용 가능한 게시물들을 수집해 왔습니다.

Snapchat

스냅챗은 어떤 방식으로 AI 모델을 훈련시키나요? 대부분의 소셜 미디어 앱처럼 스냅챗은 사용자가 공개적으로 게시한 사진, 동영상, 오디오를 활용하여 생성형 AI 모델을 훈련시킵니다. 스냅챗은 이 데이터를 AI 스냅이나 AI 렌즈와 같은 기능 개발에 사용한다고 밝혔습니다. 스냅챗은 또한 퍼플렉시티의 AI 도구를 검색 기능에 통합하기 위한 계약을 체결한 적이 있지만, 작년에 광범위한 출시를 앞두고 " 상호 합의 하에 해지 " 되었기 때문에 사용자 데이터가 퍼플렉시티와 공유되었거나 퍼플렉시티를 통해 훈련되었는지 여부는 불분명합니다.

이런 상황을 막으려면 어떻게 해야 할까요? 대부분의 소셜 미디어 앱과 달리 스냅챗에서 이 기능을 비활성화하는 방법은 비교적 간단합니다(다소 숨겨져 있긴 하지만). 앱 내에서 설정 으로 이동하여 개인정보 보호 설정 에서 ' 생성형 AI 설정'을 탭하세요 . 여기에서 '공개 콘텐츠 사용 허용' 토글을 비활성화하면 됩니다. 이렇게 하면 제3자가 공개적으로 이용 가능한 데이터를 수집하는 것이 완전히 불가능한 것은 아니지만, 스냅챗의 설계 덕분에 수집이 다소 어려워졌습니다. 더욱 안전하게 보호하고 싶다면 프로필에 영구적으로 공개되는 콘텐츠를 남겨두지 않는 것이 좋습니다.

스레드

어떤 방식으로 학습을 진행하나요? 스레드는 페이스북의 모회사인 메타 소유이므로 페이스북과 동일한 데이터 학습 정책을 따릅니다. 즉, 법적으로 절대적으로 요구되는 경우가 아니라면 스레드에 공개적으로 이용 가능한 데이터는 사용자의 동의 여부와 관계없이 AI 학습에 사용되며, 사용자는 이를 거부할 수 없습니다.

이 문제를 해결하려면 어떻게 해야 할까요? 유럽 연합(EU)에 거주하는 경우, 페이스북 계정과 동일한 절차로 이의를 제기 할 수 있습니다 . 미국(US) 사용자의 경우, AI의 답변에 개인 정보가 포함되었다는 증거를 제출하여 데이터 일부를 삭제해야 합니다. 그렇지 않으면 스레드 계정을 비공개로 설정하거나 완전히 삭제하는 방법밖에 없습니다.

틱톡 서비스

어떤 방식으로 훈련을 시킬까요? 틱톡의 AI 훈련 정책은 페이스북보다 더 복잡합니다. 틱톡이 올해 초 미국 사업부를 분사 시켜 독립 법인이 되었기 때문입니다. 일반적으로 틱톡의 모회사인 바이트댄스는 사용자 데이터를 기반으로 AI 모델을 훈련시키지만, 미국에서는 해당 데이터가 추천 시스템 훈련 등 다른 용도로 사용될 수 있으며, 바이트댄스의 일반 AI 모델 훈련에는 사용할 수 없습니다.

이를 막으려면 어떻게 해야 할까요? 페이스북처럼, 여러분의 데이터를 이용한 AI 학습을 거부하려면 해당 지역 법률에 위배되는 개인정보 침해에 대한 구체적인 이의 신청서를 제출해야 합니다. 다시 말해, 단순히 "제 데이터로 학습하지 마세요"라고 말하는 것만으로는 안 됩니다. 이 페이지를 방문하시면 거주 지역에 맞는 신청서 양식을 찾으실 수 있습니다.

이런 경우 보통 계정을 비공개로 설정하는 것이 최후의 수단이라고 하지만, 틱톡이 비공개 영상이나 저장하지 않은 초안 영상까지 이용해 AI 모델을 학습시킨다는 보고 가 있습니다 . 따라서 틱톡이 사용자의 데이터를 기반으로 AI를 학습시키는 것을 막는 가장 확실한 방법은 계정을 완전히 삭제하는 것입니다.

씰룩 씰룩 움직이다

어떤 종류의 학습을 진행하는 걸까요? 트위치의 정책에 따르면 라이브 스트림, VOD, 클립, 스트림 채팅은 물론 채널의 이미지와 텍스트까지 생성형 AI 모델 학습에 사용할 수 있습니다. 트위치가 이 데이터를 어떤 기능 개발에 활용할지는 정확히 알려지지 않았습니다. 트위치는 FAQ 페이지 에서 자막 기능과 같은 것을 언급하고 있지만 , 자동 자막 기능은 오늘날 우리가 알고 있는 생성형 AI 모델보다 훨씬 오래전부터 존재해 왔습니다.

이 문제를 해결하려면 어떻게 해야 할까요? 트위치에서 채널을 운영하고 있다면 트위치 보안 설정 으로 이동하여 '생성형 AI 학습' 항목을 찾아 비활성화할 수 있습니다. 이 옵션은 기본적으로 활성화되어 있으며, 트위치도 이것이 바람직하지 않다는 것을 알고 있습니다 . 중요한 점은 이 설정이 본인의 채널에만 적용된다는 것입니다 . 다른 사람의 스트림에 출연하거나 채팅에 참여하는 경우, 해당 사용자의 데이터 수집 거부 설정이 적용됩니다.

X

어떤 종류의 학습을 진행하는 걸까요? X는 단순히 사용자의 게시물과 공개 데이터를 Grok AI 모델 학습에 사용하는 데 그치지 않습니다. xAI 및 SpaceX와의 합병 이후에는 사용자의 데이터가 회사 전체의 AI 모델 학습에 사용될 가능성이 있습니다. 저는 사이트의 공개 정책을 바탕으로 추측만 할 수 있지만, SpaceX와 xAI의 CEO인 일론 머스크가 법적 절차는 물론 안전 절차까지 무시하는 것으로 악명 높다는 점을 유념해야 합니다 . 따라서 데이터 사용에 따른 위험을 평가하고 어떻게 처리할지 결정할 때 이 점을 고려해야 합니다.

이 문제를 해결하려면 어떻게 해야 할까요? 다행히 x는 사용자의 데이터를 기반으로 한 AI 학습을 거부할 수 있는 방법을 제공합니다. 설정 > 개인정보 및 보안 으로 이동하여 데이터 공유 및 개인 설정 까지 아래로 스크롤하세요 . 여기에서 Grok 및 타사 협력업체를 선택합니다 . 이 페이지에서 선택 해제할 수 있는 여러 항목이 있는데, 특히 "Grok 및 xAI와의 상호 작용, 입력 및 결과뿐 아니라 공개된 데이터를 학습 및 미세 조정에 사용하도록 허용합니다."라는 긴 문구를 선택 해제하는 것이 중요합니다.

유튜브

그들은 어떤 방식으로 학습을 시키고 있는 걸까요? 유튜브는 AI 학습 측면에서 개인정보 보호에 심각한 위협이 됩니다. 유튜브 계정이 구글 계정과 연결되어 있고, 구글은 유튜브의 AI 기반 요약 기능 에서 알 수 있듯이 AI 분야의 거대 기업 중 하나 이기 때문입니다. 구글이 사용자의 데이터(구글 계정 외부 데이터까지 포함)를 이용해 AI를 학습시키는 모든 방법과 이를 막는 방법을 모두 설명하려면 훨씬 더 방대하고 긴 가이드가 필요할 것입니다. 하지만 유튜브라는 좁은 범위 안에서만 보더라도, 구글은 채널 소유자(유튜버) 의 동의나 인지 없이 유튜브에 업로드된 동영상을 기반으로 동영상 생성 모델을 학습시키는 것으로 보입니다.

이 문제를 해결하려면 어떻게 해야 할까요? 유튜브를 자주 이용하는 사용자라면 구글 계정 설정에서 내 데이터를 기반으로 한 구글의 AI 학습을 최대한 차단하는 방법을 알아보는 것이 좋습니다 . 하지만 유튜브에 직접 영상을 업로드하는 경우는 상황이 완전히 다릅니다. 현재 구글은 사용자의 영상을 기반으로 AI 모델이 학습되는 것을 막을 수 있는 어떤 옵션도 제공하지 않습니다.

하지만 아이러니하게도 구글은 타사 모델 학습에 내 데이터를 사용하는 것을 거부할 수 있는 기능을 제공합니다. 이렇게 하려면 YouTube 크리에이터 스튜디오를 열고 설정 > 채널 > 고급 설정 으로 이동한 다음 , 타사 학습 섹션 까지 아래로 스크롤합니다 . 거기서 "타사에서 내 채널 콘텐츠를 사용하여 AI 모델을 학습하도록 허용" 옵션의 체크를 해제하면 됩니다.

댓글이 닫혔습니다.