대화형 AI 9곳 분석: 대화 제목·프롬프트·스크린샷이 제3자 추적기로 전달됨
- IMDEA Networks 연구진이 웹·모바일 대화형 AI 서비스 9곳을 정적·동적 분석으로 조사해 제3자 광고·추적 서비스(ATS)의 존재와 데이터 흐름, 그리고 동의 선택·구독 등급·접근 제어가 대화 노출에 미치는 영향을 정리함
- Grok은 접근 제어 없는 대화 permalink를 노출해 추적기가 채팅 전체를 읽을 수 있었고, 공유 과정에서 TikTok이 Grok 대화 스크린샷을 받은 것으로 나타남
- 여러 제공자가 대화 제목, 프롬프트, 스크린샷 같은 대화 파생물을 지속적 사용자 식별자와 함께 제3자에게 전달했으며, 자동 생성된 제목에 "Salary 85k NYC: mortgage 280-350k" 같은 민감 정보가 남음
- 연구진은 이 관행을 GDPR과 ePrivacy 지침 맥락에서 분석하고 영향받는 제공자와 유럽 데이터보호기관에 책임 있는 공개 절차를 진행함
- 로이터 보도에 따르면 OpenAI는 2026년 초 미국 ChatGPT 무료 등급 사용자를 대상으로 Criteo와 광고 파일럿을 진행함
Hacker News opinions
permalink로 대화 전체가 노출된다는 게 제일 충격임. Grok은 접근 제어가 없어서 추적기가 URL만 알면 채팅 전체를 읽을 수 있었다더라.
그건 거의 무능 수준인데.
스크린샷이 제일 무섭지. 민감한 정보가 스크린샷에 우연히 남는 경우가 워낙 많으니까.
이걸 유출이라고 부를 수 있나? 처음부터 그게 계약의 목적인데. 조사는 해야겠지만 다 합법이겠지.
미국에선 그렇겠지만 EU 법으론 GDPR 위반 소지가 큼.
제목은 leak이 아니라 sell이라고 써야 함. 유출이라고 하면 데이터를 파는 쪽 책임이 사라지잖아.
URL에 UUID를 넣으면 프라이버시가 지켜진다고 착각하는 게 최악임. Perplexity도 과거 검색 URL로 들어가면 대화 전체가 보임.
UUID URL을 직접 공유하지 않으면 문제 없는 거 아님? 그 URL을 누가 추측하겠어.
Security by obscurity는 옛날부터 안 통하는 안티패턴임. Gemini도 공유를 누르면 공개 URL을 만들고, 그 URL이 브라우저와 미리보기, 검색엔진을 거치며 색인되는 경로가 너무 많음. Claude artifact가 통째로 구글에 색인된 적도 있음.
그건 비밀번호랑 같은 거 아닌가. 비밀번호를 알면 내 데이터가 다 보이잖아.
AI 회사들이 데이터를 그렇게 좋아하는데 광고 회사에 넘긴 게 좀 의외임. 광고 회사 중엔 경쟁자도 있고. 급하게 만든 광고 기능이나 투자자 수익 압박이 회사 자체 이익과 충돌한 것 같음.
AI 회사가 급하게 구현한다고? 설마.
나 지금 AI 회사 온보딩 중인데 다른 큰 AI 회사들을 돕는 곳임. 바이브코딩된 플랫폼과 문서가 어마어마하고 플랫폼이 로딩이 안 될 때도 있음. 사람이 손대본 적 없는 기능도 훈련 과정에 올라와 있음.
초록만 읽었는데 이게 사고로 샌 건지 의도적으로 준 건지가 핵심임. 내 추측은 사고 쪽이고 그럼 전혀 안 놀랍지. OpenAI는 서비스를 안전하게 운영할 경험도 자원도 없다는 걸 여러 번 보여줬음.
핸런의 면도날을 적용해야 하는 상황인 듯. 바이브코딩 이후로 무능과 부주의가 업계 전체에 더 퍼졌음.
OpenAI가 의도적으로 했을 것 같진 않음. 임원들이 메타 출신이라 혹독하게 배웠을 텐데. 사용자 정보를 광고 네트워크에 흘리면 결국 고객이 알게 되고, 더 중요한 건 데이터를 직접 쥐고 있어야 광고 타깃팅에서 경쟁 우위가 생긴다는 점임. 메타도 지금은 광고주에게 명단을 주지 않고 원하는 특성만 받아서 메타가 대상을 정함.
그 교훈을 배운 게 아니라 잘못 배운 거겠지. 문제가 되면 벌금과 평판 손실이 이익보다 작으니 그냥 밀고 나가는 게 그들이 배운 것임.
그냥 데이터를 판 거지 유출이 아님. 유출은 실수일 때 쓰는 말임.