Mistral Vibe는 사용자 데이터 학습이 기본, Enterprise만 기본 제외
- Mistral Vibe 일반 사용자는 대화와 첨부 문서를 포함한 입력·출력 데이터의 모델 학습 사용에서 기본 제외 상태가 아니며, Enterprise 고객만 기본 제외 상태임
- Vibe 관리자는 Admin panel의 Privacy에서 'Allow your interactions to be used to train our models' 토글을 꺼서 학습 사용을 중단할 수 있고, 모바일 앱에서는 Data & Account Controls의 데이터 공유를 해제해야 함
- Mistral은 학습 제외를 확인한 뒤부터 입력과 출력 데이터를 모델 학습에 사용하지 않는다고 밝힘
- Mistral Studio와 API는 Admin panel의 Privacy에서 Anonymous improvement data 토글을 별도로 꺼야 하며, Vibe에서 학습을 제외해도 API 설정에는 적용되지 않음
Hacker News opinions
유럽 업체라서 중앙집중식 개인정보 제어가 낫다고 보고 Mistral을 골랐는데, Team 요금제의 조직 단위 학습 제외 설정이 사라진 듯했음. 문서와 실제 사용자 설정이 며칠간 충돌했고, 시험 프롬프트 일부는 학습에 쓰였다가 항의 후 삭제됐음.
'기본 opt-in'이라는 표현은 반대 의미로 들림. 기본 활성화 상태라서 사용자가 꺼야 한다는 뜻이면 opt-out이라고 해야 함.
나는 Enterprise가 아닌데도 admin.mistral.ai에서 Vibe와 Console/API 학습을 조직 전체에 대해 끄는 토글을 봤음. 계정을 처음 만들 때 껐고 지금도 그대로 유지됨.
조직 전체에 강제로 적용할 학습 제외가 없다면 Team 요금제는 민감한 IP나 GDPR 데이터를 다루는 회사에 쓸 수 없는 수준임. 직원마다 개인정보 토글을 찾아 끄라고 할 수는 없음.
그래서 방금 다시 확인했는데, 조직 전체의 Vibe와 API 학습을 끄는 토글은 실제로 있음.
Mistral보다 나은 모델이 많고 로컬 실행도 가능한데 굳이 쓸 이유를 모르겠음.
EU 기업이라면 미국 업체 의존을 조금 줄일 수 있다는 이유는 있음. 규제기관이 학습 데이터 관련 질의를 하면 답할 수 있다는 점도 차이일 수 있음.
나는 Mistral OCR은 쓸 만하다고 봄. 소형 모델은 단순 번역에도 자주 쓰는데 내 용도에는 충분했음.
주권을 말해도 다른 회사 컴퓨터에서 돌리는 서비스면 결국 데이터 문제는 남음.
나는 학습 사용을 이미 껐는데, 그걸 두고 스파이웨어라고 부르는 근거가 뭔지 모르겠음.
Mistral은 원래 이런 일을 하지 않는 유럽 선택지라고 내세웠던 것 아닌가 싶음. 성능 경쟁에서 뒤처지니 기본 수준 모델을 넘은 뒤에는 사용자 피드백이 튜닝 신호로 필요해졌을 수도 있음.
이 글은 다소 과장됐다고 봄. Mistral은 예전부터 관리자 설정에서 학습을 영구적으로 끌 수 있었고, 이전 opt-out도 유지됐다고 알고 있음. Kagi Ultimate도 주로 OpenAI와 Anthropic 같은 폐쇄형 모델을 씀.