我能选择不让我的输入或输出数据用于训练吗?

Mistral AI 对非企业套餐的用户提示词默认进行训练的变化,引发了付费客户对隐私保障的担忧,尤其是这来自一家欧洲提供商。评论者围绕令人困惑的“opt-in vs opt-out”措辞、Team 套餐中组织级隐私开关的移除,以及用户究竟能多大程度信任任何 AI 供应商“不使用数据训练”的承诺展开讨论。该线程将 Mistral 的做法与 Anthropic、Google 和 Grok 等竞争对手并列,凸显出更广泛的趋势:对于希望更严格控制敏感数据的人来说,转向本地或代理式 LLM 使用。

政策变更与训练默认设置

  • 讨论的核心是 Mistral 现在在非企业套餐上默认使用用户输入/输出进行训练,并提供退出机制。
  • 对于 Vibe(消费者/Team):用户默认是“加入”的,必须按账户关闭训练。
  • 对于 Enterprise:默认不进行训练,可由管理员集中管理。
  • 一些参与者认为,这与早先声称 Team 默认已退出的文档相比,是一次逆转。

组织控制与开关混乱

  • 一些用户报告称,之前有一个组织级管理员开关可以禁用训练;而新的 Team 账户据称没有了这个开关。
  • 一位评论者说,支持人员确认该组织级开关已被移至仅 Enterprise 可用。
  • 也有人仍然看到全局开关,这表明不同旧账户和新账户的行为可能不同,这也是混乱的来源。
  • 据称,文档和界面都滞后于政策变更,导致一些测试提示词在无意中被用于训练。

opt-in 与 opt-out 术语

  • 一个很长的子线程在争论“默认 opt in”的含义。
  • 许多人形成的共识是:
    • “Opt-in” = 默认关闭;用户必须主动选择开启。
    • “Opt-out” = 默认开启;用户必须主动选择关闭。
  • 有些人认为企业营销已经以对用户不利的方式混淆了这些术语。

与其他 AI 提供商的比较

  • Claude Team/Enterprise:有人提到其默认会关闭对提示词的训练;个人方案上有人报告默认相反。
  • Grok:因默认关闭训练而受到赞扬,但其 ToS 被批评为极其宽泛。
  • Google/Microsoft/Anthropic/OpenAI:许多评论者表示,类似“默认开启,可选择退出”的模式很常见。

信任、隐私与法律角度

  • 有人强烈怀疑任何大型提供商是否真的不会对已退出的数据进行训练;也有人认为合同和 GDPR 风险使得秘密训练不太可能。
  • 有人提到 GDPR 明确将未经授权的数据二次使用视为违法,不过也有人怀疑执法力度。
  • 还提出了对提示词中的 PII、保留时长、数据泄露,以及一旦数据进入模型后不可逆的担忧。

为什么使用或避开 Mistral

  • 支持 Mistral 的观点:欧盟司法管辖、数据主权、本地模型、不错的 OCR/小模型、以及能够服务像 GLM 这样的第三方开源模型。
  • 反对 Mistral 的情绪:被认为在“变烂”、隐私敌对默认设置、沙特合作、专利,以及感觉他们在模仿美国大型科技公司的行为。
  • 一些人最终认为,对于想避免自己的数据被用于训练,本地/自托管模型才是唯一可靠的方式。