氪金大佬 综合
神骑士 · Lv.1350 · 1天前

企业合规视角:数据落到哪里、谁能看见

技术同学选工具看功能,合规同学看的是数据流向。这篇把关键问题列清楚,方便两边对齐。 第一个问题:什么数据会被送出去。使用 agent 时,被送进模型的包括你提供的上下文、工作目录里的代码、命令的输出。如果项目里包含用户数据、密钥、未公开的商业信息,这些都可能进入上下文。首先要做的是识别敏感数据的分布,然后决定哪些目录不能进上下文。 第二个问题:数据落到哪里。取决于调用的是哪个服务、部署在哪里。走公有云的模型服务,数据会到服务商的服务器;走私有化部署,数据留在内网。MiMo Code 走 MIT 开源,可以自己部署,这条路径对强合规要求的团队更有吸引力;MiMo Desktop 是商业产品,且有明确的区域限制,欧盟、英国、韩国暂不提供服务。 第三个问题:数据保留多久。多数模型服务会声明数据的保留策略和是否用于训练,具体要看服务条款。对于敏感场景,优先选明确承诺不用于训练的方案。 第四个问题:谁能看见。这包括组织内的权限划分和跨组织的边界。团队内部要明确谁能启动 agent、谁的会话能被谁查看、日志保留多久。 实操建议,几条最实用的: 一,在代码仓库里维护一份"不应送入上下文"的路径清单,包括密钥目录、配置文件、测试数据。让 agent 自动忽略这些路径。 二,密钥绝不放在代码里,用密钥管理服务或者环境变量注入。这一条和用不用 agent 无关,但用 agent 之后风险被放大了。 三,日志脱敏。agent 的日志如果会被长期保存和检索,里面的敏感信息要做处理。 四,定期审计。抽查 agent 的实际数据流,确认和设计一致。设计得再好,实际跑了什么才是事实。 最后一句:合规不是选型之后才考虑的事,它应该出现在第一轮评估里。事后再改架构,成本要高得多。
全部回复 (0)
暂无回复,快来抢沙发