绝不能输入 AI 工具的内容
假设服务对象最担心的是某个工具是否会把信息传到移民执法部门。据此保护他们的信息,并率先用清楚的话说明数据如何处理。
分成几堆,一起定出"绝不能做"那一堆
- 把你这一周经手的八项任务分别写在卡片上,一张卡片写一项。
- 把它们分成三堆:可以交给聊天机器人做的、绝不能做的、还拿不准的。
- 大声念出"还拿不准"这一堆,团队一起讨论哪些要归到"绝不能做"。把这份名单写下来,这就是你们机构必须能向服务对象解释清楚的清单。
"还拿不准"这一堆里还剩下什么?机构里该由谁来拍板?
- 输入 ChatGPT、Claude、Gemini 或 Microsoft Copilot 时,文本会离开你的屏幕。它会传到运营该工具的公司,存放在其服务器上,并可能被保留很长时间。在许多日常账户中,这些内容还可能被用来训练该工具的未来版本。
- 绝不要粘贴任何可能识别服务对象身份的信息。这包括姓名、A 号码、案件或收据编号、住址、电话号码、出生日期、移民身份,以及其处境的医疗或法律细节。
- 不要把服务对象的文件、截图或表格上传到通用 AI 工具。福利信函或移民通知书上满是身份信息,一旦上传,你就无法再控制它的去向。
- 使用工具前先去除具体细节。询问一般性的规则或流程,把服务对象的具体档案排除在外。像“续签工作许可需要哪些文件”这样的问题,既能得到答案,又不会暴露任何人。
- 假设服务对象最担心的是这个工具是否会把信息传到移民执法部门。像这个答案真的关乎他们的安全一样去保护他们的信息,因为对一些服务对象来说,确实如此。
- 移民身份一旦暴露就很危险。政府机构和商业数据经纪公司会收集并共享个人信息,所以不要在你无法掌控的工具中留下身份信息或识别信息。
- 每次会面开始时都用清楚的话说明数据处理方式。用一句简短、没有术语的话告诉服务对象,你绝不会把他们的姓名或案件输入任何外部工具。让数据处理方式清楚可见,是赢得信任的一部分,也是少数能在当下减轻服务对象恐惧的做法之一。
你在公开的 AI 工具中输入的任何内容都会离开你的设备,传到运营该工具的公司,并可能被存储。大语言模型还可能记住其训练数据中的片段并逐字复现,包括姓名、电话号码和街道地址(Carlini 等人,2021)。当供应商使用账户输入的内容来训练未来的模型时,今天输入的服务对象信息日后可能会重新出现。
对移民执法的恐惧会减少人们使用服务,即使是合法居留的人也是如此(Herring 和 Barnow,2025)。这种影响也波及儿童。2016 年大选和拟议中的公共负担规则出台后,移民幼儿的医疗就诊率下降了(Ettinger de Cuba 等人,2023)。
因新冠住院的拉丁裔患者表示,他们推迟就医部分是因为对移民身份和费用的担忧(Cervantes 等人,2021)。工作人员展现出谨慎、清楚可见的数据处理方式,就能减少一个让服务对象因此却步的理由。
移民身份之所以敏感是有充分理由的。消费级 AI 账户不受 HIPAA 等健康隐私法律的保护,而执法机构已经通过商业数据经纪公司和行政记录获取了移民社区的个人信息(Data and Society, Poverty Lawgorithms)。把身份和识别信息排除在你无法掌控的工具之外,是默认的安全做法。
你的数据究竟如何流动,谁能看到它
使用 AI 聊天机器人时,你输入的文字传播的范围远比屏幕更远。了解它们走过的路径,以及真正的保护措施在哪里,能让你判断什么内容可以放心输入。这些都不需要技术背景。
商业聊天机器人并不在你的电脑上运行。当你按下回车键,你的文本会通过互联网发送到该公司的服务器,这些服务器常被称为云(cloud),也就是该公司运营的数据中心。模型在那里读取你的文本,并把答案发送回来。你输入的提示词(prompt)已经离开了你的设备,抵达了一家你无法控制的公司。
大多数机构使用的工具,例如 ChatGPT、Claude、Gemini 和 Microsoft Copilot,都是云端(cloud)商业模型。它们功能强大,而你输入的一切都会发送给供应商。本地模型(local model)运行在你自己的电脑或你所在机构自己的服务器上,数据从不离开建筑物。本地模型确实存在,也在不断改进,但设置起来更难,能力通常也较弱,所以大多数日常工具都是云端模型。一个大致的判断方法是:如果一个工具需要联网才能回答,它就在把你输入的内容发送出去。
这取决于具体工具和套餐,值得去核实。在许多免费账户和个人账户中,供应商可能会使用你输入的内容来改进或训练未来的模型,有时设置里会有退出选项(opt-out),例如一个训练开关,或者关闭聊天记录的功能。商业版(business)、企业版(enterprise)、团队版套餐,以及大多数通过 API 的访问,通常会附带书面承诺,不会用你的内容进行训练,这项承诺常常写在数据处理协议(data processing agreement)里。那份合同才是真正的保护,它的具体措辞因合同而异,机构应当在把任何敏感信息交给某个工具之前先读一读。
API 是其他软件在幕后用来把文本发送给模型的管道。许多供应商默认不会用 API 数据来训练模型,并且会为受监管的信息签署协议,这也是为什么一个经机构审核过的应用可能比员工个人账户更安全的原因之一。数据仍然会传送到供应商那里,所以谁持有这份协议、协议写了什么,仍然很重要。
正规工具会对你的数据进行传输中加密和静态加密,把数据打乱,使外部人无法在传输途中或存储中读取它。这能防止被拦截。但它无法对公司本身隐藏任何内容,公司的系统,有时甚至是员工或分包商,仍然可以访问你发送的内容。加密并不是输入服务对象身份信息的理由。
即使某个工具承诺不用你的输入来训练模型,它仍可能把内容存储一段时间,例如用于监测滥用行为,或应对法律要求。在应用里删除一段对话,并不能保证这条记录会在所有地方立刻消失。对于可能传到移民执法部门的信息,要假设某个你无法触及的地方仍可能留有一份副本。
因为在服务对象就站在你面前的那一刻,你通常无法确认某个工具的确切条款,所以安全的规则并不取决于套餐类型。让姓名、A 号码、住址、出生日期、移民身份和案件细节都远离你无法掌控的任何工具,转而提出一般性的、不含身份信息的问题。
一位福利导航员在预约进行中求助聊天机器人
- 一位资源导航员正在帮助绿卡持有者奥孔克沃女士(Mrs. Okonkwo)判断她的家庭是否符合食品援助资格。导航员打开 ChatGPT,开始输入这位服务对象的全名、她的 A 号码、家庭住址、家庭收入,以及她是合法永久居民这一事实。
- 在发送之前,导航员停了下来。所有这些信息都会离开机构,留存在供应商的服务器上,还可能被用来训练未来的模型。而要得到答案,这些信息其实一个都不需要。
- 导航员删除了身份信息,改为提出一般性的问题:一个四口之家申请食品援助的收入上限是多少,合法永久居民身份是否会影响资格。得到的答案是一样的,而且没有暴露任何人的信息。
- 在告诉奥孔克沃女士任何结果之前,导航员先对照官方的州福利页面进行核实,并在下一次预约开始时明确说明,她绝不会把服务对象的姓名或案件输入任何外部工具。
改写提示词,删除服务对象的信息
拿一个包含服务对象姓名、A 号码和住址的提示词。以小组为单位,把它改写成询问一般性规则、不含任何可识别信息的版本。比较两个提示词,确认改写后的版本仍能得到个案工作者需要的答案。
写出你会对服务对象说的那句关于数据的话
请独自写出一到两句简明的话,供你在会面开始时使用,向服务对象说明你会输入什么、不会输入什么到任何外部工具中。保持简短,不用术语。把它读给一位搭档听,让对方扮演一个害怕移民执法的服务对象来回应,然后不断修改,直到这句话真正能减轻这种恐惧为止。