摘要
Jeff Panasuik的《第二语言条件》[7]认为,Google DeepMind的SL2T虽然去掉了注译,却保留了注译过去所暴露的那种组织逻辑:一个以书面英语为输出目标的体系,由它决定什么算作成功、什么成为权威记录。他认为我的《信任的坐标》[5]在治理框架内是准确的,但也受限于这一框架,并最后向SLAT指数提出一个问题:哪一项保障措施能给机构一些它无法重新解释、无法协商放弃、也无法悄悄忽视的东西。
我毫无保留地接受他在方法论上的纠正,也接受方向性是架构本身的属性,而不仅仅是部署方式的属性。我与他分歧之处在于:治理与架构是否处于不同的轴线上。他所举出的每一个能改变其判断的条件,都是一个治理条件;而他所指出的架构问题,恰恰可以通过一个治理条件来回应:记录应当是手语源文件,而非英语输出,记录的应是聋人所说的内容;而获得合格人工口译员的权利应归属于聋人本人,而非购买该系统的机构。
Jeff说对的地方
这个方法论上的要点是站得住的,我愿意坦然承认,而不是回避或淡化。《信任的坐标》一文分析了一项聋人无障碍技术,所依据的两份文件均产生于由开发者召集、主持并出资的流程[4][1]。该文未记录任何聋人核实步骤,未对已发布模型的输出做独立评估,也未引用任何手语来源的资料。Jeff谨慎地指出,他并非声称这些步骤从未发生过,而只是说我发表的分析并未证明它们确实发生过。这正是我那篇文章向DeepMind提出的“缺席”与“未记录”之间的区别,而这一区别同样约束着我自己的工作,正如它约束着他们的工作一样。我的发现是:附于某个预发布版本的最有力的社区评估揭示了开发者记录中的一个缺口;Jeff说得对,我的文章指出了这个缺口,却没有填补它。
他在注译于整个故事中所处位置的问题上也是对的。去掉注译是这次发布中最有力的架构决定,而一篇无法认可这一点的批评文章,就根本没有真正触及这个系统。他将已披露的失败模式解读为一种模式,而非一份清单,这是他文章中最有价值的部分。非手动语法、深度与接触、环境指代、舌部动作以及跨轮次的话语,并非五个互不相关的工程缺陷。它们是一种手语中那些线性书面目标无处安放的部分,而手部动作——书面目标能够接收的部分——正是该系统捕捉得最好的内容。
框架的交汇之处
Jeff写道,治理质量与架构方向是两条独立的轴线,一份合规性审查可以衡量前者,而不必解决后者。作为对单份文件审查所能做到的事情的描述,这是公允的。但作为对架构实际如何改变的描述,我认为并不完整,而他自己文章结尾的部分恰恰说明了这一点。
看看他所说的那五个会实质性改变其判断的条件:聋人签署者在治理投票和预算决定权中占多数;对语料库拥有自由、事先和知情的集体同意权;公开涉及同意、补偿和非手动覆盖范围的数据声明和模型卡;依据具有约束力的法规进行评估;以及在采购合同中保证配备合格口译员。这五项条件没有一项是架构规格。每一项说的都是:谁来决定、谁来同意、必须披露什么、适用何种法律、合同必须保证什么。它们都是治理条件,而且是好的治理条件。

这种殊途同归正是关键所在。输出目标不是自然法则;它是拥有决定权的人所做出的设计选择,是接受它的买家出资支持的,也是被奖励它的评估体系维持下去的。Jeff说得对,一份合规清单看不到锁着的门后面的那条走廊。但历来唯一能真正改变走廊方向的工具,都是那些改变谁掌握钥匙的工具:决策权、可强制执行的合同条款,以及供应商无法仅凭描述意图就能满足的证据要求。治理不是与架构不同的一条轴线,它是用来撼动架构的杠杆。
方向性,再探讨
我最初的论点是:SL2T是一个理解系统——机器读取聋人,听人一方再读取机器。当一个虚拟形象向聋人观众打手语打得很糟糕时,造成的伤害是无障碍的失败。而当一个模型把聋人签署者的话转录得很糟糕时,造成的伤害是误归责,因为这个人从未说过的话可能会以其名义进入书面记录。我当时把这种风险当作一种只要“支持性使用范围”保持有效就能被遏制的东西。
Jeff的纠正是:限制并不会改变方向。一扇上锁的门也许能阻止进入,但不会改变走廊通向何处,而发布材料本身也预见到了云端API、可能开放的权重、更多语言以及最终的生成功能。一旦集成商掌握了这项能力,边界所面向的对象就不再是聋人用户,而是决定如何嵌入它的雇主、学校、警察部门或福利机构。我接受这一点。方向性是系统本身的属性,我的文章低估了这个“范围”可能维持多短暂。
我想补充的是,这对评估者来说意味着什么。如果方向性是架构层面的问题,那么任何手语转文本系统的每一次部署,默认都继承了误归责的风险,而举证责任应落在那个想把机器输出纳入记录的人身上,而不是落在事后才不得不发现错误的聋人身上。这就重新定义了治理问题。问题不再是供应商是否围绕危险用途划出了边界,而是是否有任何机制能从一开始就阻止这种输出成为记录。
前提条件,以及核实应当归属何处
Jeff文章中最有力的一段,涉及该发布本身所做的一个假设:用户拥有足够的功能性英语读写能力来核实生成的文本。我把这描述为一种剩余风险,它最沉重地落在那些手语优先工具本应最能服务的用户身上。Jeff的论点是,这不仅仅是风险分配的问题:它正是主要保障机制的运作方式本身,因为签署者虽然留在核实的环节中,却必须用书面英语来核实。他引用了一项2026年针对成年聋人ASL使用者的研究[6]。该研究并未测试AI翻译,Jeff也明确说明了这一点,但它足以证明:一项要求签署者审核流利英语的保障措施,不能被想当然地认为对该系统声称服务的每个人同样可用。
我同意这一点,并且我认为补救措施可以直接从他自己对该系统将什么视为权威记录的分析中得出。如果英语输出就是记录,那么核实就必须用英语进行,这个前提条件就无法避免。但如果手语源文件才是记录,就不存在这个问题。由签署者本人保留控制权的原始手语视频,成为此人所说内容的证据,而英语文本则恢复其本来面目:一种转译,可归因于机器,在此人用自己的语言加以确认之前,不具备作为本人话语的地位。随后,确认可以采取完全不依赖英语读写能力的形式,包括由签署者自行选择的合格口译员或聋人中介对该转译进行审核,以及此人对照源文件对转译内容提出异议的权利。

这与其说是一个新颖的原则,不如说是把一个熟悉的原则应用到一个新的对象上。文字记录本身不是证词,证词才是证词。在法律场合中,口译陈述是要对照说话者本人进行核验的,而不是反过来。手语转文本系统却默认颠倒了这种关系,而这种颠倒恰恰是Jeff所指出的与米兰会议一脉相承之处:掌握多数族群语言的能力,成为一个人的话语能否被正确呈现的先决条件。将手语源文件作为记录,就能从保障机制中去掉这一前提条件,即便书面英语仍然是该系统的输出目标。
回答这个问题
Jeff问,哪项保障措施能给机构一些它无法重新解释、无法协商放弃、也无法悄悄忽视的东西。我的回答是:机构所持有的任何保障措施都无法通过这一检验,因为买家所掌握的东西,买家都可以放弃。能够在采购过程中幸存下来的保障措施,是那些属于聋人本人、并随其进入每一次部署的措施。我会列举两项。
- 用户可自行援引的获得合格人工口译员的权利。这不应只是指南中的一项建议,也不应是机构可自行决定是否提供的备用选项,而应是一项合同条款,聋人可以在互动中的任何时刻援引,若被拒绝则有明确的救济措施,机构无权代其放弃这项权利。这回应了咨询委员会自己排名最高的关切问题,而Jeff指出发布材料并未对此做出保证。这也有着早于AI出现的法律基础:根据《美国残疾人法》第二章,公共实体必须优先考虑个人所要求的辅助工具[ncg_citep key="cfr35160"];《残疾人权利公约》第9条第2款(e)项将专业手语口译员列为缔约国必须提供的现场协助形式之一[ncg_citep key="crpd2006"]。这种选择权在法律上本就属于当事人。采购环节不应再悄悄把它转移给买方。
- 手语源文件即记录。机器生成的英语,除非该聋人本人已用自己的语言确认过,否则不得以聋人之言的名义录入档案;手语源文件须由本人保留控制权,任何争议都应以源文件为准进行裁定,而非以文本为准。这正是回应Jeff所提前提条件的保障措施,因为它把英语读写能力从核实环节中剔除了出去,同时又不假装输出目标已经改变。
这两项保障措施都具备一个供应商划定的边界所不具备的特性。它们不是关于系统不应被用于何种用途的声明,而是附着于个人身上的权利,因此无论最终是哪个集成商、机构或雇主掌握了这项能力——包括那些在云端API和开放权重之后才出现的主体——这些权利都会对其产生约束力。

写在PDF文件里的边界,针对的是供应商的意图。而属于聋人本人的权利,则针对此后的每一次部署。
Heather M. Grizzle
这对SLAT意味着什么改变
Jeff把他的问题既提给了我的指数,也提给了他自己工作中的采购条款,因此公允地说,他的文章在我这一方带来了一些改变。有三点。
第一,方法上的缺口。对一项聋人无障碍技术所做的治理审查,如果未记录任何聋人核实步骤,就只能描述供应商的记录,却无法独立检验它。我正在为该指数组建一个聋人审查机构,在它正式成立之前,我会在我发表的任何内容中说明这一点,而不是让这一缺失不被记录下来。我关于SL2T的后续工作,将一直带着这项声明,直到这个缺口被填补。
第二,输出验证。迄今为止SLAT各项评估中最深层的发现[8]是:没有任何供应商发布过对其手语输出的独立评估。我已经起草了一份输出验证协议,将聋人评估者的参与视为定义性要素,而非可有可无的附加项;禁止将供应商提供的或演示用的内容纳入样本;并将误归责问题与准确性问题分开报告,以免Jeff和我都在谈论的那种失败被平均化而掩盖掉。这是一份草案,我在此公开它的存在,以便我对完成它负责。
第三,记录规则。该指数已经询问聋人用户是否有途径接触到合格的人工人员。但它尚未询问:机器输出是否可以在未经本人用自己的语言确认的情况下,作为该人之言录入记录。Jeff的文章说服了我,这应该被纳入其中,我将在该指数的下一次修订中把这一点作为一项条件提出。他最后提出的那个问题,值得一个比“充分性评级”更好的答案,而我能给出的最好答案,是一项由聋人本人所持有的权利,而不是一份由机构做出的承诺。
参考文献
- Google DeepMind Sign Language Team et al. (2026, August 12). AISLAC Joint Impact Report for SL2T 1.0. Google DeepMind.
- U.S. Department of Justice. 28 CFR 35.160(b)(2), Communications: auxiliary aids and services. https://www.ecfr.gov/current/title-28/chapter-I/part-35/subpart-E/section-35.160
- United Nations. (2006). Convention on the Rights of Persons with Disabilities, Article 9(2)(e).
- Google DeepMind Sign Language Team. (2026, August 12). Putting sign language AI into users’ hands. Google DeepMind.
- Grizzle-Odland, H. M. (2026, August 22). The Coordinates of Trust: A governance reading of Google DeepMind’s SL2T. Novara Consulting Group.
- McKee, M. M., Plegue, M., Champlin, S., Hill, J., Panko, T., Buis, L. R., Sen, A., Paasche-Orlow, M. K., and Hauser, P. C. (2026). Predictors of health literacy among Deaf American Sign Language users. Patient Education and Counseling, 142, 109348. https://doi.org/10.1016/j.pec.2025.109348
- Panasuik, J. (2026, August 26). The Second Language Condition: An Architectural Reading of SL2T. LinkedIn. https://www.linkedin.com/pulse/second-language-condition-architectural-reading-sl2t-panasuik-m-sc–5ukic/
- Novara Consulting Group. (2026). SLAT Index Evaluation Standard, Version 2.0. https://doi.org/10.5281/zenodo.21537271

