Kurz gefasst
Jeff Panasuiks „The Second Language Condition“ [7] argumentiert, dass Google DeepMinds SL2T die Glossierung entfernt, aber die organisierende Logik beibehalten hat, die die Glossierung einst offenlegte: ein schriftsprachliches Ausgabeziel, das entscheidet, was als Erfolg zählt und was zur maßgeblichen Aufzeichnung wird. Er liest meine „The Coordinates of Trust“ [5] als zutreffend innerhalb eines Governance-Rahmens, aber dadurch auch begrenzt, und schließt mit der Frage an den SLAT Index, welche Schutzmaßnahme einer Institution etwas gibt, das sie nicht umdeuten, wegverhandeln oder stillschweigend ignorieren kann.
Ich akzeptiere seine methodische Korrektur vorbehaltlos, und ich akzeptiere, dass Richtung eine Eigenschaft der Architektur ist und nicht nur des Einsatzes. Wo ich mich von ihm unterscheide, ist die Behauptung, dass Governance und Architektur auf getrennten Achsen liegen. Jede Bedingung, die er als geeignet nennt, seine Lesart zu ändern, ist eine Governance-Bedingung, und das architektonische Problem, das er identifiziert, lässt sich durch eine beantworten: Die gebärdensprachliche Quelle, nicht die englische Ausgabe, muss die Aufzeichnung dessen sein, was eine gehörlose Person gesagt hat, und das Recht auf einen qualifizierten menschlichen Dolmetscher muss der gehörlosen Person gehören, nicht der Institution, die das System kauft.
Was Jeff richtig erkennt
Der methodische Punkt trifft zu, und ich möchte ihn offen einräumen, statt ihn zu relativieren. „The Coordinates of Trust“ analysierte eine Zugangstechnologie für Gehörlose anhand zweier Dokumente, die in einem vom Entwickler einberufenen, moderierten und finanzierten Prozess entstanden [4][1]. Es dokumentierte keinen Verifizierungsschritt durch Gehörlose, präsentierte keine unabhängige Bewertung der Ausgabe des veröffentlichten Modells und führte keine gebärdensprachliche Quelle an. Jeff achtet darauf, zu sagen, dass er nicht behauptet, diese Schritte hätten nie stattgefunden, sondern nur, dass meine veröffentlichte Analyse nicht belegt, dass sie stattfanden. Das ist dieselbe Unterscheidung zwischen Abwesenheit und Nicht-Dokumentation, die mein Artikel von DeepMind verlangte, und sie bindet meine Arbeit genauso wie ihre. Mein Befund, dass die stärkste gemeinschaftsbezogene Bewertung, die an einen Vorab-Veröffentlichungsbuild geknüpft war, eine Lücke in der Aufzeichnung des Entwicklers identifizierte; Jeff hat recht, dass mein Artikel die Lücke benannt, aber nicht geschlossen hat.
Er hat auch recht damit, wo die Glossierung in der Geschichte stand. Das Entfernen der Glossierung war die stärkste architektonische Entscheidung der Veröffentlichung, und eine Kritik, die das nicht anerkennen kann, setzt sich nicht mit dem System auseinander. Seine Lesart der offengelegten Fehlermodi als Muster statt als Liste ist das Nützlichste in seinem Artikel. Nicht-manuelle Grammatik, Tiefe und Kontakt, umgebungsbezogene Referenten, die Zunge und Diskurs über Gesprächsrunden hinweg sind keine fünf unzusammenhängenden technischen Lücken. Es sind die Teile einer Gebärdensprache, für die ein lineares schriftliches Ziel keinen Platz hat, und die Hände, die ein schriftliches Ziel erfassen kann, sind das, was das System am besten einfängt.
Wo sich die Rahmen treffen
Jeff schreibt, dass Governance-Qualität und architektonische Richtung getrennte Achsen seien und dass eine Compliance-Lesart die erste messen könne, ohne die zweite zu klären. Als Beschreibung dessen, was eine einzelne Dokumentenprüfung leisten kann, ist das fair. Als Beschreibung davon, wie sich Architektur tatsächlich ändert, halte ich es für unvollständig, und sein eigener Schlussabschnitt zeigt, warum.
Betrachten Sie die fünf Bedingungen, von denen er sagt, sie würden seine Lesart wesentlich ändern: gehörlose Gebärdensprachnutzer, die eine Mehrheit der Governance-Stimmen und Budgetentscheidungen halten; freie, vorherige und informierte kollektive Zustimmung zum Korpus; veröffentlichte Datenaussagen und Modellkarten, die Zustimmung, Vergütung und nicht-manuelle Abdeckung umfassen; Bewertung gegen verbindliche Regulierung; und ein in den Beschaffungsvertrag garantierter qualifizierter Dolmetscher. Keine einzige davon ist eine architektonische Spezifikation. Jede ist eine Aussage darüber, wer entscheidet, wer zustimmt, was offengelegt werden muss, welches Recht gilt und was ein Vertrag garantieren muss. Es sind Governance-Bedingungen, und es sind gute.

Diese Übereinstimmung ist der Punkt. Ein Ausgabeziel ist kein Naturgesetz; es ist eine Designentscheidung, getroffen von Menschen mit der Befugnis, sie zu treffen, finanziert von Käufern, die sie akzeptieren, und aufrechterhalten durch Bewertungssysteme, die sie belohnen. Jeff hat recht, dass eine Compliance-Checkliste den Korridor hinter einer verschlossenen Tür nicht sehen kann. Aber die einzigen Instrumente, die jemals einen Korridor umgeleitet haben, sind jene, die ändern, wer die Schlüssel hält: Entscheidungsbefugnis, durchsetzbare Vertragsbedingungen und Nachweisanforderungen, die ein Anbieter nicht durch bloße Absichtserklärungen erfüllen kann. Governance ist keine andere Achse als Architektur. Sie ist der Hebel, mit dem Architektur angefochten wird.
Richtung, erneut betrachtet
Mein ursprüngliches Argument war, dass SL2T ein Verständnissystem ist: die Maschine liest die gehörlose Person, und eine hörende Partei liest die Maschine. Wenn ein Avatar einer gehörlosen Zuschauerin schlecht vorgebärdet, besteht der Schaden in gescheitertem Zugang. Wenn ein Modell eine gehörlose Gebärdensprachnutzerin schlecht transkribiert, besteht der Schaden in Falschzuschreibung, weil Worte, die die Person nie produziert hat, unter ihrem Namen in eine schriftliche Aufzeichnung gelangen können. Ich behandelte dieses Risiko als etwas, das die unterstützte Nutzungshülle so lange eindämmt, wie die Hülle hält.
Jeffs Korrektur ist, dass Eingrenzung die Richtung nicht ändert. Eine verschlossene Tür mag den Eintritt verhindern, aber sie ändert nicht, wohin der Korridor führt, und die Veröffentlichungsmaterialien selbst antizipieren Cloud-APIs, mögliche offene Gewichte, mehr Sprachen und schließlich Generierung. Sobald Integratoren die Fähigkeit besitzen, ist das Publikum für die Grenze nicht mehr die gehörlose Nutzerin, sondern der Arbeitgeber, die Schule, der Polizeidienst oder das Sozialamt, die entscheiden, wie es eingebettet wird. Das akzeptiere ich. Richtung ist eine Eigenschaft des Systems, und mein Artikel unterschätzte, wie vorübergehend die Hülle wahrscheinlich sein wird.
Was ich hinzufügen würde, ist, was daraus für eine Bewertung folgt. Wenn Richtung architektonisch ist, dann erbt jeder Einsatz eines Gebärde-zu-Text-Systems standardmäßig das Risiko der Falschzuschreibung, und die Last sollte bei dem liegen, der die maschinelle Ausgabe in eine Aufzeichnung aufnehmen möchte, nicht bei der gehörlosen Person, die den Fehler nachträglich abfangen muss. Das stellt die Governance-Frage neu. Es geht nicht mehr darum, ob der Anbieter eine Grenze um gefährliche Nutzungen gezogen hat. Es geht darum, ob überhaupt etwas verhindert, dass die Ausgabe von vornherein zur Aufzeichnung wird.
Die Voraussetzung, und wo Verifizierung angesiedelt sein sollte
Die stärkste Passage in Jeffs Artikel betrifft die eigene Annahme der Veröffentlichung, dass Nutzer über ausreichende funktionale Englischkenntnisse verfügen, um generierten Text zu verifizieren. Ich beschrieb das als Restrisiko, das am härtesten jene Nutzer trifft, denen ein gebärdensprachorientiertes Werkzeug am besten dienen könnte. Jeff argumentiert, es sei mehr als eine Risikoverteilung: Es ist die Funktionsweise der zentralen Schutzmaßnahme selbst, denn die gebärdende Person bleibt als Verifizierende im Prozess, muss aber in geschriebenem Englisch verifizieren. Er zitiert eine Studie aus 2026 über erwachsene gehörlose ASL-Nutzer [6]. Die Studie testete keine KI-Übersetzung, und Jeff sagt das auch, aber sie reicht aus, um zu zeigen, dass eine Schutzmaßnahme, die verlangt, dass eine gebärdende Person fließendes Englisch überprüft, nicht als gleichermaßen für alle verfügbar vorausgesetzt werden kann, denen das System angeblich dient.
Ich stimme zu, und ich denke, die Abhilfe folgt direkt aus seiner eigenen Analyse dessen, was das System als maßgebliche Aufzeichnung behandelt. Wenn die englische Ausgabe die Aufzeichnung ist, muss die Verifizierung auf Englisch erfolgen, und die Voraussetzung ist unvermeidlich. Wenn die gebärdensprachliche Quelle die Aufzeichnung ist, ist das nicht der Fall. Das ursprüngliche gebärdensprachliche Video, unter der Kontrolle der gebärdenden Person aufbewahrt, wird zum Beleg dessen, was die Person gesagt hat, und der englische Text wird zu dem, was er tatsächlich ist: eine Wiedergabe, einer Maschine zuzuschreiben, ohne jeden Status als Worte der Person, bis diese Person sie in ihrer eigenen Sprache bestätigt hat. Bestätigung kann dann Formen annehmen, die überhaupt nicht von englischer Lesefähigkeit abhängen, einschließlich der Überprüfung der Wiedergabe durch einen qualifizierten Dolmetscher oder eine von der gebärdenden Person gewählte gehörlose Mittlerperson, sowie das Recht der Person, die Wiedergabe gegen die Quelle anzufechten.

Das ist kein neuartiges Prinzip, sondern eher ein vertrautes, angewandt auf ein neues Artefakt. Ein Transkript ist keine Aussage; die Aussage selbst ist es. Eine gedolmetschte Äußerung in einem rechtlichen Kontext wird gegen die sprechende Person geprüft, nicht umgekehrt. Gebärde-zu-Text-Systeme kehren diese Beziehung standardmäßig um, und diese Umkehrung ist genau die Kontinuität mit Mailand, die Jeff identifiziert: Kompetenz in der Mehrheitssprache wird zur Voraussetzung dafür, in den eigenen Worten korrekt wiedergegeben zu werden. Die gebärdensprachliche Quelle zur Aufzeichnung zu machen, entfernt diese Voraussetzung aus der Schutzmaßnahme, auch wenn geschriebenes Englisch das Ausgabeziel des Systems bleibt.
Die Frage beantworten
Jeff fragt, welche Schutzmaßnahme einer Institution etwas gibt, das sie nicht umdeuten, wegverhandeln oder stillschweigend ignorieren kann. Meine Antwort ist, dass keine von der Institution gehaltene Schutzmaßnahme diesen Test bestehen kann, denn was auch immer der Käufer hält, der Käufer kann darauf verzichten. Die Schutzmaßnahmen, die eine Beschaffung überdauern, sind jene, die der gehörlosen Person gehören und mit ihr in jeden Einsatz wandern. Ich würde zwei nennen.
- Ein von der Nutzerin ausübbares Recht auf einen qualifizierten menschlichen Dolmetscher. Keine Empfehlung in einem Leitfaden und keine Rückfalloption, die die Institution nach eigenem Ermessen anbieten kann, sondern eine Vertragsbedingung, die die gehörlose Person jederzeit während einer Interaktion geltend machen kann, mit einem festgelegten Rechtsmittel, falls sie verweigert wird, und ohne Befugnis der Institution, im Namen der Person darauf zu verzichten. Das beantwortet das höchst eingestufte eigene Anliegen des Beratungsgremiums, von dem Jeff feststellt, dass die Veröffentlichungsmaterialien es nicht garantieren. Es hat auch eine rechtliche Grundlage, die älter ist als KI: Unter Title II des ADA muss eine öffentliche Stelle dem von der Person gewünschten Hilfsmittel vorrangige Berücksichtigung geben [ncg_citep key="cfr35160"], und Artikel 9(2)(e) der UN-Behindertenrechtskonvention nennt professionelle Gebärdensprachdolmetscher unter den Formen von Live-Unterstützung, die Vertragsstaaten bereitstellen müssen [ncg_citep key="crpd2006"]. Die Wahl liegt rechtlich bereits bei der Person. Die Beschaffung sollte aufhören, sie stillschweigend auf den Käufer zu verlagern.
- Die gebärdensprachliche Quelle ist die Aufzeichnung. Maschinell erzeugtes Englisch gelangt niemals als Worte einer gehörlosen Person in eine Akte, sofern diese Person es nicht in ihrer eigenen Sprache bestätigt hat, die gebärdensprachliche Quelle unter ihrer Kontrolle aufbewahrt wird und jede Streitigkeit gegen die Quelle, nicht gegen den Text, entschieden wird. Das ist die Schutzmaßnahme, die Jeffs Voraussetzung beantwortet, denn sie entfernt die englische Lesefähigkeit aus dem Verifizierungspfad, ohne vorzutäuschen, dass sich das Ausgabeziel geändert hätte.
Beide Schutzmaßnahmen teilen eine Eigenschaft, die einer Anbietergrenze fehlt. Sie sind keine Aussagen darüber, wofür das System nicht verwendet werden sollte. Es sind Rechte, die an die Person gebunden sind, sodass sie jeden Integrator, jede Behörde oder jeden Arbeitgeber binden, der am Ende die Fähigkeit besitzt, einschließlich derer, die nach der Cloud-API und den offenen Gewichten hinzukommen.

Eine in einem PDF niedergeschriebene Grenze adressiert die Absicht des Anbieters. Ein Recht, das die gehörlose Person hält, adressiert jeden nachfolgenden Einsatz.
Heather M. Grizzle
Was sich dadurch im SLAT ändert
Jeff stellte seine Frage an meinen Index und an die Beschaffungsklauseln in seiner eigenen Arbeit, daher ist es fair zu sagen, was sein Artikel auf meiner Seite ändert. Drei Dinge.
Erstens die Methodenlücke. Eine Governance-Lesart einer Zugangstechnologie für Gehörlose, die keinen Verifizierungsschritt durch Gehörlose dokumentiert, kann die Aufzeichnung eines Anbieters beschreiben, aber nicht unabhängig prüfen. Ich baue derzeit ein Gremium zur Überprüfung durch Gehörlose für den Index auf, und bis dieses besetzt ist, werde ich das bei allem, was ich veröffentliche, offenlegen, statt die Abwesenheit undokumentiert zu lassen. Meine weitere Arbeit zu SL2T wird diese Aussage tragen, bis die Lücke geschlossen ist.
Zweitens die Validierung der Ausgabe. Der tiefste Befund über alle bisherigen SLAT-Bewertungen hinweg [8] ist, dass kein Anbieter eine unabhängige Bewertung seiner gebärdensprachlichen Ausgabe veröffentlicht hat. Ich habe ein Protokoll zur Validierung der Ausgabe entworfen, das die Teilnahme gehörloser Bewertender als definierend statt als ergänzend behandelt, vom Anbieter bereitgestellte oder Demonstrationsinhalte aus der Stichprobe ausschließt und Falschzuschreibung getrennt von Genauigkeit berichtet, damit der Fehler, den Jeff und ich beide beschreiben, nicht wegdurchschnittlich wird. Es ist ein Entwurf, und ich veröffentliche seine Existenz hier, damit ich zur Fertigstellung verpflichtet werden kann.
Drittens die Aufzeichnungsregel. Der Index fragt bereits, ob eine gehörlose Nutzerin einen Weg zu einem qualifizierten Menschen hat. Er fragt noch nicht, ob maschinelle Ausgabe als Worte einer Person in eine Aufzeichnung gelangen kann, ohne dass diese Person es in ihrer eigenen Sprache bestätigt hat. Jeffs Artikel überzeugt mich, dass er das tun sollte, und ich werde das als Bedingung für die nächste Überarbeitung des Index vorschlagen. Die Frage, mit der er schloss, verdient eine bessere Antwort als eine Hinlänglichkeitsbewertung, und die beste Antwort, die ich habe, ist ein Recht, das die gehörlose Person hält, statt ein Versprechen, das die Institution gibt.
Quellen
- Google DeepMind Sign Language Team et al. (2026, August 12). AISLAC Joint Impact Report for SL2T 1.0. Google DeepMind.
- U.S. Department of Justice. 28 CFR 35.160(b)(2), Communications: auxiliary aids and services. https://www.ecfr.gov/current/title-28/chapter-I/part-35/subpart-E/section-35.160
- United Nations. (2006). Convention on the Rights of Persons with Disabilities, Article 9(2)(e).
- Google DeepMind Sign Language Team. (2026, August 12). Putting sign language AI into users’ hands. Google DeepMind.
- Grizzle-Odland, H. M. (2026, August 22). The Coordinates of Trust: A governance reading of Google DeepMind’s SL2T. Novara Consulting Group.
- McKee, M. M., Plegue, M., Champlin, S., Hill, J., Panko, T., Buis, L. R., Sen, A., Paasche-Orlow, M. K., and Hauser, P. C. (2026). Predictors of health literacy among Deaf American Sign Language users. Patient Education and Counseling, 142, 109348. https://doi.org/10.1016/j.pec.2025.109348
- Panasuik, J. (2026, August 26). The Second Language Condition: An Architectural Reading of SL2T. LinkedIn. https://www.linkedin.com/pulse/second-language-condition-architectural-reading-sl2t-panasuik-m-sc–5ukic/
- Novara Consulting Group. (2026). SLAT Index Evaluation Standard, Version 2.0. https://doi.org/10.5281/zenodo.21537271

