跳到正文
原文
arXiv cs.CL· Muhammad Rafiullah Memon, Viet Vo, Wanlun Ma, Yang Xiang·· 6 小时前AI 评分52

NeurIPS 2026 研讨会论文提出手语到文本安全接口的儿童审计框架

Not What a Child Expressed: Auditing the Sign-to-Text Safety Interface in Child-Facing AI

AI 摘要

该论文指出自动手语翻译(SLT)已进入消费级产品,但现有的儿童面向 AI 平台信任与安全工具仅针对文本进行过滤和 grooming 分类,从未将 SLT 模型与儿童安全过滤器联合评估。研究发现,当前主流部署的 SLT 模型既未针对 18 岁以下使用者训练,也未经过正式评估,导致翻译错误可能在不影响流利度的情况下改变安全决策。

文章提出了一个由聋人知情指导的预部署审计方案,包含失败分类法、清洗后的场景模式、四种比较条件和四种结果度量指标。以澳大利亚手语(Auslan)作为首个案例研究,重点考察否定、参与者角色、保密性、紧急性或求助等关键语义要素的翻译错误如何绕过或触发安全机制。

事实层面确认了 SLT 模型缺乏针对未成年人的训练数据和安全联合评估;推断层面表明当前的多模态安全架构存在系统性盲区,即翻译层可能成为安全过滤的漏洞;猜测层面认为若不加干预,此类接口错误可能导致儿童在寻求紧急帮助时被误判为违规或被忽略。

来源:arXiv cs.CL · arxiv.org