让每一次练习都有反馈!广外打造首个基于CSE口译量表建模的教学AI平台
创始人
2026-08-19 00:06:01

长期以来,口译教学最重要的四步是“听、记、译、评”。前三步教师能在课堂上带着学生走,第四步却常常“带不动”。一份交替传译练习,教师要重听录音、比对源语,判断哪里漏了信息、译反了逻辑,哪些卡顿影响沟通,再写出学生能照着改的评语。广东外语外贸大学高级翻译学院副院长王巍巍教授说:“一个班三十人,一周一次练习,教师就要听三十遍录音。这几乎是不可能完成的工作量。”这不是一所学校独有的问题,也是口译教学长期面临的共性难题。“AI云帆译”由此应运而生。

初心缘起:从国家标准到智能平台的十年破壁

2014年至2018年,王巍巍团队参与研制《中国英语能力等级量表》(CSE)口译量表。2018年,该量表由教育部、国家语委正式发布。它把过去较多依赖经验判断的口译质量,转化为可描述、可分级的能力指标。

有了标准,还要让标准真正进入课堂。一线口译教师大多没有语言测试学的专门训练,如果逐条对照量表评分,理解成本和时间成本都很高。王巍巍说:“量表要真正起作用,必须变成教师和学生都能使用的工具。这就是‘AI云帆译’的起点。”

从量表到产品,团队走了近十年。2019年起,团队与阿里达摩院、阿里云等合作开展算法研发,逐步搭建1.0算法底座;2024年完成工程化开发,“AI云帆译”平台于当年底上线发布;2026年,基于预训练模型的口译自动评分模型(Pretrained-model based Automatic Scoring for Interpreting,PASI)获广东省生成式人工智能服务备案登记,成为广东省首个完成备案的高校自研口译测评模型。

全链拆解:“教—学—练—评”的智能闭环

与市面上的翻译学习类AI产品相比,“AI云帆译”的特点在于以国家语言能力标准为理论基础。团队参与了CSE口译量表研制,对量表构念、等级描述与教学应用有持续而深入的理解,这使量表解释、模型建构与教学反馈能够保持较高的一致性。

王巍巍介绍,“AI云帆译”的技术链路分为四段:语音识别将学生的口译录音和源语音频转写为文字;声学特征评分关注发音、流畅度、韵律和停顿等声音特征;语义评分在句级对齐基础上,结合多参考译文、源语信息与量表分级判据,评估信息传递质量,避免把单一参考译文视为唯一答案;最后通过反馈生成与交互,将分数转化为学生看得懂、能照着改的评语。

落到课堂上,平台贯通四个环节:课前,学生完成预习性练习,系统自动测评并生成班级学情数据;课中,教师依据能力分布确定讲解重点,不再只凭印象判断;课后,学生开展线上线下练习,获得AI即时反馈并参与同伴互评;复盘时,再进行问题诊断和目标设定。一学年下来,每名学生都能沉淀出一份“口译能力发展测评报告”。

平台的核心底座是PASI口译自动评分模型。模型从内容、表达、交际三个维度评分,对应CSE口译量表中的准确度与完整性、语言使用与逻辑连贯、流畅度与有效沟通等核心要求。学生看到的不只是一个分数,还包括“目前处于什么水平、下一阶段需要做到什么”。目前平台主要覆盖中英双向交替传译训练,其他语对与任务类型正在持续建设。

已发表研究为模型的评分质量提供了初步效度证据:在同质口译学生样本中,PASI 1.0与人工评分的Pearson相关系数达到0.95。后续研究也发现,模型在人群构成和任务类型变化时表现存在差异;团队正持续开展多场景人机一致性验证,优化交替传译等任务中的评分稳定性。

平台还实现了动态分层教学和个性化学习路径规划。分层依据不是一次考试的总分,而是学生在三个维度上的历史评分序列。“一个学生可能内容维度处于中上水平,表达维度相对偏弱,他需要的不是简单‘降到B班’,而是在表达维度上加强训练。”平台提供三层反馈:三个维度的量化分数、各维度对应的分层评语,以及关联具体译文片段的问题定位。

AI接手部分重复性评判后,教师可以把更多精力用于目标设定、课程规划和策略传授。“AI给翻译教育带来的核心价值,是让‘每一次练习都有反馈’第一次变得可执行。”王巍巍说。

但技术进入课堂的目标并不是简单“减负”。口译系副教授余怿使用平台两年。她认为,平台主要解决了练习材料难度分层和练习进度自主把控两个问题,避免能力较强的学生“吃不饱”,也避免基础较弱的学生因压力而逃避、不敢开口。“教学技术使用的第一目标绝对不是减轻工作负担,而是提升教学效率和效果。”

落地有声:从课堂到地方国际传播的“学练战赛”

平台自2024年上线以来,已在广外本硕课程中常态化使用,服务覆盖校内4万余名师生。活跃用户累计使用中英口译练习素材538篇,教师发布班级口译任务741个,学生在线练习时长达7519小时。平台已嵌入《交替传译》《专题口译》《模拟会议口译》等核心课程,并辐射境内外多所合作高校。

云帆实验室负责人、口译系副教授许艺从平台上线起便在多门口译课程中持续使用。她认为,平台解决的最大问题不只是提高评分效率,更是把课外练习真正组织起来。教师精力有限,不可能每次练习都逐份点评;现在学生练习后能较快得到内容、表达、交际三个维度的反馈。她还观察到,同伴互评的质量也随之提高:过去讨论多停留在漏译和语法等表层问题,现在学生熟悉三个维度后,讨论更容易深入。

2024级口译专业研究生刘乐山把平台称作“24小时在线的口译陪练”。“课余练习最突出的问题,就是找不到合适的素材,也得不到及时反馈。”他尤其喜欢语音转写和测评功能,因为这些功能可以帮助他监测填充词等不良表达习惯。

平台培养的复合型新文科人才还对接“IP Guangdong”等广东省国际传播重点工作。学生年均完成多语种翻译200多万字、音视频本地化100小时;2025年9月至11月,团队线上线下培训全省1200多名涉外讲解人员;已举办四届、累计参赛超10000人的“云山杯”国际远程口译大赛,赛题均取自广东21个地市的真实参访案例。王巍巍把这个闭环概括为“学、练、战、赛”:课堂学习理论与方法,平台训练基本功,真实项目中实战,国际赛事上检验。

(小标题)面向未来:把人的优势放在更高价值的任务上

在AI冲击翻译行业的背景下,王巍巍判断,重复性、低难度的语言转换任务会率先被替代,但高端口译的价值将进一步凸显。“高端译员真正处理的,不只是语言转换,更包括信息筛选、语境判断和沟通协调。”目前多数商用AI同传采用级联架构,仍可能出现延迟累加和错误传播;更根本的挑战,是准确识别言外之意。比如,一位发言者听完一套层层加码的流程后说“这个方案可真省事”,真实意图可能恰恰是批评流程繁琐。如果系统只按字面直译,就会把反讽误判为赞许。“语气、反问和非语言信息的综合处理,仍是人类译员的重要优势。”

近年来,文科和翻译专业不断面对“AI都会翻译了,还学这个干什么”的追问。王巍巍主张“守正创新”:守住翻译训练的内核——判断力、跨文化理解,以及在不同主体之间促成沟通、解决问题的能力;同时主动拥抱技术。“如果文科面对质疑只会说一句‘AI取代不了我们’,那就是在等待被淘汰。”

她认为,“翻译是AI时代的微积分”。翻译训练所培养的发现文化差异、提炼信息主旨、清晰表达和居中协调等能力,正是人机协作时代需要的核心能力。

“外语教育长期以来较多依赖经验驱动。一个好教师的判断力来自多年积累,但这种判断力难以外化、传递和规模化。”王巍巍说,数据驱动正在改变这一点。当每一次练习都留下结构化评分记录,教学判断便有了可累积、可检验、可传递的依据。“AI平台在这个转型中扮演的角色,说到底,是把国家语言能力标准数字化,让它真正落到每一堂课、每一次练习中。”

文丨记者 陈亮

图丨受访者提供

编辑:王沫依

原标题:让每一次练习都有反馈!广外打造首个基于CSE口译量表建模的教学AI平台 来源:羊城晚报•羊城派

相关内容

热门资讯

三晖电气上半年营收1.03亿元... 8月18日,三晖电气发布2026年半年报。报告显示,公司上半年营业收入为1.03亿元,同比下降29....
卓创资讯上半年营收1.85亿元... 8月18日,卓创资讯发布2026年半年报。报告显示,公司上半年营业收入为1.85亿元,同比增长8.2...
力宝华润(00156.HK)拟... 格隆汇8月18日丨力宝华润(00156.HK)宣布,公司将于2026年8月28日星期五假座香港金钟道...
福耀玻璃中期收入219.71亿... 观点网讯:8月18日,福耀玻璃(03606.HK)发布截至2026年6月30日止6个月的中期业绩。期...
特朗普:不寻求延长美伊谅解备忘... (来源:经济日报)转自:经济日报美国东部时间8月17日下午,美国总统特朗普在白宫回答媒体提问时表示,...