苹果研究破解 AI“英语口音”难题,提升多语言自然性
作者:灵犀软件园时间:2025-05-22 17:05:11
本站 5 月 17 日消息,苹果与多国高校及研究院联合发布最新成果,揭示了大语言模型存在的“英语思维定式”问题,并提出创新解决方案。本站注意到,科研人员中不乏中国学者的存在。
研究人员针对非英语语种输出中普遍存在的语法与词汇偏差问题展开了深度剖析,测试覆盖中文、法语、英语(基于维基百科)语料。
测试发现,即使专为中文优化的 Qwen 模型,其母语表现仍落后人类水平;Meta 的 Llama 3.1 综合表现最佳,但自然度仍存在显著差距;所有模型在非英语输出中均残留英语语法结构。
换句话说,即使模型在用中文或法语进行对话,但它仍在用英语进行“思考”,而且非英语输出仍然遵循类似英语的语法和词汇模式。
针对大语言模型的遣词造句,研究团队提出两项量化指标:
https://arxiv.org/abs/2410.15956
词汇自然性(Lexical Naturalness):评估 LLM 用词是否符合母语习惯
句法自然性(Syntactic Naturalness):检验 LLM 语句是否贴合本土语法
为了缩小差距,研究人员通过“回译法”自动生成训练样本,将人工撰写的流畅中文内容先翻译成英文,再逆向翻译成带有 "翻译腔" 的“反面”样本。利用这类对比数据训练模型加强自然表达能力,在保持基准性能的前提下显著改善语言输出质量。
论文地址:
相关文章
-
苹果研究破解 AI“英语口音”难题,提升多语言自然性
本站 5 月 17 日消息,苹果与多国高校及研究院联合发布最新成果,揭示了大语言模型存在的“英语思维定式”问题,并提出创新解决方案。本站注意到,科研人员中不乏中国学者的存在。研究人员针对非英语语种输出
-
realme 真我 GT 7T 手机渲染图再曝:7000mAh 电池、5000 万主摄、天玑 8400 MAX 芯片
本站 5 月 17 日消息,消息源 Sudhanshu Ambhore 昨日(5 月 16 日)在 X 平台发布推文,曝料称 realme 真我计划 5 月 27 日发布 GT 7T 手机,并分享了完
-
最强 AI 编程助手:OpenAI 发布 Codex 智能体,专注自动化软件开发
本站 5 月 17 日消息,OpenAI 今天(5 月 17 日)宣布推出基于云端的 AI 智能体 Codex,专注于自动化软件开发,涵盖修复错误和实现功能等任务,官方希望该智能体可以开创代码编写的新
-
苹果调整多地 App Store 定价政策,实施新开发者税率
本站 5 月 17 日消息,苹果当地时间周五发布开发者公告,宣布在巴西、哈萨克斯坦及欧洲多国对 App Store 定价与开发者收益方案进行调整。本站汇总具体变更如下:巴西(5 月 16 日生效)针对
-
批量退出人形机器人后,金沙江投资水下机器人
本站 5 月 18 日消息,据投中网 15 日报道,苏州世航智能科技有限公司(以下简称“世航智能”)宣布连续完成天使 + 轮和 Pre-A 轮 5000 万元融资。其中,天使 + 轮由招商局集团招商启
-
国内首个全潜式深远海智能渔业平台设计方案获得 AIP 认证
感谢本站网友 有容乃悦、独爱依兰 的线索投递! 本站 5 月 18 日消息,据海油工程微讯消息,海油工程设计院自主研发的 5 万立方米全潜式深远海智能渔业