苹果研究破解 AI“英语口音”难题,提升多语言自然性

苹果研究破解 AI“英语口音”难题,提升多语言自然性

IT资讯 2025-05-17 14:09:05 6小时前

IT酷哥 5 月 17 日消息,苹果与多国高校及研究院联合发布最新成果,揭示了大语言模型存在的“英语思维定式”问题,并提出创新解决方案。IT酷哥注意到,科研人员中不乏中国学者的存在。

研究人员针对非英语语种输出中普遍存在的语法与词汇偏差问题展开了深度剖析,测试覆盖中文、法语、英语(基于维基百科)语料。

测试发现,即使专为中文优化的 Qwen 模型,其母语表现仍落后人类水平;Meta 的 Llama 3.1 综合表现最佳,但自然度仍存在显著差距;所有模型在非英语输出中均残留英语语法结构。

换句话说,即使模型在用中文或法语进行对话,但它仍在用英语进行“思考”,而且非英语输出仍然遵循类似英语的语法和词汇模式。

针对大语言模型的遣词造句,研究团队提出两项量化指标:

词汇自然性(Lexical Naturalness):评估 LLM 用词是否符合母语习惯

句法自然性(Syntactic Naturalness):检验 LLM 语句是否贴合本土语法

为了缩小差距,研究人员通过“回译法”自动生成训练样本,将人工撰写的流畅中文内容先翻译成英文,再逆向翻译成带有 "翻译腔" 的“反面”样本。利用这类对比数据训练模型加强自然表达能力,在保持基准性能的前提下显著改善语言输出质量。

论文地址:

https://arxiv.org/abs/2410.15956

文章版权声明:除非注明,否则均为网络转载文章,转载或复制请以超链接形式并注明出处。

相关阅读

  • 多元办公场景下,企业如何保障工作效率与数据安全流通?
  • 以轻便机身承载旗舰级优异性能 尼康 Z 8 开发者访谈
  • 《动物派对》全新宣传视频放出,支持英伟达 DLSS 2 和 Reflex 技术
  • 戴森推出系列创新科技,更智能、高效地打造洁净健康的家居环境
  • 国汽智图亮相 2023 中关村论坛 为数字经济产业发展注入创新动能
  • 消息称谷歌天气即将成为独立 App,有望下月随谷歌新硬件一同发布
  • 钉钉接入“通义听悟”,大模型摘要能力已加入邀测
  • 洞察 Z 世代生活,小熊电器产品迭代交出高分答卷
  • Wi-Fi 技术与应用场景前瞻研讨会召开,锐捷将助推 Wi-Fi 7 为垂直行业注入新活力
  • 618 人气好物 三星 Galaxy Buds2 系列耳机热销中
  • 幕布加入 flomo 浮墨笔记团队,7 月份恢复 iOS / 安卓各端更新
  • 国内首款汽车电子安全气囊点火驱动专用芯片由国芯科技研发成功
  • 跨境商家利好! 菜鸟国际快递搭乘中欧班列 物流降本 70%
  • JetBrains 中国大陆业务计划落地至上海公司,全系列产品将推出包含增值税的人民币定价
  • IMT-2020 (5G) 推进组携手产业链发布裸眼 3D 产业推进倡议, 加速裸眼 3D 移动应用规模化发展
  • 中科院与腾讯申请的 AI 心理咨询专利获授权
  • 科大讯飞:将发布“讯飞星火认知大模型”V1.5
  • 小米推出高考活动,完成考生认证即可获得千元优惠券包和其他产品
  • 欧盟宣布联合 56 家公司启动 81 亿欧元的微电子项目
  • 智方舟网信生态加速营入围名单揭晓
  • 最新资讯

    热门资讯