时间:2025-07-01 11:52:25来源:青软科技园
本站 5 月 17 日消息,苹果与多国高校及研究院联合发布最新成果,揭示了大语言模型存在的“英语思维定式”问题,并提出创新解决方案。本站注意到,科研人员中不乏中国学者的存在。
研究人员针对非英语语种输出中普遍存在的语法与词汇偏差问题展开了深度剖析,测试覆盖中文、法语、英语(基于维基百科)语料。
测试发现,即使专为中文优化的 Qwen 模型,其母语表现仍落后人类水平;Meta 的 Llama 3.1 综合表现最佳,但自然度仍存在显著差距;所有模型在非英语输出中均残留英语语法结构。
换句话说,即使模型在用中文或法语进行对话,但它仍在用英语进行“思考”,而且非英语输出仍然遵循类似英语的语法和词汇模式。
针对大语言模型的遣词造句,研究团队提出两项量化指标:
词汇自然性(Lexical Naturalness):评估 LLM 用词是否符合母语习惯
句法自然性(Syntactic Naturalness):检验 LLM 语句是否贴合本土语法
为了缩小差距,研究人员通过“回译法”自动生成训练样本,将人工撰写的流畅中文内容先翻译成英文,再逆向翻译成带有 "翻译腔" 的“反面”样本。利用这类对比数据训练模型加强自然表达能力,在保持基准性能的前提下显著改善语言输出质量。
论文地址:
https://arxiv.org/abs/2410.15956
网发此文仅为传递信息,不代表认同其观点或证实其描述。同时文中图片应用自网络,如有侵权请联系删除。
苹果研究破解 AI“英语口音”难题,提升多语言自然性
2025-07-01 11:52Windsurf 首款 AI 软件工程模型:SWE-1 系列登场,编程能力比肩 GPT-4.1、Gemini 2.5 Pro
2025-07-01 11:35外资迎利好!三部门发布新税收抵免政策鼓励在华再投资
2025-07-01 11:33科技昨夜今晨 0517:整车 33.8 万元起,蔚来新 ES6 / EC6 上市;小米手机官宣 Civi 5 Pro 本月见 ;中国电信 5G-A 套餐商用...
2025-07-01 11:142025土耳其国际铸造展:土耳其铸造业盛况,中国展商不容错过!
2025-07-01 11:11