首页 > 财税知识 > 财税知识 > 国际最新研究称,一人工智能模型能翻译200种不同语言

国际最新研究称,一人工智能模型能翻译200种不同语言

发布时间:2024-06-09 15:50:05来源: 15210273549

京6月8日电 (记者 孙自法)国际著名学术期刊《自然》最新一篇人工智能(AI)研究论文称,研究人员开发出一个Meta人工智能模型的底层技术,该模型能翻译200种不同语言,增加了能用机器翻译的语言数量。

该论文介绍,神经机器翻译模型利用人工神经网络翻译各种语言,这些模型通常需要大量可在线获取的数据加以训练,但并非所有语言数据都公开、低成本或是普遍可及,此类语言被称为“低资源语言”。而增加模型在翻译语言数量上的语言输出可能会影响模型的翻译质量。

为此,本篇论文作者、“不落下任何语言”(No Language Left Behind,NLLB)团队开发出一种跨语言技术,能让神经机器翻译模型学习如何利用翻译高资源语言的预存能力来翻译低资源语言。作为成果,NLLB团队开发了一个在线多语言翻译工具,名为NLLB-200,该工具能容纳200种语言,其低资源语言数量是高资源语言的三倍,翻译表现比已有系统高了44%。

由于NLLB团队在许多低资源语言上只能获取1000-2000例样本,为扩大NLLB-200的训练数据量,他们用一个语言识别系统发现了这些特定语言的更多实例。该团队还从互联网存档中挖掘双语文本数据,帮助提升了NLLB-200的翻译质量。

《自然》同期发表同行专家“新闻与观点”文章指出,NLLB团队研发的这个工具,可以帮助很少被翻译的那些语言的使用者,让他们能使用互联网和其他技术。

此外,NLLB团队还强调教育是一个非常重要的应用,因为这个模型可以帮助低资源语言使用者获取更多图书和研究文章。不过,该团队也提醒说,误译的情况仍有可能出现。(完)

财税知识更多>>

理想 L6 深度剖析:25 万级中大型 SUV 的实力担当? 新款雪铁龙 C3 Aircross ——喜欢他的理由有很多 东风风行星海S7再出新版,配置新调整,纯电续航555公里 红旗P301项目首台验证样车下线!预计2026年5月正式投产 长城汽车2025新车巡礼:从越野悍将到百万豪车,总有一款让你心动 长安汽车2月9日举行开年第一场发布会,深蓝S09有望亮相 问了DeepSeek,哈弗和坦克,以及长城汽车的一些问题 吉利银河L6混动和秦PLUS在NVH和舒适性的比较 新风口来袭——DeepSeek AI牵手吉利,共启智能驾驭新时代 小鹏汽车上涨2.93%,报17.035美元/股 小鹏确认:新X9纯视觉智驾,全系取消激光雷达价格能否带来惊喜? 蔚来汽车在中国的第 3,100 个换电站上线 8万起的埃安UT,凭啥敢称“A级颜霸”? “鼠标模式”实锤?任天堂专利透露了Joy-Con的新功能 电脑软件:硬盘信息检测工具 HD Tune Pro v6.00 介绍和使用教程 解码拼多多“新质供给”:产业带高质量转型的新电商实验 上海二手房买卖最新费率:个税,增值税,契税一览 房价若继续下跌,41.5%家庭或迎来“4大难关”,今明两年情况如何? 2025一季度最具性价比的国产手机推荐 下一代宝马X5测试突生意外,深陷雪堆,揭秘新一代豪华SUV的设计 选车不纠结!日产轩逸、丰田雷凌、卡罗拉全方位大对比 2024年北上广最爱买什么车型?特斯拉Model Y成最大赢家 比亚迪多车已支持 博主:双枪充电含金量在25年会不断提升 乐道汽车春节服务:将有1200座换电站投入运营 法媒:关税也不能影响中国电动车成为冠军 品牌年度销量TOP10榜,都说合资不行了,为何自主才4家? 车型年度终端销量排行:SUV、轿车前十油车占四席,MPV油车势危 全新林肯领航员亮相北美车展,车长近5.4米,配48英寸贯穿屏 上汽奥迪A5L路试曝光,溜背轿跑造型亮眼,还有无框车门? 体量惊人但没有像素灯,问界M8无伪装实车曝光,会是爆款吗?