IT之家 11 月 27 日消息,据阿里云官方公众号,新加坡国家人工智能计划近日发布了一款名为 Qwen-SEA-LION-v4的东南亚多语言大模型。该模型的核心技术底座基于阿里巴巴的“通义千问”开源模型构建…
近日,新加坡国家人工智能计划联合阿里巴巴推出了一款面向东南亚市场的多语言大模型——Qwen-SEA-LION-v4。该模型以阿里巴巴开源的“通义千问”框架为基础,通过针对性优化,成功突破了东南亚地区语言多样性带来的技术瓶颈,成为全球首个在该领域实现突破的AI解决方案。
东南亚地区语言生态复杂,现存超过1200种语言,日常交流中常出现多语言混用现象。然而,现有主流AI模型多以英语为核心开发,难以适配东南亚本土需求,导致该地区长期面临“AI服务断层”问题。此次中新联合研发的模型通过技术革新,首次在“东南亚语言模型全面评估基准”(SEA-HELM)的2000亿参数量以下开源模型榜单中夺得榜首,标志着区域性AI技术实现重大突破。
研发团队透露,Qwen-SEA-LION-v4的预训练阶段已覆盖119种语言,特别针对东南亚小语种进行数据增强。在后训练阶段,团队通过增加跨语言任务权重,使模型具备处理混合语言输入的能力。例如,在输入包含马来语、泰语和英语的复杂语句时,模型仍能准确理解语义并生成符合语境的回应。
为推动技术普惠,该模型已通过AISingapore官网及HuggingFace开源社区向全球开放下载。开发者可基于模型进行二次开发,应用于教育、医疗、政务等多个场景。此前,东南亚地区因语言障碍导致AI应用成本高昂,此次开源有望降低本地化服务门槛,加速区域数字化转型进程。
(来源:小熊科技)免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。
