如今,各行业语料数据如一座座“孤岛”,跨领域复合型语言科技人才更是“一将难求”。各高校、科研院所、行业企业独立布局、资源难以集中,难以面向医疗、应急、高端制造、国际传播等关键领域形成系统化创新合力。
8月24日,中国语言资源保护工程成果展示馆开馆系列活动在长沙湖南省博物馆开幕。活动上,国家关键领域语言科技赋能联盟(以下简称“联盟”)成立,同时《促进语言资源赋能文化和科技融合长沙倡议》在会上发布。这是一个由全国高等院校、科研院所及相关企事业单位等多元主体自愿组建的全国性、非营利性协同创新平台,东华大学作为联盟秘书处依托单位,将牵头推进联盟建设与日常运行。
联盟坚持“大语言观”与“大科技观”深度融合,致力于将语言从传统的“交流工具”和“软实力”,重塑为驱动高质量发展的“新型基建”与“硬支撑”。围绕这一目标,联盟锚定了语言资源要素化的“转化器”、语言服务标杆化的“试验场”、安全发展规范化的“护城河”、国际协作项目化的“桥头堡”、语言赋能普及化的“研究室”等五大功能定位,部署了五大核心任务。
在战略咨询与标准评测上,组建高水平专家委员会,牵头制定语言数据采集、标注、数据集质量、大模型应用成熟度等行业技术标准,让行业发展有“尺”可量。
在语料资源共建共享上,针对应急、纺织、医疗等关键领域,建设大规模、高质量、多模态的专用语料库,打破行业语料“孤岛”,让数据资源集约利用、安全共享。
在关键核心技术攻关上,协同研发垂直领域语言大模型,攻克小语种机器翻译、低资源语音识别、复杂场景语义理解等“卡脖子”技术,组建高端智库研判人工智能对国家语言安全的影响。
在跨学科人才培养上,推动高校设立“语言+”交叉学科,构建新型课程体系,培养兼具语言学和行业领域知识的复合型人才,让人才供给跟上产业需求。
在成果转化与交流推广上,建立企业需求清单与成果供给池,举办“语言科技+”成果推介与供需对接会,精准匹配可转化成果与行业需求,让技术从实验室“走”到生产线。
据了解,东华大学多年来在语言科技赋能领域扎实探索。作为一所以理工见长、人文底蕴深厚的高校,东华大学拥有纺织、材料等“双一流”学科优势,为语言科技赋能产业提供了丰富的应用场景。学校已建成国家语言文字推广基地、纤维材料语料库、纺织服饰数智百科系统等一系列基础平台,率先布局纺织服装垂直领域行业大模型研发,推出服装样板智能生成系统、材赋教育大模型、智能翻译教学平台等多项语言科技创新成果,持续深化语言科技赋能的理论探索与实践应用,成为语言科技的“试验田”。
值得一提的是,东华大学秉持“育人为本、智能向善、服务社会”理念,自主研发了“爱·东华”AI辅导员系统。这套系统,以META-RAG技术及校本语料库为驱动,构建了“永不下线、随时陪伴”的智慧育人新范式。
同时,东华大学联合北京大学、同济大学、北京语言大学、鹏城实验室、国家图书馆、科大讯飞股份有限公司等数十家高校、科研院所和企事业单位,共同发起了联盟组建工作。