专栏中心

EEPW首页 > 专栏 > 大语言模型微调数据竞赛,冠军!

大语言模型微调数据竞赛,冠军!

发布人:天翼云开发者 时间:2023-12-18 来源:工程师 发布文章

image.png 

近日,天池FT-Data Ranker竞赛落下帷幕,天翼云智能边缘事业部AI团队(后称天翼云AI团队)凭借在大语言模型(LLM)训练数据增强方面的卓越研究,荣获大语言模型微调数据竞赛——7B模型赛道冠军

image.png 

FT-Data Ranker竞赛是一场面向大语言模型研究、以数据为中心的竞赛,吸引了包括来自北京大学、Hantec等知名高校、研究机构、企业的近400支优秀队伍参赛。天翼云在激烈的角逐中脱颖而出,展现出强大的技术创新能力。

 

数据在大语言模型(LLM)的能力打造中发挥着至关重要的作用,更好地构建和处理数据集成为大语言模型领域研究的重点。本次竞赛的核心在于独立、精确地评估和提升数据集质量,加速形成基准驱动的数据开发流程,增强大语言模型数据处理能力,提高该领域对数据质量和数据优化的理解能力。本次竞赛特别关注微调(Fine-tuning)阶段的数据,要求参赛者对原始数据集进行清洗、过滤和增强,利用新数据集对特定模型进行微调,并在测试集上进行性能排名。

 

面向竞赛通用选择任务,天翼云AI团队自主构建了数据处理流程,使用多个文档去重、字符串过滤算子对低质的大规模原始语料进行处理,从而获得高质量的模型训练数据;同时,面向文本摘要任务,天翼云AI团队创新地采用范式迁移(Paradigm Transfer)和模型能力蒸馏(Distillation)的方法,在设定模型随机性为0的前提下,利用生成式模型将原始语料中的问答进行数据处理和迁移,作为摘要数据,间接扩充训练数据。基于以上方法和策略,团队在原始语料基础上构建了一个内容丰富、多样化的任务训练集,帮助模型更好地学习和理解竞赛任务。该方案的创新性实用性得到了评委的高度认可。

 

本次竞赛团队采用的大语言模型训练数据增强技术,已在天翼云团队模型研发和生产业务中广泛应用。例如,在天翼云政务大模型“慧泽”的研发中,通过广泛采用训练数据增强策略和算法来提升模型的各项能力,使得“慧泽“具备了政务知识全面、意图理解能力强、应用广泛以及安全可靠等优势,可高效赋能政策咨询、政务导办、12345坐席辅助、智能办公等场景,助力提升城市治理水平。

 

未来,天翼云将继续推进人工智能相关技术创新以及实践应用,以更加全面、智能的产品与服务,赋能千行百业数字化转型。


专栏文章内容及配图由作者撰写发布,仅供工程师学习之用,如有侵权或者其他违规问题,请联系本站处理。 联系我们

关键词: 云计算 大数据

相关推荐

软件安全成为嵌入式云计算的热点

云计算在IC设计中的应用

打造可靠的云存储技术

Upwind筹集2.5亿美元以实现云安全规模化

云计算掀起智能硬件变革的浪潮

2016物联网大会宣传片

将AI工作负载推向边缘

仿人型机器人能同时流利地说15种语言

边缘计算与人工智能(Edge AI)如何引领新一轮技术革命

应用于数据中心(DataCenter)的 Smarter Solution

视频 2014-02-14

云计算掀起智能硬件变革的浪潮

由Memfault驱动的Nordic nRF Cloud荣获移动突破奖所颁发之年度云计算创新奖

美图获阿里巴巴2.5亿美元战略投资,将在AI与电商领域深度合作

台积电AI产能:英伟达的需求可能迫使实现翻倍

消息称谷歌首款 AR 眼镜年内上市售卖,将在本周 I/O 大会发布

全球云计算市场迎来重大价格调整

2026-02-10

大数据时代

资源下载 2015-05-23

IDC预计,2029年中国大数据总体市场规模将超730亿美元

智能计算 2025-09-11
更多 培训课堂
更多 焦点
更多 视频

技术专区