腾讯公布大语言模型训练专利 可提高模型的准确性

腾讯公布大语言模型训练专利 可提高模型的准确性

天眼查App显示,2月7日,腾讯科技(深圳)有限公司申请的“大语言模型的训练方法、装置、计算机设备及存储介质”专利公布。

摘要显示,在该方法中,通过在大语言模型的训练过程中引入第一摘要文本和第二摘要文本,为模型训练提供了更多可学习信息,同时由于第一摘要文本和第二摘要文本包含的信息量不同,且第一摘要文本中包含正确语句和错误语句,通过对同一样本文本的两个不同摘要文本进行对比学习,并区分学习第一摘要文本中的正确语句和错误语句,避免了由于摘要文本单一而导致的模型过拟合和生成不准确等问题,不仅提高了模型的泛化性能,还提高了模型的准确性。

f5448385aa89e6b68fe084ceb87c95f.png32a5c2515be21f4a5bac228a66c2e53.png

 

原创文章,作者:新智派,如若转载,请注明出处:https://knewsmart.com/archives/326597

(0)
上一篇 2025年2月8日 上午11:12
下一篇 2025年2月8日 下午12:12

相关推荐

发表回复

登录后才能评论