騰訊公布大語言模型訓練專利 可提高模型的準確性觀點
觀察君
2025-02-08 12:17

導讀
天眼查App顯示,2月7日,騰訊科技(深圳)有限公司申請的“大語言模型的訓練方法、裝置、計算機設備及存儲介質”專利公布。
天眼查App顯示,2月7日,騰訊科技(深圳)有限公司申請的“大語言模型的訓練方法、裝置、計算機設備及存儲介質”專利公布。
摘要顯示,在該方法中,通過在大語言模型的訓練過程中引入第一摘要文本和第二摘要文本,為模型訓練提供了更多可學習信息,同時由于第一摘要文本和第二摘要文本包含的信息量不同,且第一摘要文本中包含正確語句和錯誤語句,通過對同一樣本文本的兩個不同摘要文本進行對比學習,并區分學習第一摘要文本中的正確語句和錯誤語句,避免了由于摘要文本單一而導致的模型過擬合和生成不準確等問題,不僅提高了模型的泛化性能,還提高了模型的準確性。
1.TMT觀察網遵循行業規范,任何轉載的稿件都會明確標注作者和來源;
2.TMT觀察網的原創文章,請轉載時務必注明文章作者和"來源:TMT觀察網",不尊重原創的行為TMT觀察網或將追究責任;
3.作者投稿可能會經TMT觀察網編輯修改或補充。