一种大语言模型的Token级接受-拒绝对齐方法

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
一种大语言模型的Token级接受-拒绝对齐方法
申请号:CN202510861689
申请日期:2025-06-25
公开号:CN120725003A
公开日期:2025-09-30
类型:发明专利
摘要
本发明提供了一种大语言模型的Token级接受‑拒绝对齐方法,可以应用于自然语言处理技术领域。该方法包括:基于文本训练数据,利用目标大语言模型生成的候选Token集,并对候选Token集进行多策略采样,得到候选Token有序集;将Token筛选过程建模成马尔可夫决策过程,通过轻量化对齐模型计算候选Token有序集中的每个Token的接收‑拒绝概率进而实现对候选Token有序集进行筛选,得到Token筛选集;利用Token筛选集对所述目标大语言模型生成的候选文本序列进行筛选以便将句子级对齐任务分解为Token级二元分类任务,得到与文本训练数据相对应的目标文本样本。
技术关键词
大语言模型 对齐方法 多策略 决策 文本生成模型 序列 数据 标签 网络优化 模型更新 自然语言 图像 样本 阶段 蒸馏 动态