国家知识产权局信息显示,支付宝(杭州)数字服务技术有限公司申请一项名为“基于强化学习训练生成模型的方法及装置”的专利,公开号CN121581138A,申请日期为2025年11月。
专利摘要显示,本说明书实施例提供一种训练生成模型的方法及装置,针对目标生成模型,可以在GRPO强化学习的基础上,引入竞争性对抗学习的另外一个生成模型,对于同一条输入数据,可以由两个生成模型分别进行处理,各自得到多条生成信息,然后,可以将两个生成模型对应的生成信息一一对应,并通过判别模型对比确定各条生成信息的奖励分数。然后根据奖励分数确定目标生成模型的优化目标,向着优化目标最大化方向调整目标生成模型的待定参数。在目标生成模型优化的同时,还可以对作为竞争的另一个生成模型进行优化。如此,构成竞争性对抗强化学习,可以减缓奖励破解的问题。
天眼查资料显示,支付宝(杭州)数字服务技术有限公司,成立于2016年,位于杭州市,是一家以从事软件和信息技术服务业为主的企业。企业注册资本10000万人民币。通过天眼查大数据分析,支付宝(杭州)数字服务技术有限公司共对外投资了12家企业,参与招投标项目65次,财产线索方面有商标信息76条,专利信息5000条,此外企业还拥有行政许可60个。
声明:市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
来源:市场资讯