Techub News 消息,谷歌研究院发布全新检索框架 Retrieve-for-Train(R4T),旨在解决推荐系统需返回多样化结果集而非单一最佳匹配的问题。R4T 使用强化学习学习查询扩散策略,并将其蒸馏成一个小型扩散模型,可在单次推理中生成全部检索方向,使查询扩散效率提升 12 至 20 倍。 该框架解决了通用大语言模型在执行查询扩散时的两大问题:近义坍塌(产生过于相似的子查询)和延迟过高。其通过三阶段流程实现:首先训练一个查询扩散语言模型,然后合成监督数据,最终训练一个参数为 5390 万的扩散变换器模型来直接生成目标嵌入集合。 在 Polyvore 时尚搭配数据集和专有音乐数据集上的测试显示,基于 Gemma3-4B 的 R4T 框架在开放检索质量上优于最佳采样法,其生成的子查询多样性从零样本的 56.0 提升至 76.8。该方法无需在推理时重复调用大模型,显著降低了成本与延迟。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo.
Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin.
Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.
Techub News 消息,谷歌研究院发布全新检索框架 Retrieve-for-Train(R4T),旨在解决推荐系统需返回多样化结果集而非单一最佳匹配的问题。R4T 使用强化学习学习查询扩散策略,并将其蒸馏成一个小型扩散模型,可在单次推理中生成全部检索方向,使查询扩散效率提升 12 至 20 倍。 该框架解决了通用大语言模型在执行查询扩散时的两大问题:近义坍塌(产生过于相似的子查询)和延迟过高。其通过三阶段流程实现:首先训练一个查询扩散语言模型,然后合成监督数据,最终训练一个参数为 5390 万的扩散变换器模型来直接生成目标嵌入集合。 在 Polyvore 时尚搭配数据集和专有音乐数据集上的测试显示,基于 Gemma3-4B 的 R4T 框架在开放检索质量上优于最佳采样法,其生成的子查询多样性从零样本的 56.0 提升至 76.8。该方法无需在推理时重复调用大模型,显著降低了成本与延迟。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

Mọi thông tin trên trang web này chỉ mang tính tham khảo. Trang web không bảo đảm tính chính xác, hiệu lực, kịp thời hay đầy đủ của thông tin. Người dùng tự chịu rủi ro khi hành động dựa trên thông tin của trang web này.