跳到正文
原文
Google Research·· 16 天前AI 评分25

Google Research 提出 Retrieve-for-Train 框架加速复杂 AI 搜索

Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train

AI 导读

Google Research 推出 Retrieve-for-Train 框架,通过离线强化学习将查询分解行为编译为监督信号,以解决 LLM 在复杂搜索中的推理瓶颈。该方案利用 RL 训练 Gemma3-4B 和 Qwen3-4B 生成对齐属性的子查询,并蒸馏至一个 53.9M 参数的扩散检索器中。此架构实现了单次非自回归推理,消除了测试时思维链开销,显著提升了集合级搜索结果的多样性与响应速度。

来源:Google Research · research.google