跳到正文
Google Research·· 19 天前AI 评分41

绕过推理瓶颈:Retrieve-for-Train 加速复杂 AI 搜索

Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train

AI 导读

Retrieve-for-Train 框架通过离线强化学习将查询扇出编译为监督信号,再蒸馏进 53.9M 参数扩散检索器,推理时以单次非自回归前向生成完整目标嵌入集,绕开 CoT 推理 token 带来的推理瓶颈。该框架出自 ICML 2026 论文,并用强化学习微调了 Gemma3-4B 和 Qwen3-4B。

来源:Google Research · research.google