Google Research·· 19 天前AI 评分41
绕过推理瓶颈:Retrieve-for-Train 加速复杂 AI 搜索
Bypassing inference bottlenecks: Accelerating complex AI search with Retrieve-for-Train
AI 导读
Retrieve-for-Train 框架通过离线强化学习将查询扇出编译为监督信号,再蒸馏进 53.9M 参数扩散检索器,推理时以单次非自回归前向生成完整目标嵌入集,绕开 CoT 推理 token 带来的推理瓶颈。该框架出自 ICML 2026 论文,并用强化学习微调了 Gemma3-4B 和 Qwen3-4B。
来源:Google Research · research.google