绕过推理瓶颈:用 Retrieve-for-Train 加速复杂 AI 搜索

2026-09-16

Google Research 提出 Retrieve-for-Train 框架,用离线强化学习一次性训练轻量扩散模型,绕过推理时自回归思考预算,即时生成连贯且专家级的 AI 搜索结果集。