EPISODE · Jul 22, 2026 · 29 MIN
[人人能懂AI前沿] 从“上锁的剑”到“行动草图”:重塑AI的思考与行动
from AI可可AI生活
你有没有想过,我们该如何驾驭一个越来越聪明的AI?本期我们将从几篇最新的论文出发,探讨一些极其巧妙的思路:我们不删除AI的危险知识,而是给它一把上了锁的“双刃剑”;我们不直接塞给AI答案,而是像“好私教”一样让它反思自己的功劳;我们甚至用古老的“学徒制”让普通模型超越名师,用一张“行动草图”就能指挥机器人干活;最后,我们会发现,解决最复杂的排序问题,有时只需换个更聪明的“提问方式”。准备好了吗?让我们一起看看这些闪耀着智慧之光的AI新思想。00:00:40 给AI一把上了锁的“双刃剑”00:05:00 如何给AI请一个“好私教”?00:10:01 AI世界的“学徒制”,如何把一个普通模型,训练成超级学霸?00:15:52 给机器人画一张“行动草图”00:21:22 给机器排座次,换个聪明的问法本期介绍的几篇论文:[LG] Mark, Don't Erase: Token Inoculation for Dual-Use Knowledge in LLMs [NAVER AI Lab] https://arxiv.org/abs/2607.18639 ---[LG] Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information [Meta AI] https://arxiv.org/abs/2607.19313 ---[CL] Search-on-Graph-R1: Training Large Language Models to Search Knowledge Graphs with Reinforcement Learning [Université de Montréal & McGill University] https://arxiv.org/abs/2607.18481 ---[CV] Masked Visual Actions for Unified World Modeling [Stanford University] https://arxiv.org/abs/2607.19343 ---[LG] Exposure-Based Reinforcement Learning to Rank [Google DeepMind & University of Amsterdam] https://arxiv.org/abs/2607.18689 在小宇宙查看该单集文稿
Embed this episode
Ready to play
[人人能懂AI前沿] 从“上锁的剑”到“行动草图”:重塑AI的思考与行动
No transcript for this episode yet
Similar Episodes
No similar episodes found.