EPISODE · Jul 1, 2026 · 28 MIN
[人人能懂AI前沿] 从元认知、内省耦合到多维反馈
from AI可可AI生活
你有没有想过,我们如何才能真正信任一个AI?本期节目,我们将从几篇最新论文出发,看看如何让AI学会谦虚地承认“我不确定”,以及如何看穿它解释背后真实的“小心思”。我们还会聊聊,如何赋予AI更强大的“变焦”记忆力,并像指挥家一样精准调教它的行为。准备好,一起揭开AI更深层的秘密吧!00:00:27 一个更“诚实”的AI,是如何炼成的?00:05:47 给AI的黑箱,装一扇透明的窗00:11:35 AI的“读心术”,我们真能看懂它在想什么吗?00:17:14 AI的记忆难题与“可变焦”图书馆00:22:22 如何正确地“挑毛病”,一个让机器人变聪明的沟通方法本期介绍的几篇论文:[CL] Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs [Yale University & Google Research] https://arxiv.org/abs/2606.32032 ---[CL] Introspective Coupling: Self-Explanation Training Tracks Behavioral Change Despite Fixed Supervision [MIT] https://arxiv.org/abs/2606.32038 ---[LG] Surrogate Fidelity: When Can Open LLMs Explain Closed Ones? [Meta] https://arxiv.org/abs/2606.32008 ---[CL] SeKV: Resolution-Adaptive KV Cache with Hierarchical Semantic Memory for Long-Context LLM Inference [University of British Columbia & Microsoft Research] https://arxiv.org/abs/2606.31145 ---[RO] Freeform Preference Learning for Robotic Manipulation [Stanford University] https://arxiv.org/abs/2606.32027 在小宇宙查看该单集文稿
Embed this episode
Ready to play
[人人能懂AI前沿] 从元认知、内省耦合到多维反馈
No transcript for this episode yet
Similar Episodes
No similar episodes found.