EPISODE · Jun 11, 2026 · 12 MIN
AI Agent 论文播报 06-10:假成功、记忆投毒与集体智能
from 周六9点半
这一期我们围绕同一条主线展开:Agent 研究的重心,正在从'它能不能做对'转向'它做错时怎么被发现、被拦住'。三篇论文,两防一攻,一起看 Agent 如何走向系统级可靠性。本期重点* 从自信收尾到静默失败:刻画 LLM Agent 的假成功(From Confident Closing to Silent Failure: Characterizing False Success in LLM Agents):跨上万条轨迹首次系统刻画'假成功',发现主流 LLM-as-judge 几乎等于瞎猜,而一个 TF-IDF + 逻辑回归的小模型反而能做到 0.83-0.95 的 AUROC,对运行时监控有直接落地价值。* MemVenom:Web Agent 多模态记忆的触发式投毒(MemVenom: Triggered Poisoning of Multimodal Memories i...去小宇宙查看完整单集简介在小宇宙查看该单集文稿
Embed this episode
Ready to play
AI Agent 论文播报 06-10:假成功、记忆投毒与集体智能
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.