EPISODE · May 18, 2026 · 11 MIN
AI Agent 论文播报|记忆投毒、SaaS评测翻车与Skill编译治理(2026-05-18)
from 周六9点半
这期聊三篇让人警醒的论文:Agent 记忆被潜伏投毒注入率高达 99.8%、最强模型在真实 SaaS 工作流上端到端通过率不足 2%、以及把 skill 从"每次重读说明书"编译成运行时接口后 token 直降 57%。Agent 正在从拼 prompt 跑 demo 被推向编译、契约、审计的工程化阶段。本期重点* 记忆潜伏投毒(Hidden in Memory: Sleeper Memory Poisoning in LLM Agents)——首次系统化证明:只要在用户读的文档里藏一段话,就能在 Agent 长期记忆里植入假偏好,几天后仍能劫持工具调用路径。6 个主流模型全部中招,且现有防御在自适应攻击面前脆弱到反弹。做带记忆的 Agent 产品必须把"写入记忆"当成和"调用工具"同级的安全动作。* 真实 SaaS 长程评测(SaaS-Bench)——23 个真实开源 SaaS、1...去小宇宙查看完整单集简介在小宇宙查看该单集文稿
Embed this episode
Ready to play
AI Agent 论文播报|记忆投毒、SaaS评测翻车与Skill编译治理(2026-05-18)
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.