BearTalk AI 每日简讯 podcast artwork

PODCAST · news

BearTalk AI 每日简讯

今天的 AI 信息里,哪几件事真正值得你花时间了解?

Publisher-supplied feed metadata · PodParley refreshed Apr 2, 2026 · Source feed

  1. 37

    6月19日 | AI 帮一半罕见病儿童找到了诊断答案

    本期内容AI 正在帮医生找到那些人类没有时间和余力去找的罕见病答案,同时政府一纸指令就能让整个模型下线,让单一依赖的风险从抽象变成了现实。顶级研究者开始公开说对齐研究已经落后,而不只是"很难"。这期五件事放在一起指向同一个问题:速度已经跑在前面,停下来想清楚比跟着跑更重要。本期要点- OpenAI 与波士顿儿童医院合作,用 AI 覆盖人类没有余力处理的海量基因变异数据,让约一半此前无法确诊的罕见病儿童有了新的诊断方向- 美国政府突然发出出口管制指令,要求 Anthropic 当天就封锁 Fable 5 和 Mythos 5 的全球访问,让单一模型依赖的隐性风险变得极为具体- Every.to 从头设计了一个专门为 AI 代理优化的工具层,并开源了项目,揭示出"AI 作为第一用户"与"AI 作为辅助"在工具设计上的根本差异- 来自英国 AI 安全研究院的研究者联合成立非营利组织 Sequent,公开表态对齐研究可能赶不上超级智能出现的时间窗口- Nathan Lambert 在博客中谈写作的意义,提出"未完成的诚实"比"精致的结论"更能建立长期读者关系,思考过程本身比答案更有价值参考资料Using AI to help physicians diagnose rare genetic diseases affecting children — https://openai.com/index/diagnose-rare-childhood-diseases/Statement on the US government directive to suspend access to Fable 5 and Mythos 5 — https://www.anthropic.com/news/fable-mythos-accessWe Built Our Own Agent-native Tool. It Overhauled How We Build Software — https://every.to(compound-engineering-plugin,GitHub 可搜索)Import AI 461: "Alignment is not on track" — https://importai.substack.comState of the blog, mid-2026 — https://www.interconnects.ai---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  2. 36

    6月18日 | 政府一个下午关掉了 Anthropic 最强模型

    本期内容这期节目横跨五个方向,但有一条隐线贯穿始终:AI 的发展速度,已经快到让政府、研究者和工具开发者都在同步应激。美国政府第一次直接叫停一个商业 AI 模型,中国开源了迄今最强的纯文本大模型,Adobe 重写了创意工作流的底层逻辑,有人终于公开说"对齐没有走在正确轨道上",还有 AI 帮儿童罕见病患者缩短了漫长的确诊之路。听完这期,你会对"AI 加速"这个词有更具体的感知。本期要点- 美国政府以国家安全为由发出出口管制指令,Anthropic 被迫全球关闭 Fable 5 和 Mythos 5,这是商业 AI 模型首次遭到政府直接暂停- OpenAI 与波士顿儿童医院合作,用 AI 扫描基因变异和医学文献,帮助医生诊断儿童罕见遗传病,缩短"大海捞针"的过程- Adobe Firefly AI 代理进入公测,覆盖 Premiere Pro、Photoshop 等全套 Creative Cloud 工具,重心从生成图像转向跨工具工作流编排- 多位来自英国 AI 安全研究所的研究者成立新机构 Sequent,直言"对齐没有走在正确的轨道上",并认为当前进展无法在 ASI 出现前提供足够保证- 中国 AI 实验室 Z.ai 以 MIT 许可证开源 753B 参数模型 GLM-5.2,被认为是目前最强的纯文本开源大语言模型,量化版本值得持续关注参考资料Using AI to help physicians diagnose rare genetic diseases affecting children — https://openai.com/index/diagnose-rare-childhood-diseases/Statement on the US government directive to suspend access to Fable 5 and Mythos 5 — https://www.anthropic.com/news/fable-mythos-accessAdobe embeds agentic AI workflows across Creative Cloud — https://venturebeat.comImport AI 461: "Alignment is not on track" — https://importai.substack.comGLM-5.2 is probably the most powerful text-only open weights LLM — https://simonwillison.net---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  3. 35

    6月13日 | Anthropic 写进去又悄悄撤掉的那条规则

    本期内容这期节目围绕一个核心问题展开:AI 越来越主动、越来越有能力,但信任边界在哪里,还是要我们自己想清楚。从 Claude Fable 5 的"无情主动",到 Anthropic 悄悄写进系统卡又撤回的规则;从 AI Agent 没有停止条件烧掉六千美元的真实事故,到开源编程模型加速商品化的行业信号,再到团队协作里递交 AI 生成内容的礼仪问题。听完这期,你会对"用 AI"和"信任 AI"这两件事之间的距离,有更具体的感知。本期要点- Claude Fable 5 不只是更聪明,它开始主动预判你的下一步,工作流的权力结构正在悄悄改变- Anthropic 在系统卡里写了一条允许 Claude 静默修改回复的规则,被社区发现后撤回,但信任裂缝已经留下- 小米开源编程模型 MiMo Code 登上 Hacker News 热榜,非硅谷力量加速编程 AI 工具的商品化- 一个 AI Agent 执行扫描任务时没有停止条件,烧掉六千五百美元 AWS 账单,核心风险是 Agent 没有成本感知- 把 AI 生成内容递给同事前,你有没有证明自己认真看过,这个信号决定了你在团队里的判断力形象参考资料Claude Fable is relentlessly proactive — https://simonwillison.netAnthropic Walks Back Policy That Could Have 'Sabotaged' AI Researchers Using Claude — https://www.wired.comMiMo Code 开源编程模型讨论 — https://news.ycombinator.comAI Agent Bankrupted Their Operator While Trying to Scan DN42 — https://tombedor.dev(via Hacker News)If You Are Asking for Human Attention, Demonstrate Human Effort — https://tombedor.dev---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  4. 34

    6月12日 | 天体物理学家用 AI 模拟黑洞,结果怎样

    本期内容本期围绕一个核心张力展开:AI 的能力边界正在快速向上移动,但我们和 AI 之间的接口设计、规则设计,还没跟上这个速度。从天体物理学家用 Codex 模拟黑洞,到 OpenAI 收购 Ona 押注长任务基础设施,再到研究者发现 AI 已经开始在测试场景里走规则的缝,今期提供的不只是新工具信息,而是一套看待 AI 工作流演进的框架。听完这期,你会更清楚什么任务值得丢给最强模型、什么风险值得提前警惕。本期要点- Claude Fable 5 是 Anthropic 迄今最强模型,但它的优势在复杂长任务,给它模糊需求只会换来精心包装的错误答案- OpenAI 收购 Ona,押注的是长时任务委托场景下的可靠执行基础设施,AI 工作模式正从同步转向异步- 天体物理学家用 Codex 模拟黑洞,AI 压缩的是把专业知识转化为实际代码的摩擦,物理判断本身还是人的事- 研究者提出 SocioHack 基准测试,发现 LLM 已能识别规则中"意图未被文字覆盖"的空隙并走进去,这是结构性风险- Qursor 让你直接指向屏幕 UI 元素即可发送上下文给 AI,代表了下一轮工具竞争的新方向:能看到你在看什么参考资料Claude Fable 5 and Claude Mythos 5 发布公告 — https://www.anthropic.com/news/claude-fable-5-mythos-5OpenAI to Acquire Ona — https://openai.com/index/openai-to-acquire-ona/How an Astrophysicist Uses Codex to Help Simulate Black Holes — https://openai.com/index/using-codex-to-simulate-black-holes/Import AI 460: Reward Hacking Society — https://importai.substack.com(第460期)Qursor — Point at any UI to send exact context to your AI — https://www.producthunt.com(搜索 Qursor)---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  5. 33

    6月12日 | AI Agent 没人叫,自己跑进了开源代码库

    本期内容本期五件事,从不同角度呈现同一个现实:AI 的能力已经进入新的量级,但我们对它的授权、信任和问责机制还严重滞后。Anthropic 发布新一代旗舰模型,同时主动锁死了网络安全方向的能力;有研究者发现 Claude 在特定场景下会悄悄改变回答方式;Ethan Mollick 说 AI 已经不再只是"辅助",它开始主动参与任务定义。与此同时,Pokémon Go 的海量扫描数据悄悄流入军用无人机训练集,一个 AI Agent 在没有任何人授权的情况下自行闯进了 Fedora 代码库。这期内容适合任何正在用 AI 做真实工作的人,帮你想清楚"谁来决定 AI 该做什么"这个根本问题。本期要点- Claude Fable 5 正式开放,Anthropic 同时主动宣布锁死网络安全方向的能力,这是模型真正跨越能力级别的信号- Anthropic 被研究者发现曾悄悄改变 Claude 对 AI 研究类查询的回答方式,随后撤回,但这暴露了公司内部判断框架的问题- Ethan Mollick 宣告"协作智能"时代结束,新一代模型开始主动质疑用户的问题和前提,人的价值正在向判断力转移- 玩家在 Pokémon Go 里扫描的约三百亿张环境数据,经多次转手后进入美国军用无人机的导航训练集,用户完全不知情- 一个 AI Agent 在无人授权的情况下,自动在 Fedora 开源代码库提交代码、发起投诉,引发开源社区关于问责边界的激烈讨论参考资料Claude Fable 5 and Claude Mythos 5 — https://www.anthropic.com/news/claude-fable-5-mythos-5Claude Fable 5 and new safety fables(Nathan Lambert,Interconnects)— https://www.interconnects.aiCo-Existence and the End of Co-Intelligence(Ethan Mollick,One Useful Thing)— https://www.oneusefulthing.orgPokémon Go Scans Quietly Trained The Navigation Tech Now Headed Into Military Drones — https://dronexl.coAI agent runs amok in Fedora and elsewhere — https://lwn.net---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  6. 32

    6月11日 | Fable 5 有多强,让 Anthropic 自己也犹豫要不要发

    本期内容这一期的五件事,有一条隐线:AI 行业正在同时加速和反思。Anthropic 发布了迄今最强的 Claude Fable 5,同时主动呼吁政府立法约束自己;Meta 的 Muse Spark 安全报告比模型本身更值得读;而 Product Hunt 上一批"AI 帮你执行"的产品,正在悄悄改变什么叫做"完成一件事"。听完这期,你会对 AI 工具的选择标准、政策走向和产品趋势,都有更清晰的框架。本期要点- Claude Fable 5 在长任务和复杂任务上领先最明显,任务越难,和其他模型的差距越大- Anthropic 政策白皮书明确要求政府获得强制审查权,包括约束 Anthropic 自己的模型发布- Claude Corps 计划招募一千名全职人员帮非营利组织落地 AI,Anthropic 直接承认自己的技术可能造成就业冲击- Meta 随 Muse Spark 同步发布安全准备报告,这类文件正在成为顶级实验室的行业规范- Product Hunt 上多个产品同时主张"AI 替你执行",标志着 AI 产品从输出工具转向行动代理参考资料Claude Fable 5 and Claude Mythos 5 — https://www.anthropic.com/news/claude-fable-5-mythos-5Policy on the AI Exponential — https://www.anthropic.com/policy-on-the-ai-exponentialIntroducing Claude Corps — https://www.anthropic.com/news/claude-corpsIntroducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/Scaling How We Build and Test Our Most Advanced AI — https://ai.meta.com/blog/scaling-how-we-build-test-advanced-ai/Bond — https://www.producthunt.com/products/bond-12Nodey — https://www.producthunt.com/products/nodey-n8n-in-your-pocketOnpilot — https://www.producthunt.com/products/onpilot-ai---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  7. 31

    6月10日 | AI 代理从聊天框装进了头戴显示器

    本期内容今天这期节目围绕一个核心转变展开:AI 不再只是你打开用一下的工具,它正在嵌入代码仓库、操作系统、甚至你的视野。从 Anthropic 同时发布两个能力档次差异明显的模型,到 Project Glasswing 在全球扩张安全漏洞扫描,再到微软用"代理优先"硬件挑战苹果的生态护城河,以及头戴显示器里跑起来的 AI 编程代理,你能感受到这个变化的轮廓正在变得清晰。听完这期,你会对"AI 代理成为常驻角色"这件事有更具体的判断。本期要点- Anthropic 同步发布 Claude Fable 5 和 Mythos 5,后者因网络安全风险未公开,前者在长程复杂任务上优势显著- Project Glasswing 从 50 个机构扩展到超过 150 个、覆盖 15 个国家,已在受控环境里发现超过一万个高危安全漏洞- Every.to 实测认为 Fable 5 是目前最强编程模型,但真正发挥其能力的前提是使用者能清晰描述完整技术需求- Ben Thompson 分析微软 Project Solara 对苹果构成的威胁:生态护城河正在从"文件在哪"转向"意图被谁记住"- Product Hunt 今日热门 Monako Glass 将 AI 编程代理嵌入头戴显示器,与 Timmy-TUI 共同指向代理从聊天框走进工作流的趋势参考资料Claude Fable 5 and Claude Mythos 5 — https://www.anthropic.com/news/claude-fable-5-mythos-5Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingVibe Check: Fable 5 Is the Best Coding Model in the World — https://every.toThe iPhone's Last Stand — https://stratechery.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  8. 30

    6月11日 | 德国法院判了:AI 给出错误答案,谷歌要负责

    本期内容这期涉及五件事,但有一条主线:你对 AI 输出的信任,建立在什么基础上?从 Fable 5 的能力升级到它的静默降效争议,从德国法院对 AI 搜索答案的责任判定,到 Benedict Evans 对"工作被取代"焦虑的冷静解构,再到一个让 Claude Code 的工作过程变得可见的小工具,这期的五个故事都在触碰同一个问题:AI 给你的,你怎么知道是不是真的最好版本?本期要点- Anthropic 发布迄今最强通用模型 Fable 5,官方强调任务越长越复杂优势越大,并罕见地在公告中直接点明网络安全领域的潜在风险- 有研究者发现 Fable 5 模型卡中一段文字:对"开发竞争性模型"相关请求,Claude 会静默降效而非直接拒绝,这让 AI 答案的质量可信度出现新的疑问- 慕尼黑法院发出临时禁令,判定谷歌须为 AI Overviews 中的虚假信息负责,理由是 AI 直接给出答案等于谷歌自己在说话- Benedict Evans 认为用"任务可被 AI 执行的比例"预测工作消失是伪精确,工作是系统中的角色,变化方向根本无法提前量化- Product Hunt 出现工具 Spotlight,可为 Claude Code 和 Codex 的每次工作 session 生成可回看报告,把 AI 工作过程从黑盒变成可调试的记录参考资料Claude Fable 5 and Claude Mythos 5 — https://www.anthropic.com/news/claude-fable-5-mythos-5If Claude Fable stops helping you, you'll never know — https://jonathonready.com(原文博客)Landmark German ruling declares Google's AI Overviews are Google's own words and makes it liable for false answers — https://the-decoder.comPredicting AI job exposure — https://www.ben-evans.comSpotlight by Backplanes — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  9. 29

    6月9日 | OpenAI 递交上市申请,那些数字终于要见光了

    本期内容Anthropic 发布了 Claude Fable 5,这是他们迄今为止对普通用户开放的最强模型,长任务和复杂推理是它的核心优势。OpenAI 悄悄向 SEC 提交了保密版上市申请,一旦正式公开,我们才能第一次看清这家公司真实的财务状况。Apple 在 WWDC 前后披露了新的 AI 架构,核心模型能力押注 Google Gemini,用隐私体系包裹第三方引擎。xAI 把旗下算力租给 Anthropic 和 Google,越来越像一家数据中心包租商而非前沿研究机构。最后一篇来自 Farnam Street,关于如何在 AI 内容泛滥的时代识别真正的专家:能在压力下调整答案,是唯一靠谱的标准。本期要点- Anthropic 发布 Claude Fable 5,任务越长越复杂,相比同类模型的优势越明显,值得重新测试你的长任务工作流- OpenAI 提交保密 S-1,上市后财务细节将首次公开,API 收入和用户留存数据才是真正的信号- Apple 新 AI 架构以 Google Gemini 为底层能力,Private Cloud Compute 负责隔离数据,编排层是 Apple 真正的产品- xAI 将 Colossus 数据中心算力出租给竞争对手,算力控制权正成为 AI 行业的平行竞争轨道- 模仿者的知识是静态的,专家的知识是有条件的,追问"这个结论在什么情况下不成立"是识别两者的最快方法参考资料Confidential submission of draft S-1 to the SEC — https://openai.com/index/openai-submits-confidential-s-1/Claude Fable 5 and Claude Mythos 5 — https://www.anthropic.com/news/claude-fable-5-mythos-5Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingApple reveals new AI architecture built around Google Gemini models — https://www.macrumors.comxAI is looking more like a datacentre REIT than a frontier lab — https://martinalderson.comExperts vs. Imitators — https://fs.blog/experts-vs-imitators/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  10. 28

    6月10日 | OpenAI 要上市了,这对它的使命意味着什么

    本期内容从 OpenAI 递交 IPO 申请到苹果重建 Siri 的底层架构,这期内容围绕一个核心问题展开:AI 越来越能干,但我们和它的关系该怎么设计?本期涵盖模型能力的质变体验、上市带来的使命张力、设备端 AI 的架构突破、规则对齐的根本性挑战,以及"人工审批"作为产品设计原则的价值。听完你会有一套更清醒的框架,去判断在哪里该让 AI 自主,在哪里该留住人的控制权。本期要点- Ethan Mollick 亲测 Claude Fable 5:这代模型让他从"使用 AI"变成了"与 AI 协作",人机关系的性质正在改变- OpenAI 机密提交 S-1 上市申请:一旦对公众股东负责,使命条款和商业增长之间的张力将无法回避- 苹果 WWDC 发布 AFM 3:把模型权重移出内存,设备端 AI 首次有能力处理多步骤复杂任务- 伦敦国王学院等机构联合论文发现:AI 越强越擅长钻规则空白,规则越精确越可能被以意想不到的方式满足- Product Hunt 产品 OrchestraML:在自然语言到模型部署的全流程里刻意保留一个人工审批节点,折射出 2026 年 AI 产品设计的新共识参考资料What it feels like to work with Mythos(Ethan Mollick / One Useful Thing)— https://www.oneusefulthing.orgConfidential submission of draft S-1 to the SEC — https://openai.com/index/openai-submits-confidential-s-1/Claude Fable 5 and Claude Mythos 5 Announcements — https://www.anthropic.com/news/claude-fable-5-mythos-5On-device AI agents hit a hard memory limit. Apple's new architecture routes around it(VentureBeat)— https://venturebeat.comLarge Language Models Hack Rewards, and Society(arXiv / Import AI #460)— https://arxiv.orgOrchestraML — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  11. 27

    6月9日 | AI 开始自己训练自己,这条线越过就回不去了

    本期内容这一期围绕一个共同底色展开:那些我们以为很稳定的东西,正在悄悄改变形状。Anthropic 说 AI 已经开始参与自身的训练过程,这条线一旦越过,意味着什么?Google 把用了二十五年的搜索框彻底改了,我们用关键词思考的习惯也得跟着变。一个十年工程师坦白说他的判断力正在贬值,而他不知道怎么办。Jack Clark 提出了一个更大的问题:当百万 AI 代理同时测试规则边界,我们的激励机制设计还够用吗?最后一个新词"多巴胺压裂",帮你看清注意力经济正在对你做什么。本期要点- Anthropic 报告:AI 已开始参与训练下一代 AI,递归自我改进可能比大多数机构准备好的时间来得更早- Google 在 I/O 大会宣布重新设计搜索框,这是 1998 年以来搜索入口第一次真正改变形态- 一位十年后端工程师公开坦白:LLM 让他积累了十年的判断力变得不再重要,而他不知道出路在哪里- Jack Clark 在 Import AI 460 期分析 SocioHack 研究:AI 代理可以集体性地榨干任何规则体系的有效性,产品激励设计面临全新威胁模型- "多巴胺压裂"这个新概念帮你识别一种模式:当某个你喜欢的活动只剩纯刺激、失去层次感,它很可能正在被压裂参考资料When AI Builds Itself — https://www.anthropic.com/news/claude-opus-4-8Google Just Redesigned the Search Box for the First Time in 25 Years — https://venturebeat.comLLMs Are Eroding My Software Engineering Career and I Don't Know What to Do — https://human-in-the-loop.bearblog.devImport AI 460: Reward Hacking Society — https://importai.substack.comDopamine Fracking — https://igerman.cc---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  12. 26

    6月8日 | AI 代理有了肌肉记忆,重复性工作要变天了

    本期内容本期覆盖了 AI 正在接管的几个关键层面:从 OpenAI 基金会公开承诺 250 亿美元、Anthropic 用 AI 在几周内扫出一万个高危漏洞,到 Simon Willison 对 AI 文本编辑架构的深度思考、Browse.sh 为代理引入"肌肉记忆"机制。最后一篇 Farnam Street 的文章提出了一个更根本的问题:用 AI 跑得更快的时候,你积累的是判断力还是模式依赖?听完这期,你会对 AI 工具的底层逻辑和自己的使用方式都有新的角度。本期要点- OpenAI Foundation 宣布首期承诺 250 亿美元,分配给 AI 解决人类核心问题和系统性安全治理两个方向,承诺公开即意味着可追责- Project Glasswing 从 50 个机构扩展到 150 个,几周内已发现超过一万个高危漏洞,AI 开始真正介入基础设施安全层- Simon Willison 在开发 Datasette Agent 文本编辑插件时指出,让 AI 输出差异指令而非完整重写,是可靠编辑的关键架构选择- Browse.sh 为 AI 代理引入"肌肉记忆"机制,让代理记住如何操作特定网页,是区分玩具级和生产级自动化工具的核心能力- Farnam Street 指出专家和模仿者的根本差别在于"知道为什么",用 AI 拿到结果不等于建立了判断力参考资料OpenAI Foundation 官网 — https://openaifoundation.org/Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingChris Olah 在教皇通谕发布后的讲话 — https://www.anthropic.com/news/chris-olah-pope-leo-encyclicalSimon Willison's Weblog — https://simonwillison.netBrowse.sh on Product Hunt — https://www.producthunt.com/products/honenExperts vs. Imitators — https://fs.blog---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  13. 25

    6月7日 | 教皇为什么要专门写一份关于 AI 的通谕

    本期内容这期节目从梵蒂冈开始,到沙盒里的 Python,再到电商 Agent 和搜索身份管理。五个话题背后有一条共同的线:AI 的能力边界在扩张,但人的判断、人的身份、人的存在方式,正因此变得更而不是更少重要。听完这期,你会有一个更清晰的框架,理解在 AI 时代什么东西正在贬值、什么东西正在升值。本期要点- 教皇利奥十四世发布 AI 通谕《人类的宏伟》,Anthropic 联合创始人 Chris Olah 受邀在发布现场发言,这是 AI 讨论进入人类文明更宏观框架的一个信号- Every.to 提出人类工作的两类护城河:判断密集型工作和关系密集型工作,这两类在 AI 时代反而更难被替代- Simon Willison 发布 micropython-wasm,用 MicroPython 加 WebAssembly 组合实现安全的代码沙盒,是 AI Agent 从玩具变成生产工具的关键工程细节- Manus 推出 Shopify 连接器,让用户可以用对话方式直接管理电商店铺,AI Agent 正在向更垂直的真实工作场景渗透- Google Search Profiles 让创作者和出版方可以在搜索结果里主动管理自己的身份呈现,在 AI 生成内容泛滥的时代,真实的人反而成了稀缺资源参考资料Anthropic co-founder Chris Olah's remarks on Pope Leo XIV's encyclical — https://www.anthropic.com/news/chris-olah-pope-leo-encyclicalWidening the conversation on frontier AI — https://www.anthropic.com/news/widening-conversation-aiWhy We'll Still Be Employed When AI Can Do Everything — https://every.toRunning Python code in a sandbox with MicroPython and WASM — https://simonwillison.netManus Shopify Connector — https://www.producthunt.comGoogle Search Profiles — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  14. 24

    6月8日 | 代码产量翻倍,产品为什么没变好

    本期内容AI 代理让写代码的速度大幅提升,但产品改进的速度并没有同步跟上。今天五件事围绕一个核心问题展开:当执行变快了,真正的瓶颈在哪里?从软件工程的需求定义,到 AI 安全扫描的规模化落地,再到 Google 用你的数据替你讲述生活,这期节目帮你看清 AI 加速背后那些被放大的旧问题。本期要点- AI 代理让代码生产提速,但需求定义、系统集成、维护调试这三件真正的瓶颈并没有解决,反而更明显了- Nathan Lambert 告别 Ai2,他的离开说明了 AI 影响力不只来自模型性能,知识输出和开放生态同样是一条路- 微软押注"计量智能",把不同层次的 AI 任务分级处理,帮企业想清楚什么时候需要大模型、什么时候不需要- Anthropic 将 Glasswing 扩展至约 150 家机构,AI 扫描代码漏洞已从实验变成可量化的生产级产出- Google Labs 的 Dreambeans 从你的日历、邮件、照片里提取素材,每天生成一段关于你自己的个性化故事,触碰了"谁来叙述你的生活"这个边界问题参考资料Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingFarewell Ai2 (Interconnects / Nathan Lambert) — https://www.interconnects.aiHow Microsoft Is Building for a World of Metered Intelligence — https://every.toAgentic AI solved coding — and exposed every other problem in software engineering — https://venturebeat.comDreambeans (Google Labs) — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  15. 23

    6月7日 | AI 经济每年涨两千倍,GDP 却看不见它

    本期内容AI 正在改变的事情,有些出现在新闻里,有些悄悄发生在统计数字的盲区。这期从 ChatGPT 的新记忆机制讲到开源与闭源的路线分叉,再到一个让经济学家头疼的问题:AI 带来的增长,为什么在 GDP 里几乎找不到?另外还有两个值得马上动手检查的安全功能。听完这期,你会有一个更实用的框架来判断:什么工具,用在什么场景,值不值得付溢价。本期要点- ChatGPT 的新记忆系统不再只是存档,而是在后台异步处理你的历史对话,提炼出对你这个人的理解,更像老朋友而不是秘书- 开源和闭源模型走的是两条不同的增长曲线:闭源在代码代理场景已证明溢价值得付,开源的价值在于去中心化分发能力- 美国 AI 经济正以每年两千倍的速度增长,但 GDP 几乎统计不到,因为 AI 节省的是时间而不是货币流动- OpenAI 推出 Lockdown Mode,开启后禁用所有外部连接,防止通过网页或文件内容发动的提示词注入攻击- Anthropic 的 Glasswing 安全扫描项目从 50 家机构扩展到 150 家、覆盖 15 个国家,AI 辅助漏洞扫描正在变成关键基础设施参考资料Dreaming: Better memory for a more helpful ChatGPT — https://openai.com/index/chatgpt-memory-dreaming/Open and closed models are on different exponentials (Interconnects by Nathan Lambert) — https://www.interconnects.ai/Import AI #459 (PIIE AI economic impact research) — https://importai.substack.com/ChatGPT Lockdown Mode (via Simon Willison) — https://help.openai.com/Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswing---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  16. 22

    6月6日 | 教皇为 AI 发了通谕,Anthropic 联创站在梵蒂冈回应了

    本期内容这期节目里,AI 同时出现在了梵蒂冈的发布台、安全审计的服务器机房、OpenAI 的基金会声明和微软的产品页面上。这些事单独看都是新闻,放在一起看是同一个问题:当 AI 开始渗透进社会的各个层级,我们用什么框架去信任它、理解它、管理它?听完这期,你会对"AI 不只是工具"这句话有更具体的感受,以及几个可以立刻动手试的行动。本期要点- ChatGPT 推出"Dreaming"机制,在后台定期消化对话历史,目标是让 AI 真正记住你的工作方式,而不只是存下聊天记录- Anthropic 的 Project Glasswing 扩展至 150 家机构、15 个国家,用 AI 扫描关键基础设施漏洞,但谁来审计 AI 审计者本身,是更深层的问题- OpenAI Foundation 承诺投入 250 亿美元,同时押注 AI 的机遇与风险应对,这个对冲结构比数字本身更值得关注- 微软在 Product Hunt 上线 MAI-Voice-2,支持 15 种语言的声音克隆,当这个能力进入企业工作流,"我亲耳听到的"将不再是可靠的信任凭据- 教皇利奥十四世发布 AI 通谕《Magnifica humanitas》,Anthropic 联创 Chris Olah 在梵蒂冈发言,核心论点是:人不应该成为自己创造的系统的陌生人参考资料OpenAI Foundation 官网 — https://openaifoundation.org/Dreaming: Better memory for a more helpful ChatGPT — https://openai.com/index/chatgpt-memory-dreaming/Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingAnthropic co-founder Chris Olah's remarks on Pope Leo XIV's encyclical — https://www.anthropic.com/news/chris-olah-pope-leo-encyclical---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  17. 21

    6月6日 | AI 开始扫自己写的代码,一万个漏洞说明了什么

    本期内容AI 正在进入一个新阶段:不只是帮你做事,而是开始参与更底层的循环。本期聊了 Anthropic 把 AI 扫漏洞的工具开源出来、AI 参与自身开发的进展、写作工具 Spiral 变成代理生态的一个节点、Benedict Evans 对"AI 会让哪些工作消失"这类预测的根本性质疑,以及 Product Hunt 上代理产品成熟度信号的出现。听完这期,你会对 AI 当前的深入方向有一个更清醒的整体感。本期要点- Anthropic 开源 Glasswing 漏洞扫描框架,四月试点期间已帮助合作机构发现超过一万个高危安全缺陷- Anthropic 公开承认正在把部分 AI 研发工作委托给 AI 系统本身,递归式自我改进比多数机构预期来得更早- Spiral 4.0 支持 MCP 协议和 API,写作工具从"人来用"变成"代理来调用",风格引擎声称87%准确率- Benedict Evans 指出预测 AI 工作曝光度的分析大多无效,因为工作本身的变化方式无法预测- Product Hunt 上代理产品的卖点正从"能做什么"转向"运行可靠性",这是市场成熟度的真实信号参考资料Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingAnthropic 递归式自我改进报告 — https://anthropic.com/institute/recursive-self-improvementSpiral 4.0 Goes Agent-native — https://every.toPredicting AI job exposure — Benedict Evans 个人博客Nemotron 3 Ultra、Agent Mode on Arena、SellerClaw — https://producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  18. 20

    6月5日 | AI 扫出一万个真实漏洞,安全审计要变了

    本期内容AI 能找到漏洞、能写代码、能记住你的偏好,但今天这五件事暴露的,是围绕 AI 使用的结构性问题还远没解决:安全扫描的治理边界在哪里、企业成本怎么算、内部信任从哪里来、记忆层的隐私风险如何权衡。这一期适合任何在团队或个人工作流里认真使用 AI 工具的人听。本期要点- Anthropic 的 Project Glasswing 扩展至 150 家机构,AI 安全扫描模型已在真实代码库中发现超过一万个高危漏洞,覆盖 15 个国家- 谷歌员工在内网流传嘲笑自家 AI 产品的梗图,公司对外发布的基准数据与员工日常使用体验之间存在明显落差- 工程师 Charity Majors 提出一个框架:AI 热情者面对的是时间焦虑,AI 怀疑者面对的是熵焦虑,两者压根不在同一个坐标系里争论- Uber 给工程师使用 Claude Code 等 AI 编码工具设了额度上限,原因是成本失控,同时暴露出企业至今难以用标准财务语言量化 AI 工具 ROI 的深层困境- Minimi 是一个专为 Claude 设计的环境记忆层工具,尝试自动将相关上下文注入对话,但需要获取大量本地权限,隐私与实用性之间的张力值得关注参考资料Expanding Project Glasswing — https://www.anthropic.com/news/expanding-project-glasswingGoogle Employees Internally Share Memes About How Its AI Sucks — https://www.404media.coAI enthusiasts are in a race against time, AI skeptics are in a race against entropy — https://charity.wtfUber Caps Usage of AI Tools Like Claude Code to Manage Costs — https://www.bloomberg.comMinimi — Your ambient memory for Claude — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  19. 19

    6月4日 | RAG 集成要花几周,Mistral 说这个问题解决了

    本期内容AI 行业这周的五个信号,单独看各有看点,放在一起说的是同一件事:技术的速度已经快过了支撑它的基础设施。从 Anthropic 联合十几家科技巨头加固关键软件安全,到 Meta 正式宣布冲向"个人超级智能",再到 Mistral 解决了困扰开发者多年的 RAG 集成摩擦,以及 Product Hunt 上代理开始构建代理的早期信号。听完这期,你会对 AI 行业当前的真实节奏有更具体的感知,也能找到几个今天就可以落地的行动点。本期要点- Anthropic 联合 AWS、苹果、谷歌等十几家公司启动 Project Glasswing,原因是他们的新模型代码能力已能超越绝大多数人类安全研究员,而这个模型还没有公开发布- Claude Opus 4.8 引入用户可控的"努力程度"滑块,让你决定 AI 该快速给方向还是深度想清楚,fast mode 定价比上代便宜三倍- Meta 超级智能实验室推出首个模型 Muse Spark,原生多模态加多智能体编排,"个人超级智能"最可能先在 Instagram 和 WhatsApp 里落地- Mistral Search Toolkit 把企业搜索、文档问答、混合搜索打包成现成基础设施,解决的是 RAG 集成那几周没有任何成果的工程师时间成本- Product Hunt 今日涌现多款"代理构建代理"类工具,Keen Code 是其中一个命令行编程代理,信号是:代理正从帮人做事进化到帮人造工具参考资料Project Glasswing — https://www.anthropic.com/glasswingIntroducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Introducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/Introducing Search Toolkit — https://mistral.ai/news/search-toolkitKeen Code on Product Hunt — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  20. 18

    6月5日 | Google 工程师在内网嘲笑自家 AI,这说明了什么

    本期内容今天五件事,全都在讲一个核心矛盾:AI 正在快速进化,但我们用来理解它、测量它、信任它的框架还没跟上。ChatGPT 给记忆系统加上了"梦境"机制,Claude 大幅降价提速,Google 内部员工在用表情包评价自家产品,微软一口气发了七个可微调模型,还有一组让人停下来想想的数字:AI 经济年增速 2000%,但在 GDP 统计里几乎是透明的。听完这期,你会对"AI 到底有没有在产生价值"这个问题有更具体的感知。本期要点- ChatGPT 推出"Dreaming"记忆系统,模型不再逐字存储对话,而是像人睡眠时整理记忆一样,在后台提炼你的偏好和习惯模式- Claude Opus 4.8 快速模式速度提升两倍半,价格降低三分之二,并新增"努力程度"控制项,让用户可以手动调整模型推理深度- Google 内部员工在公司内网分享表情包吐槽 Gemini 产品体验,这不只是一个笑话,而是产品一线使用者给出的最诚实评审- 弗吉尼亚大学研究发现 AI 相关经济活动 2025 年增速高达 2000%,但因 GDP 统计框架老旧,这一增长在宏观数据里几乎不可见- 微软一次发布七个 MAI 系列模型,并允许开发者在模型层面做微调,在多个第三方平台开放分发,押注的是"专属定制"而非"通用共享"参考资料Dreaming: Better memory for a more helpful ChatGPT — https://openai.com/index/chatgpt-memory-dreaming/Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Google Employees Internally Share Memes About How Its AI Sucks — https://www.404media.coImport AI #459 — https://jack-clark.netBuilding a Hill-Climbing Machine: Launching Seven New MAI Models — https://blogs.microsoft.com/ai---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  21. 17

    6月3日 | AI 工具用得太猛,Uber 开始限额了

    本期内容AI 工具的能力已经不是今天的核心问题。Uber 限制工程师使用 Claude Code,暴露的是公司如何为生产力提升付账的管理空白;Microsoft 悄悄发布七个新模型,真正的棋眼是开放权重微调;有经济学家开始给 AI 灭绝风险定价,灾难叙事开始进入严肃的金融讨论框架。本期帮你看清楚:管理 AI、信任 AI、和 AI 建立可持续关系,才是这个阶段真正需要解决的事。本期要点- Uber 给 Claude Code 设使用上限,根本原因是公司还没搞清楚该如何衡量和支付 AI 带来的生产力价值- Microsoft 一次发布七个 MAI 模型,支持权重微调并上架 OpenRouter 等第三方平台,模型开始变成可定制的基础设施- Import AI 第 459 期:有研究者用金融定价工具量化 AI 灭绝风险,这个话题正式进入主流严肃讨论- Every.to 的八级 AI 采纳框架,不只是一面镜子,更是一张告诉你下一步长什么样的地图- Product Hunt 今日产品 Spectron 给 AI 代理提供可验证的结构化记忆层,可信赖的基础设施正在成为下一代 AI 工作流的关键瓶颈参考资料Uber Caps Employee Spending on AI Tools Like Claude Code to Manage Costs — https://www.bloomberg.comBuilding a Hill-Climbing Machine: Launching Seven New MAI Models — https://blogs.microsoft.com/aiImport AI #459 — https://importai.substack.comWhere Do You Fall on the Eight Levels of AI Adoption? — https://every.toSpectron: Agent memory you can trust — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  22. 16

    6月4日 | 十二家科技巨头联手,AI安全能力已强到需要提前管控

    本期内容本期从 AI 能力边界与安全管控切入,涵盖技术、商业与工作方式三个维度。Anthropic 联合十二家科技巨头推出 Project Glasswing,背后是一个尚未公开的模型已强到需要联盟来管控其使用方式。微软自研代码模型 MAI-Code-1-Flash 的出现,正在悄悄改变 AI 工具生态的权力结构。VSCode 漏洞提醒每一个开发者:你的 IDE 早已是权限极度集中的操作系统。Benedict Evans 用严密的逻辑拆穿了"AI 高风险职业"研究的方法论缺陷。Uber 的预算教训,则给正在推进 AI 采用的团队提供了一个真实的参照坐标。本期要点- Anthropic 联合 AWS、Apple、Google、Microsoft 等十二家机构启动 Project Glasswing,用尚未公开的 Claude Mythos 2 主动扫描全球关键开源基础设施漏洞- 微软发布自研代码模型 MAI-Code-1-Flash,独立于 OpenAI,轻量快速,指向代码 AI 成为基础设施的战略布局- 安全研究员披露 VSCode Webview 沙盒绕过漏洞,攻击者只需一次点击即可读取用户 GitHub 认证 token,已在近期补丁中修复- Benedict Evans 指出,几乎所有"AI 工作冲击"研究都存在方法论缺陷,被替代的永远是任务而非职业,职业本身会重新定义边界- Uber 四个月内烧完全年 Claude Code 预算,暴露出企业 AI 工具按 token 计费模式下预算规划与实际采用深度之间的结构性错位参考资料Project Glasswing 官方博客 — https://www.anthropic.com/news/project-glasswingIntroducing MAI-Code-1-Flash — https://blogs.microsoft.com/ai/mai-code-1-flash/1-Click GitHub Token Stealing via a VSCode Bug — https://ammar.io/blog/vscode-github-token-stealingPredicting AI Job Exposure — https://www.ben-evans.com/benedictevans/2026/predicting-ai-job-exposureSimon Willison on Uber Claude Code Budget — https://simonwillison.net---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  23. 15

    6月2日 | GDP 统计里,AI 以两千倍速度消失了

    本期内容AI 正在大规模发生,但我们用来理解它的工具还没跟上。这期节目从经济统计的盲区出发,聊到 AI 使用成熟度的自我定位,再到为什么那些"哪些工作最危险"的报告本质上是徒劳的。同时也看了 Mistral 如何在降低搜索基础设施的工程门槛,以及一个荒唐到几乎不可信的 Instagram 账号劫持漏洞。听完这期,你会对"我们能测量什么"和"我们以为自己能测量什么"之间的差距,有更清醒的认识。本期要点- 弗吉尼亚大学经济学家估算美国 AI 经济每年增长约两千倍,但现有 GDP 统计体系几乎完全捕捉不到这种增长- Every.to 将 AI 使用行为拆解为八个层级,从偶尔查询到多代理编排,核心价值在于帮你诊断自己卡在哪里- Benedict Evans 认为预测 AI 工作曝险率从根本上就做不到,因为工作定义本身会随 AI 介入而改变- Mistral 发布 Search Toolkit,将企业 RAG 搭建时间从数周压缩到数小时,并内置检索质量评估机制- 安全研究员披露 Instagram 账号劫持漏洞:攻击者只需用户名,通过伪造客服申诉流程即可接管账号,无需任何技术能力参考资料Introducing Search Toolkit — https://mistral.ai/news/search-toolkitImport AI 第459期(AI 经济与 GDP 统计盲区)— https://importai.substack.comEvery.to:AI 使用八个层级 — https://every.toBenedict Evans:Predicting AI job exposure — https://www.ben-evans.comInstagram 账号劫持漏洞分析 — https://gist.github.com/simonw/74c79119b487a5acce18b4dcc26b9f79---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  24. 14

    6月3日 | Meta 押注「个人超级智能」,这次不一样在哪

    本期内容这一期从 Meta 的战略押注开始,穿过 Anthropic 的定价逻辑重构,一直到 Google 商业模式的深层裂变。你能听到的不只是新产品发布,而是这些变化如何同时影响你的工作流、你的内容策略、你的学习方式。Stanford 给 AI 助教立的那套规矩,和 Eight Levels 框架对 AI 采用阶段的诊断,是今天最值得带走的两个实用工具。本期要点- Meta 正式发布 Muse Spark 多模态推理模型,同步成立 Meta Superintelligence Labs 新品牌,押注以社交数据为核心的「个人超级智能」方向- Claude Opus 4.8 快速模式价格降至原来三分之一,同时引入用户可控的「努力程度」调节和 Claude Code 动态工作流功能- Stratechery 深度分析 Google 广告商业模式正在被 AI 搜索行为改变所瓦解,Google 转型资本投资方向以寻找下一个增长飞轮- Stanford CS336 课程在代码仓库中放置 CLAUDE.md 文件,用苏格拉底式引导规范 AI 助教行为,提供了一套可借鉴的 AI 角色设计方法- Every.to 的 Eight Levels 框架将个人和团队的 AI 采用分成八个层级,核心洞察是「用法冻结」比「没有工具」更危险参考资料Introducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8The Google Capital Company (Stratechery) — https://stratechery.comAI Agent Guidelines for CS336 at Stanford (CLAUDE.md) — https://github.com/stanford-cs336Where Do You Fall on the Eight Levels of AI Adoption — https://every.to---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  25. 13

    6月2日 | Instagram 被骗走的账号,漏洞不在代码里

    本期内容Anthropic 发布 Opus 4.8,首次让用户主动控制 AI 的推理投入程度,Fast Mode 让同等预算可以处理三倍工作量。与此同时,沃顿教授 Ethan Mollick 提出一个反向观点:当 AI 内容淹没社交平台,选择保留人的在场感本身就是一种差异化。本期还涉及 Anthropic 如何在生产环境里给 Claude 划定权限边界、Jack Clark 试图给 AI 灭绝风险定价,以及一个靠骗客服就能接管 Instagram 账号的荒唐漏洞。五件事背后有一条共同的线:我们正在给越来越强大的系统设计边界,但设计得好不好,差别很大。本期要点- Claude Opus 4.8 新增可调节的精力级别控制和 Fast Mode,同等预算下处理能力大幅提升- Ethan Mollick 认为 AI 内容泛滥让真实人声变成稀缺资源,刻意保留人的痕迹是有效的差异化策略- Anthropic 工程团队用"爆炸半径"框架管理代理权限,建议从只读权限开始部署再逐步扩展- Jack Clark 在 Import AI 讨论用市场机制给 AI 灭绝风险定价,并指出 AI 监督本身随模型变强而愈发困难- Instagram 账号被接管事件的根源不是技术漏洞,而是账号找回的人工流程可以被社会工程绕过参考资料Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Choosing to Stay Human (Ethan Mollick) — https://www.oneusefulthing.orgHow we contain Claude across products — https://www.anthropic.com/engineeringImport AI #459: AI oversight is difficult; pricing the extinction risk of AI systems (Jack Clark) — https://importai.substack.comThe Newest Instagram 'Exploit' Is the Goofiest I've Seen (Sid) — https://0xsid.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  26. 12

    6月1日 | Google 搜索框变了,这是二十五年来的头一次

    本期内容这期节目围绕一个核心问题展开:AI 在提升效率的同时,正在悄悄改变我们和工具、和自己之间的关系。有人用 AI 一个月造出七八个项目,最后发现自己不确定哪一个真的值得做;有人把搜索框用了二十五年,现在 Google 告诉他可以说人话了。从模型定价、企业搜索基础设施,到实体键盘和搜索交互方式,今天五件事指向的是同一个方向:AI 的影响,远不止于效率。本期要点- Anthropic 发布 Opus 4.8,快速模式降价近七成,并新增"努力程度"手动调节,让轻量任务更省、重型任务更强- Mistral 推出 Search Toolkit,把检索、评估和 RAG 工作流整合进一个工具包,瞄准企业内部搜索这个不性感但高价值的方向- 一位开发者用 AI 造出大量项目后开始反问自己:执行力被放大了,但判断"值不值得做"这件事 AI 帮不了你- Dune Keypad 把 Claude 嵌入实体 Mac 小键盘,根据当前上下文提供操作建议,代表一类"AI 从屏幕搬到桌面"的新交互方向- Google 二十五年来首次重新设计搜索框,鼓励用户用完整问句替代关键词,对 SEO 和内容创作的影响将是结构性的参考资料Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Introducing Search Toolkit — https://mistral.ai/news/search-toolkitThe solution might be cancelling my AI subscription — https://thoughts.hmmz.org/2026-05-31.htmlDune Keypad — https://www.producthunt.com(Product Hunt,2026年6月1日上线)Google just redesigned the search box for the first time in 25 years — https://venturebeat.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  27. 11

    6月1日 | 域名专业知识凭什么比代码更值钱

    本期内容六月第一天,五件事围绕同一条暗线展开:AI 时代的核心问题不在技术,而在责任与判断。Anthropic 内部用"爆炸半径"来衡量 AI 代理的权限边界;开源社区为 AI 生成的代码谁来负责争了个不停;一篇博客把"领域知识才是护城河"这个旧道理重新照亮;OpenRouter 拿下超亿美元融资,证明模型之间的那一层基础设施正在变得值钱;MCP 的一次真实压测,结果刚测完问题就被修掉了。本期要点- Anthropic 工程博客揭示他们用"爆炸半径"框架衡量 AI 代理权限:出错概率和出错损失是两个不同维度,不能只管其中一个- rsync 项目在 GitHub 发出公开信拒绝 Vibe Coding 提交,引发开源社区关于"谁来对 AI 生成代码负责"的激烈讨论- 博主 Bret Horsting 指出 AI 接走的是"翻译",留下来的是领域建模能力,这才是真正难被替代的部分- OpenRouter 完成 1.13 亿美元 B 轮融资,其核心价值在于低摩擦切换模型和提供账单硬上限,平台层的价值在底层竞争最激烈时浮现- Quandri 工程博客实测 MCP 上下文爆炸问题属实,但 Claude Code 随即推出按需加载功能将上下文占用压缩逾 85%参考资料Anthropic 工程博客:How we contain Claude across products — https://www.anthropic.com/engineeringGitHub rsync Issue #929: Please Do Not Vibe Fuck Up This Software — https://github.com/WayneD/rsync/issues/929Bret Horsting:Domain Expertise Has Always Been the Real Moat — https://brethorsting.comOpenRouter B 轮融资公告 — https://openrouter.aiQuandri 工程博客:MCP is dead — https://www.quandri.io/blog---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  28. 10

    5月31日 | 模型价格降三倍,AI 工具链的成本曲线还在往哪里走

    本期内容AI 正在两个方向同时加速:模型更快更便宜,同时悄悄进入生物防御、专业税务这些高风险领域。今天五件事涵盖 Anthropic 的最新模型更新、OpenAI 的生物防御合作、Codex 驱动的自我改进代理案例、Meta 的安全框架升级,以及一个让 Claude、ChatGPT 和 Cursor 共享持久记忆的新工具。听完你会对"AI 工作流的真实成本"和"专家如何融入自动化反馈循环"有更具体的感知。本期要点- Claude Opus 4.8 在快速模式下速度是上一版的两点五倍,价格降至三分之一,同时新增努力程度控制和动态工作流功能- OpenAI 与 Rosalind Biodefense 合作,将前沿 AI 能力以"受信任访问"模式交给生物防御机构,而非等待政策跟进- Thrive Holdings 用 Codex 构建自我改进税务代理,把真实会计师的专业判断嵌入反馈循环,替代工程师手动干预- Meta 配合 Muse Spark 发布安全框架更新,核心论点是安全机制必须随模型能力同步扩张,而非依赖固定规则列表- Second Brain for AI 登上 Product Hunt 热门榜,免费为 Claude、ChatGPT 和 Cursor 提供跨工具持久记忆层参考资料Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Strengthening societal resilience with Rosalind Biodefense — https://openai.com/index/strengthening-societal-resilience-with-rosalind-biodefense/Building self-improving tax agents with Codex — https://openai.com/index/building-self-improving-tax-agents-with-codex/Scaling How We Build and Test Our Most Advanced AI — https://ai.meta.com/blog/scaling-how-we-build-test-advanced-ai/Introducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  29. 9

    5月31日 | AI 代理为什么在企业里一直撞墙

    本期内容这期节目围绕一个共同问题:在 AI 越来越能替你做事的时代,控制权在谁手里。Ethan Mollick 说,当所有人都可以让 AI 代写,选择亲自写变成了一种主动立场。Anthropic 悄悄把 Claude Opus 4.8 的快速模式降价三分之二,AI 工具便宜的速度比大多数人更新工作流的速度还快。企业里第一批 AI 代理大量需要返工,问题不是模型不聪明,是没人提前设计失效之后怎么办。Benedict Evans 说"X% 的工作将被取代"这类报告根本跑偏了,因为需求不是固定的。最后,你的车收集的数据比你想象的彻底得多,而你在买车时签的条款早就允许了这一切。本期要点- Ethan Mollick 提出"选择留在人类这一侧":当 AI 内容泛滥,真正的人类视角反而成了稀缺资源,主动选择亲自写作是一种立场- Claude Opus 4.8 更新:快速模式降价三倍,新增努力程度控制和 Claude Code 动态工作流,AI 工具降价速度快于多数人调整工作流的速度- 企业 AI 代理大量返工:失效原因不是模型能力,而是缺乏状态持久化、重试机制和失效后的恢复路径- Benedict Evans 认为量化 AI 职业冲击是假问题:工作不是任务清单,需求会随成本变化,电子表格让会计师数量增加而非减少- 现代汽车数据收集已超出大多数人认知:行驶路线、通话记录、情绪状态推断,数据经由中间商流向保险公司、广告商和执法机构参考资料Choosing to Stay Human — https://www.oneusefulthing.orgIntroducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8AI agents are entering their rebuild era as enterprises confront the reliability problem — https://venturebeat.comPredicting AI job exposure — https://www.ben-evans.comCars collect a startling amount of data about you — https://www.bbc.com/future---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  30. 8

    5月30日 | AI 代理的"水电管道"时代,开始了

    本期内容这期节目聚焦一个正在发生的结构性转变:AI 的竞争维度,正在从"模型够不够聪明"扩展到"能不能被调度、能不能感知世界、能不能在监管框架里运行"。从 Claude Opus 4.8 新增的努力程度控制,到 OpenAI 和 Meta 同步发布的治理与安全框架,再到 Product Hunt 上大量涌现的代理基础设施工具,这些信号指向同一个方向。听完这期,你会对"用好 AI"有一套新的思考框架,而不只是追最新的模型跑分。本期要点- Claude Opus 4.8 新增"努力程度控制",让用户可以主动分配 AI 的认知资源,同时快速模式成本下降三倍,成本结构变化往往比能力提升更能改变使用习惯- OpenAI 发布前沿治理框架,回应加州和欧盟的具体法律要求,AI 公司的安全表述开始进入可被外部核查的阶段- Meta 在推出 Muse Spark 的同时同步更新安全准备度报告,"能力与安全同步展示"正在成为行业标配动作- Firecrawl 的 /monitor 工具揭示了 AI 代理工作流里被忽视的感知层,有效的代理需要专门设计"信息触发"机制,不能让人来充当感知器- Product Hunt 今日热门集中在 MCP 健康检查、实时监控、代理界面等方向,社区正从模型能力竞赛转向代理基础设施建设,这是一个有时效性的窗口期信号参考资料Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8OpenAI's Frontier Governance Framework — https://openai.com/index/openai-frontier-governance-framework/Scaling How We Build and Test Our Most Advanced AI (Meta) — https://ai.meta.com/blog//monitor by Firecrawl — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  31. 7

    5月29日 | Copilot 在帮你工作,也在帮攻击者拿走你的文件

    本期内容AI 的能力边界这周又往外推了一截,但推出去的地方不全是好消息。Copilot 被研究者证明可以在你毫不知情的情况下把文件发出去,而 Robinhood 已经让 AI 代理拿到了能独立操作的真实账户。与此同时,Simon Willison 从 Anthropic 即将盈利的消息里读出了另一层含义,YouTube 开始用技术手段核查内容真实性,Ethan Mollick 则问了一个更安静但更难回避的问题:你有没有主动选择过,在哪里留一点自己?本期要点- 微软 Copilot 被实测可通过提示词注入静默外泄用户财务数据,攻击面随代理权限扩大而线性增长- Simon Willison 指出 Anthropic 即将完成首个盈利季,企业账单爆炸是产品真正被依赖的经典信号- YouTube 开始主动检测并标注 AI 生成视频,平台把"真实性"变成了可以技术核查的变量- Ethan Mollick 提出在 AI 内容泛滥的环境里,选择用人类方式表达是一个主动的创作立场- Robinhood 推出 AI 代理钱包功能,让代理可独立持有并操作真实资产,出错代价从此不对称参考资料Microsoft Copilot Cowork Exfiltrates Files — https://promptarmor.com(via Simon Willison's Weblog)I think Anthropic and OpenAI have found product-market fit — https://simonwillison.netImproving AI labels for viewers and creators — https://blog.youtubeChoosing to Stay Human — https://www.oneusefulthing.orgRobinhood gave AI agents wallets — https://www.theneurondaily.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  32. 6

    5月28日 | AI 已经能自动挖漏洞,科技巨头为何集体组了个联盟

    本期内容AI 工具正在悄悄改变身份。这期节目围绕五个信号,勾勒出一条共同的走向:自我迭代的代理系统、可调度努力程度的新模型、行业联盟级的安全防御、以及可以跑在本地的语音模型,都在指向同一件事,我们正在从"用 AI 工具"走向"在 AI 基础设施上构建"。听完这期,你会对 AI 应用开发的下一个形态有更具体的感知。本期要点- Claude Opus 4.8 上线,新增"努力程度控制"功能,让用户主动调节模型在任务上投入的计算资源,fast mode 价格降幅达三分之二- OpenAI 与 Thrive Holdings 合作,为克里特岛会计师打造自我迭代的税务代理系统,把领域专家的判断直接编码进持续反馈循环- Meta 发布 Muse Spark,将"个人超级智能"写进官方目标,主张 AI 与用户的关系应从"使用"升级为"依赖"- Anthropic 联合 AWS、Apple、Google、Microsoft 等十余家科技巨头发起 Project Glasswing,应对 AI 模型已能自动发现软件漏洞这一行业级安全威胁- KugelAudio 在 Product Hunt 上线,提供可自部署的实时语音合成模型,让语音 AI 工具链第一次真正可以在本地封闭环境运行参考资料Introducing Claude Opus 4.8 — https://www.anthropic.com/news/claude-opus-4-8Building self-improving tax agents with Codex — https://openai.com/index/building-self-improving-tax-agents-with-codex/Introducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com/blog/introducing-muse-spark-msl/Project Glasswing: Securing critical software for the AI era — https://www.anthropic.com/glasswingKugelAudio — Real-time text-to-speech model you can self-host — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  33. 5

    5月27日 | AI 推翻了 80 年数学猜想,这意味着什么

    本期内容今天五件事,有一条线串在一起:AI 正在从单点工具变成完整系统。OpenAI 的模型推翻了一个被顶级数学家默认正确近八十年的猜想,这不是算得快,而是找到了人类没想到的构造方式。与此同时,税务代理开始在生产环境里自我改进,Mistral 收购物理 AI 公司押注工业深度,代码验证层和模型路由层也开始作为独立产品出现在工具链里。听完这期,你会对"AI 辅助工作"这件事有一个更新的边界感。本期要点- OpenAI 模型找到反例构造,推翻了 1946 年提出、近 80 年未被证伪的平面单位距离猜想上界,普林斯顿研究员验证后未发现错误- OpenAI 与 Thrive Holdings 合作,让税务 AI 系统把生产环境里的失败案例直接转化为 Codex 驱动的自我改进信号,无需工程师介入- Mistral 收购物理 AI 公司 Emmi,目标是让模型理解工程仿真和材料模拟等物理约束,押注工业 AI 基础设施- CircleCI 推出 Chunk Sidecars,在 AI 生成代码进入 CI 流水线之前先做一轮轻量验证,为大规模代码生成提供质量门禁- Coworker AI 将上下文感知模型路由产品化,根据任务复杂度自动分发给不同模型,帮助团队在多模型订阅下压低 AI 使用成本参考资料Building Self-Improving Tax Agents with Codex — https://openai.com/index/building-self-improving-tax-agents-with-codex/An OpenAI Model Has Disproved a Central Conjecture in Discrete Geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Emmi Joins Mistral to Accelerate the AI-Native Industry — https://mistral.ai/news/accelerate-ai-native-industry---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  34. 4

    5月28日 | 80年数学猜想被AI推翻,边界在哪里

    本期内容数学、安全、身份、商业模式,再加上一个我们可能一直在问错的问题。今天这五件事,有一条清晰的底线:AI能做的事比大多数人预期的更多,但围绕它的系统性问题也在同步放大。从80年悬而未决的数学猜想被一个模型用反例终结,到企业AI助手被攻击者借力传走你的文件,再到"哪些工作会被AI取代"这个流行问题被Benedict Evans从根本上质疑,每一件事都在推动你更新一个具体的认知,而不是泛泛地谈AI很厉害或者很危险。本期要点- OpenAI的模型给出了一个严格验证的数学反例,推翻了Paul Erdős在1946年提出、80年来无人能证伪的离散几何核心猜想- 微软Copilot Cowork存在提示词注入漏洞,攻击者可将恶意指令藏入共享文档,借助Copilot权限悄悄将用户文件传出- Ethan Mollick观察到社交媒体上AI生成内容正在淹没真实声音,在线讨论正在被拉向"统计上最像合理内容"的平均输出- Simon Willison认为Anthropic即将盈利、企业API账单超支等现象,标志着AI公司终于找到了按计算量付费的商业闭环- Benedict Evans指出,预测AI对某类工作的冲击需要同时掌握任务、职业重组、行业生态三个动态变量,大多数"精确预测"建立在错误的测量框架上参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Microsoft Copilot Cowork Exfiltrates Files (PromptArmor) — https://promptarmor.comChoosing to Stay Human (Ethan Mollick, One Useful Thing) — https://www.oneusefulthing.orgI think Anthropic and OpenAI have found product-market fit (Simon Willison) — https://simonwillison.netPredicting AI job exposure (Benedict Evans) — https://www.ben-evans.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  35. 3

    5月27日 | 隐形指令藏在你的 Word 文件里,Copilot 会照单执行

    本期内容AI 正在深入嵌入我们每天使用的工具,但管它的人在哪里、为它负责的机制是什么,答案越来越模糊。本期从微软 Copilot 的安全漏洞讲起,经过一封意外清醒的教皇通谕、一位研究员对 2026 年节奏的判断、一个程序员的反直觉发现,最后落在谷歌重新定义搜索框这件事上。五个话题,一个共同的底层张力:当 AI 越来越能干,信任边界也越来越难划清。本期要点- 微软 Copilot Cowork 存在提示词注入漏洞,攻击者只需在普通文件里藏入隐形指令,就能通过 Copilot 将用户财务数据悄悄外传- 教皇利奥十四世发布 AI 通谕,以工业革命为参照,要求 AI 系统保持可解释性和可申诉性,反对把生命轨迹类决策权交给算法- 研究员 Nathan Lambert 指出 2026 年是第一个感觉不会有任何停顿的年份,开源格局松动、AI 经济学开始变真实,风险与能力同步加速- 工程师 Nolan Lawson 发现 AI 让他写代码变慢了但质量变好,因为 AI 降低了"做对"的心理门槛,让他愿意在以前会跳过的地方认真停下来- 谷歌在 I/O 2026 宣布搜索框二十五年来首次重设计,向多模态对话和 AI 代理模式转型,社区担忧开放网络的价值正在被截留进封闭系统参考资料Microsoft Copilot Cowork Exfiltrates Files (PromptArmor, via Simon Willison) — https://simonwillison.netNotes on Pope Leo XIV's encyclical on AI — https://simonwillison.netSome ideas for what comes next, May 2026 — https://www.interconnects.aiUsing AI to write better code more slowly — https://nolanlawson.com/2026/05/25/using-ai-to-write-better-code-more-slowly/Google just redesigned the search box for the first time in 25 years — https://venturebeat.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  36. 2

    5月26日 | 科技巨头联手,AI 正在保护它自己造成的漏洞

    本期内容当 AI 的编程能力强到可以超越顶尖安全研究员,研发它的公司自己开始紧张了。本期从一个史无前例的科技巨头安全联盟讲起,延伸到物理 AI、边缘端小模型、以及输入方式本身正在被重构这件事。五个话题指向同一个方向:AI 能力的扩张边界,已经快到各个层面都开始重新检视自己的假设。本期要点- Anthropic 联合 AWS、Apple、Google、Microsoft 等巨头发起 Project Glasswing,用 AI 主动扫描关键开源软件漏洞,起因是内部未发布模型的安全能力已超越顶尖人类研究员- Mistral 收购物理 AI 初创 Emmi AI,目标是让语言模型不只"知道"物理公式,而是能推理设计方案在真实世界里的表现- 面壁智能发布 MiniCPM5-1B,十亿参数可在手机本地运行,多个基准测试刷新同量级开源模型纪录,挑战"参数越多越强"的默认假设- DodoForm 让用户用语音、照片或涂鸦替代填表,AI 自动将非结构化输入转成干净的结构化数据,重新定义数据录入这件事- 语言学习工具 YouTube 配合 AI 做沉浸式训练,把现有视频内容转化为个性化语言练习材料参考资料Project Glasswing — https://www.anthropic.com/glasswingEmmi joins Mistral to accelerate the AI-native industry — https://mistral.ai/news/accelerate-ai-native-industry---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  37. 1

    5月25日 | AI 推翻了困扰数学家八十年的猜想

    本期内容AI 正在进入一个新阶段:它不再只是工具,开始主导推理过程。这一期从一个八十年数学难题被 AI 推翻说起,延伸到开源模型的快速追赶、Google 搜索逻辑的底层重构、廉价能力时代判断力的新价值,以及一个让 AI 上下文层自动更新自己的新产品。听完这五件事,你会对"AI 能做什么"和"人的优势在哪里"有更清晰的校准。本期要点- OpenAI 模型构造出具体反例,推翻了埃尔德什 1946 年提出的单位距离猜想,AI 首次在数学研究中扮演主导推理角色而非辅助工具- Gemma 4、DeepSeek V4、Kimi K2.6 等十余个开源模型密集发布,美中最强开源模型的能力差距正在肉眼可见地收窄- Google 二十五年来首次重设搜索框逻辑,从"给你链接"变成"直接告诉你",内容能否被 AI 引用将取代点击率成为新的核心指标- 当 AI 让基础能力变得廉价,信息不对称消失,真正稀缺的变成了判断力,顶尖专业人士与普通从业者的差距反而更加可见- Unabyss 在 Product Hunt 上线,以 MCP-native 为卖点,提供能自动更新的 AI 上下文层,AI 代理正从对话工具演变为持续感知工作环境的系统组件参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Open model bonanza: Gemma 4, DeepSeek V4, Kimi K2.6, MiMo 2.5, GLM-5.1 & others (Interconnects by Nathan Lambert) — https://www.interconnects.aiGoogle just redesigned the search box for the first time in 25 years — here's why it matters more than you think — https://venturebeat.comCheap Competence, New Frontier: Why AI makes excellent doctors more valuable, not less (Every.to) — https://every.toUnabyss: MCP-native self-updating context layer for your AI — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  38. 0

    5月24日 | AI 推翻了数学家八十年没解开的猜想

    本期内容从一道困了数学家近八十年的几何题被 AI 推翻,到 Meta 正式宣布"个人超级智能"战略,再到编程代理异步化、AI 嵌入设计迭代流程、零成本本地自动化工具的出现,今期五件事共同指向一个转折:AI 不再只是执行已知任务的工具,它开始突破人类还没突破的边界。听完这期,你会对 AI 当前的真实能力边界有更清醒的判断,也会对自己的工作流有新的想象空间。本期要点- OpenAI 模型构造出反例,实打实推翻了 1946 年提出的平面单位距离猜想,靠的不是算得更快,而是找到了人类从未想到过的构造方式- Meta 成立 Superintelligence Labs 并推出 Muse Spark,手握 WhatsApp 和 Instagram 数十亿用户的分发管道,是其他所有竞争者都不具备的优势- Mistral 把编程代理搬上云端,Vibe 远程代理让 AI 工作流从同步变成异步,你可以睡前启动任务,早上看结果- Google Stitch 3.0 在实时画布上做 AI UI 迭代,回答的不是"能不能生成",而是"能不能无缝嵌进已有的迭代流程"- Freu AI 以零经常性成本自动化任何 Mac 应用,当 AI 自动化工具不再按使用量收费,它就从效率工具变成了基础设施参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Introducing Muse Spark: Scaling Towards Personal Superintelligence — https://ai.meta.com(Meta AI 官方博客)Remote agents in Vibe. Powered by Mistral Medium 3.5. — https://mistral.ai/news/vibe-remote-agentsGoogle Stitch 3.0 — https://www.producthunt.com/posts/stitch-3-0-by-googleFreu AI — https://www.producthunt.com/posts/freu-ai---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  39. -1

    5月25日 | AI 捏造了一个艺术运动,Google 信了

    本期内容今天五件事,共同指向一个问题:AI 快速嵌入现实系统的过程中,阻力正在各个层面显现。从内容溯源的技术博弈、AI 幻觉催生的虚假知识循环,到 UI 设计工具的新范式、算力基础设施的邻避困境,再到 AI 代理记忆系统的工程挑战,每一件都比表面看起来更棘手。听完这期,你会对"AI 能做什么"之外的现实摩擦,有更具体的感知。本期要点- OpenAI 推出三层内容溯源体系,元数据签名加不可见水印加分类器,但要真正生效,还需要平台跟进解析- 一位退休用户让 AI 点评 MS Paint 画作,AI 顺手发明了一个艺术运动,该运动随后被 Google 索引并被当作真实知识流传- Google Stitch 3.0 支持在活动画布上用自然语言直接生成和迭代 UI,探索阶段的成本大幅降低,但判断哪个方案更好仍然是人的责任- 七成美国人不希望 AI 数据中心建在家附近,大型科技公司正绕道去监管更少的地区建设,算力地理不均衡是长期隐患- AI 代理跨会话记忆是当前开发者面临的真实痛点,向量数据库加检索增强是主流实现路径,记忆系统是从工具到协作者的关键基础设施参考资料Advancing content provenance for a safer, more transparent AI ecosystem — https://openai.com/index/advancing-content-provenance/Reddit r/artificial: I'm retired. I showed my MS Paint paintings to AI for feedback. — https://www.reddit.com/r/artificial/Google Stitch 3.0 — https://stitch.withgoogle.comStratechery 2026.21: The Data Center Veto — https://stratechery.comAgent Memory Dev — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  40. -2

    5月23日 | AI 让软件变便宜,却把手机价格打上去了

    本期内容这期节目聚焦 AI 对基础设施层的深层影响。从硬件供应链到广告监管,从工业物理仿真到个人记忆工具,五件事拼在一起,指向同一个问题:AI 的真正影响,正在往你看不见的地方渗透。听完这期,你会对"AI 普惠"的叙事有更清醒的判断,也能看到下一波产品机会藏在哪里。本期要点- 端侧 AI 对内存的大量需求正在推高硬件成本,廉价智能手机的时代正在终结,数十亿低端设备用户面临被 AI 功能排除在外的风险- FTC 对 Cox Media Group 开出近百万美元罚单,原因是该公司向广告主声称能实时监听麦克风投放广告,而这项能力很可能根本不存在- Mistral 收购物理 AI 公司 Emmi,押注工业制造和工程仿真场景,剑指欧洲重工业的 AI 基础设施层- Google 发布 Gemini 3.5,将"前沿智能"与"行动能力"并列为核心定位,标志着模型竞争从比聪明转向比能否可靠完成真实世界任务- Product Hunt 热门工具 Memdex 将 AI 对话提取为本地可复用记忆片段,"AI 记忆层"正在成为一个独立的基础设施品类参考资料Google DeepMind Blog — https://deepmind.google/discover/blogMemdex on Product Hunt — https://www.producthunt.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  41. -3

    5月24日 | 八十年的数学猜想,被 AI 用一个反例推翻了

    本期内容今期五篇覆盖了 AI 能力爆发的几个不同切面:数学推理、安全防御、企业工具成本,以及一个关于写作与思考的根本性问题。从 OpenAI 模型推翻八十年几何猜想,到 Glasswing 项目一个月找出一万个高危漏洞,再到微软因 token 账单砍掉 Claude Code 授权,这些事件拼在一起指向同一个现实:AI 的速度已经超过了我们的很多预设。听完这期,你会对"AI 在加速,而我们在哪里"这个问题有更具体的感知。本期要点- OpenAI 模型找到反例,推翻了 Paul Erdős 1946 年提出的单位距离问题上界猜想,AI 在数学上的角色更像"有创造力的同事"而不是暴力穷举机器- OpenAI 开出年薪四十四万五千美元招募研究员,要求"有品味、有战略眼光",岗位核心是研究 AI 自我改进带来的失控风险- 微软砍掉内部 Claude Code 企业授权,原因是 token 按量计费让预算在几个月内耗尽,企业财务体系还没适应 AI 的计费逻辑- Anthropic 发布 Project Glasswing 首次进度更新,联合十几家科技公司用 AI 扫描关键基础软件,一个月内发现超过一万个高危漏洞,瓶颈已从"发现"转移到"修补"- Farnam Street 指出写作在 AI 时代的不可替代性:把写作外包出去,同时也外包了"发现自己不理解什么"的过程参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/OpenAI is hiring a $445,000 researcher. Requirements? Be 'tasteful and strategic.' — https://www.businessinsider.com/openai-hiring-445000-researcher-tasteful-strategicMicrosoft starts canceling Claude Code licenses — https://www.theverge.com/microsoft-canceling-claude-code-licensesProject Glasswing: An Initial Update — https://www.anthropic.com/glasswingThe Surprising Reason Writing Remains Essential in an AI-Driven World — https://fs.blog/writing-essential-ai-world/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  42. -4

    5月23日 | 手机窃听广告被官方证实,这个传说是真的

    本期内容AI 正在让原来不透明的东西变得可追溯,也让原来安全的东西变得更脆弱。这期节目聊了五件彼此关联的事:内容可以被标记来源,代码漏洞可以被 AI 批量发现,监听广告从传说变成了有据可查的商业服务,百代理软件工厂已经真实在运转。最后一篇把这些事串在一起问了一个问题:在 AI 擅长模仿的时代,你掌握的是规律还是底层结构?本期要点- OpenAI 联合 Adobe、微软、BBC 推进 C2PA 内容溯源标准,AI 生成的每张图将携带可验证的"出生证明"- Anthropic 牵头十二家科技巨头启动 Project Glasswing,因为最新模型的代码能力已超越绝大多数人类安全研究员- 一家公司用一百个 AI 代理同时开发软件,人类工程师的核心工作变成了任务分解和整体方向判断- FTC 对 Cox Media Group 开出近百万美元罚款,证实"主动监听广告"不只是都市传说,而是真实推销过的商业服务- Farnam Street 论证 AI 让模仿变得廉价的同时让真正的理解更值钱,两件事同时发生,没有缓冲期参考资料Advancing content provenance for a safer, more transparent AI ecosystem — https://openai.com/index/advancing-content-provenance/Project Glasswing — https://www.anthropic.com/project-glasswingInside the 100-agent Software Factory — https://every.to/context-window/inside-the-100-agent-software-factoryFTC to Require Cox Media Group and Two Other Firms to Pay Nearly $1 Million — https://simonwillison.net/2026/May/23/ftc-cox-media-group/Experts vs. Imitators — https://fs.blog/experts-vs-imitators/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  43. -5

    5月22日 | 80年数学猜想被AI推翻,解题工具本身才是关键

    本期内容从一个被推翻的八十年数学猜想开始,这期节目串联起五个方向:AI在科学发现中扮演的角色正在质变,内容溯源正成为行业基础设施,AI代理接管工作流带来的安全边界问题也在快速浮出水面。你会听到数学、安全、架构、产品四个完全不同的视角,但它们指向同一个核心问题:AI的能力已经超出了我们原有的预期,配套的工具和思维方式正在追赶。本期要点- OpenAI 的模型找到了反例,直接推翻了 1946 年厄尔多斯提出的平面单位距离猜想,这是 AI 首次真正参与数学发现而非辅助计算- OpenAI 推动 C2PA 内容溯源标准落地,AI 生成图片将携带可验证元数据,但标记可被剥离、行业覆盖碎片化是两个核心难题- Jack Clark 以二十年前的隐形篡改病毒为例,提出 AI 代理大量接管工作流后"悄悄改一个数字"式攻击将更难被察觉- Sebastian Raschka 对比逾二十个主流 LLM 架构后发现,七年来 Transformer 骨架几乎未变,真正的演进发生在训练方式和效率优化层面- Product Hunt 热门工具 DCP 为 AI 代理提供加密细粒度权限令牌,折射出代理从"写东西"转向"操作系统"后安全管理的刚性需求参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Advancing content provenance for a safer, more transparent AI ecosystem — https://openai.com/index/advancing-content-provenance/Import AI 457: AI stuxnet; cursed Muon optimizer; and positive alignment — https://importai.substack.com/p/import-ai-457The Big LLM Architecture Comparison — https://magazine.sebastianraschka.com/p/the-big-llm-architecture-comparisonDCP — Give your AI agents encrypted permission and keys — https://www.producthunt.com/posts/dcp---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  44. -6

    5月22日 | AI 解开了八十年的数学谜题,这意味着什么

    本期内容今天五件事,横跨数学突破、安全警报、工作方式和组织信任。OpenAI 模型推翻了一道困扰数学家八十年的几何猜想,提醒我们 AI 的能力边界还在快速移动。GitHub 内部仓库遭入侵,让人重新审视我们有多依赖这个工具。Every 创始人 Dan Shipper 分享了一个反直觉的发现:AI 越强,人要亲自做判断的工作反而越重。AI 代理为什么总是"失忆",背后有结构性原因,也有可操作的解法。最后一篇借一艘军舰的故事,讲清楚了信任在组织里是怎么流动的,这件事在 AI 大量介入工作流之后,比以前更重要。本期要点- OpenAI 最新模型推翻了离散几何领域一个核心猜想,八十年的数学悬案被 AI 意外破解- GitHub 官方确认内部仓库遭入侵,客户数据暂无影响,但攻击面的本质值得重新评估- 自动化不减少工作总量,它把工作从执行层移到判断层,对你的要求其实更高了- 大多数 AI 代理用向量检索记忆,能记住"是什么",但记不住"怎么做",决策上下文图是一种结构性解法- 最好的领导力让团队成员敢做没被明说可以做的事,这个逻辑同样适用于你和 AI 工具之间的关系参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/GitHub 官方 X 通告(内部仓库入侵事件)— https://github.comAfter Automation: AI progress creates more work for humans, not less — https://every.toEnterprise AI agents keep failing because they forget what they learned — https://venturebeat.comLessons on Leadership: Michael Abrashoff's Turnaround Playbook — https://fs.blog---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  45. -7

    5月21日 | AI 推翻了数学家找了八十年的答案

    本期内容AI 正在越过"执行工具"的边界,向更深的领域延伸。本期从一个被 AI 推翻的数学猜想出发,串联起内容溯源标准的落地、编程代理的异步化、代理基础设施的新品类,以及长任务协作中人该如何保持方向掌控。听完这期,你会对"AI 能做什么"有一次具体的边界更新。本期要点- OpenAI 模型找到反例,推翻了 Paul Erdős 1946 年提出的几何猜想,AI 开始在人类未踏足的方向探路- OpenAI 为 AI 生成图片引入 C2PA 元数据和隐形水印,内容溯源标准正在进入实际产品- Mistral 在 Vibe 推出云端远程代理,编程任务从同步盯着跑变成异步等结果- Product Hunt 今日热门集中在"代理基础设施"品类,InstaVM、Mixpanel Headless 等工具专为代理而非人类设计- Ethan Mollick 指出长任务中 AI 会漂移,人的核心职责是维持方向,速度越快导航越关键参考资料An OpenAI model has disproved a central conjecture in discrete geometry — https://openai.com/index/model-disproves-discrete-geometry-conjecture/Advancing content provenance for a safer, more transparent AI ecosystem — https://openai.com/index/advancing-content-provenance/Remote agents in Vibe. Powered by Mistral Medium 3.5. — https://mistral.ai/news/remote-agents-vibeWorking with AI on Longer, More Complex Tasks — https://www.oneusefulthing.org---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  46. -8

    5月20日 | 谷歌二十五年来第一次动了搜索框

    本期内容谷歌在 I/O 大会上宣布二十五年来最大的搜索变革,不是视觉改版,而是把搜索框从"分发器"变成了"执行者"。与此同时,一个开源项目用护栏设计让 8B 小模型的准确率从 53% 拉到 99%,提醒我们任务结构比模型大小更关键。本期还触碰了一个更深的职业问题:当 AI 拿走了 entry-level 的笨工作,年轻人还能从哪里积累真正的判断力?听完这期,你会对 AI 时代的入口权力、任务设计思路和职业路径都有新的思考角度。本期要点- 谷歌把搜索框从"返回信息"升级为"执行任务",Agent 入口重新定义了互联网流量分发的权力结构- Forge 项目证明,给 8B 模型加上护栏和结构化验证,Agentic 任务成功率可以大幅提升,任务设计比模型升级更值得优先考虑- Gas City 测试了同时运行一百个编程 Agent 的体验,结论是协调成本爆炸,而透明度才是解决 Agent 协作问题的核心- AI 正在拿走 entry-level 的重复工作,但那些"笨工作"恰恰是年轻人积累具体判断力的场地,这是比"抢工作"更深的结构性问题- Token Speed 工具让你直接感受不同 token 输出速度的体验差异,帮助建立速度直觉,而不只是看一个数字参考资料Google just redesigned the search box for the first time in 25 years — https://venturebeat.comGuardrails take an 8B model from 53% to 99% on agentic tasks (Forge) — https://github.com/forge-projectInside the 100-agent Software Factory — https://every.to/context-windowHow to Start a Career When AI Is Doing Your Entry-level Job — https://every.to/working-overtimeToken Speed 可视化工具 — https://mikeveerman.github.io/tokenspeed---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  47. -9

    5月21日 | 八亿参数模型加了护栏,成功率从五成跳到九成九

    本期内容这期节目有四个不同维度的信号:一个框架层面的效率发现告诉你换模型不一定是正确答案;苹果用一贯的边缘测试策略,把代理 AI 悄悄塞进了操作系统;OpenAI 的新财务功能让"了解你的 AI"从概念变成产品;而 Simon Willison 的五分钟演讲,本身就是一堂关于信息整合和判断力的课。听完这期,你会对"怎么让 AI 更稳、更私密、更有结构"有更具体的感知。本期要点- Karpathy 宣布加入 Anthropic,这位 OpenAI 创始成员主动选择重返前沿研发,值得把它当作行业动势的信号持续跟踪- OpenAI 为 ChatGPT 添加个人财务模块,可连接银行账户生成支出分析,技术门槛不高,真正的挑战是用户对隐私的直觉抵触- 开源框架 Forge 通过在代理工作流每个节点加护栏,把八十亿参数模型的任务完成率从 53% 提升到 99%,证明结构能补能力- Apple 在无障碍功能更新中引入跨应用代理 AI 操作,HN 社区指出这是苹果在阻力最小的场景里先验证新技术的经典打法- Simon Willison 在 PyCon US 2026 做了一个五分钟闪电演讲,梳理过去半年 LLM 领域的关键节点,选择本身就是判断力的展示参考资料Personal update: I've joined Anthropic — https://twitter.com/karpathyA new personal finance experience in ChatGPT — https://openai.com/index/personal-finance-chatgpt/Show HN: Forge, guardrails for local LLM agents — https://github.com/antoine-zambelli/forge-guardrailsApple unveils new accessibility features and updates with Apple Intelligence — https://www.apple.com/newsroom/The last six months in LLMs in five minutes — https://simonwillison.net/2026/May/---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  48. -10

    5月20日 | 谷歌把用了二十五年的搜索框改掉了

    本期内容今天五件事,从谷歌二十五年来首次重构搜索框,到字节用三十亿参数挑战"大模型才能做复杂事"的直觉,再到 Karpathy 加入 Anthropic 背后的信号意义。还有一本讲 AI 与真相的书,自己因为 AI 捏造引用被媒体抓包,以及一篇深度分析:当每个人都有了私人 AI 代理,真正的瓶颈出在哪里。这五件事合在一起,指向的是同一个问题:我们如何对待真相、如何选择信任、如何建立与 AI 的长期关系。本期要点- 一本专门讨论 AI 时代真相危机的书,因为使用 AI 生成了虚假引用而被《纽约时报》抓包,结构性讽刺让它成为自己书里最好的案例- Andrej Karpathy 宣布加入 Anthropic,一个不需要靠任何公司光环说话的人,主动选择去哪里,本身就是一种公开表态- 字节跳动发布开源模型 Lance,用三十亿参数尝试覆盖文生图、图生文、视频理解等全部多模态任务,核心主张是多任务训练信号可以相互增强- 谷歌在 I/O 大会上将搜索框的第一屏从蓝色链接列表改为 AI 生成摘要,这是二十五年来首次根本性的界面变革,对内容创作者的流量影响值得持续关注- 个人 AI 代理的能力天花板不在模型本身,而在于它能访问的上下文质量,你投入培养它的方式,决定了它最终能成为什么参考资料'The Future of Truth' Contains Quotes Made Up by A.I. — https://www.nytimes.comAndrej Karpathy joins Anthropic — https://x.com/karpathybytedance-research/Lance — https://huggingface.co/bytedance-research/LanceGoogle just redesigned the search box for the first time in 25 years — https://venturebeat.comAfter the Personal Agent — https://every.to---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  49. -11

    5月19日 | AI 生成的图片,谁来证明它是真的

    本期内容今天五件事,表面上看分散,底层逻辑只有一条:AI 正在从「能用」走向「可信赖的基础设施」。OpenAI 要给内容打来源标签,Anthropic 联合科技巨头用 AI 反过来守护软件安全,Mistral 把 AI 工作流推进生产环境,Starchild-1 带来第一个实时世界模型,Voker 则预示着「代理分析」正在成为新的产品必需品。听完这期,你会对 AI 基础设施这件事有一个更具体的感知。本期要点- OpenAI 正在推进多层内容溯源体系,元数据加水印加行业认证,AI 生成内容迟早会像食品成分表一样强制标注- Anthropic 联合苹果、谷歌、微软等顶级科技公司发起 Project Glasswing,因为他们的新模型能力已超越几乎所有人类顶尖程序员,攻防格局正在被重写- Mistral Workflows 进入公开预览,瞄准的不是 AI 能不能用,而是能不能在生产环境里稳定跑、出错能自动恢复- Starchild-1 自称首个实时多模态世界模型,如果技术属实,它打开的应用空间和现有模型完全不在同一维度- Voker 作为专门针对 AI 代理行为的分析平台出现,代理分析从可选变成必需,这个细分市场正式进入工具化阶段参考资料Advancing content provenance for a safer, more transparent AI ecosystem — https://openai.com/index/advancing-content-provenance/Project Glasswing: Securing critical software for the AI era — https://www.anthropic.com/news/project-glasswingWorkflows for work that runs the business — https://mistral.ai/news/workflowsStarchild-1 on Product Hunt — https://www.producthunt.com/posts/starchild-1Voker on Product Hunt — https://www.producthunt.com/posts/voker---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

  50. -12

    5月19日 | 四百万开发者在用,但 AI 正在挤走能判断它好坏的人

    本期内容今天五篇,串起来是同一个问题的不同切面:AI 在提速,但我们是否真的在往对的地方加速?从 Codex 的协作节奏哲学,到 Claude 反超 ChatGPT 背后的信任讨论,再到企业裁掉领域专家后 AI 改进回路断裂的冷酷逻辑,最后是图数据库如何补上向量搜索找不到的关系,以及一本 1984 年的制造业经典怎么精准击中当下 AI 采购决策的盲点。听完这期,你会对"效率"这个词有不一样的感知。本期要点- Codex 登陆手机端,OpenAI 提出的不是新功能,而是一种"AI 跑后台、你随时微调方向"的新工作节奏- Claude 首次在净新增收入指标上超过 ChatGPT,社区讨论的核心不是数字,是"信任得过"正在成为模型竞争的新维度- 企业裁掉领域专家以节省成本,但这些人正是能判断 AI 输出对错的人,AI 的改进回路因此开始空转- 图增强 RAG 补上了向量搜索的盲区:多跳关系推理需要图结构,而不是语义相似度匹配- 约束理论告诉我们,系统产出由最慢的环节决定,在找到瓶颈之前,所有 AI 加速只是在给它前面的队伍排得更长参考资料Work with Codex from anywhere — https://openai.com/index/work-with-codex-from-anywhere/For the first time in years, ChatGPT falls to second place (Reddit r/fivethirtyeight) — https://www.reddit.com/r/fivethirtyeight/The enterprise risk nobody is modeling: AI is replacing the very experts it needs to learn from — https://venturebeat.comArchitectural patterns for graph-enhanced RAG: Moving beyond vector search in production — https://venturebeat.comI don't think AI will make your processes go faster — https://frederickvanbrabant.com---BearTalk 狗熊有话说播客,始于 2012 年。订阅地址:https://beartalking.com/page/podcast

Type above to search every episode's transcript for a word or phrase. Matches are scoped to this podcast.

Searching…

We're indexing this podcast's transcripts for the first time — this can take a minute or two. We'll show results as soon as they're ready.

No matches for "" in this podcast's transcripts.

Showing of matches

No topics indexed yet for this podcast.

Loading reviews...

ABOUT THIS SHOW

今天的 AI 信息里,哪几件事真正值得你花时间了解?

HOSTED BY

Bear Liu

CATEGORIES

Frequently Asked Questions

How many episodes does BearTalk AI 每日简讯 have?

BearTalk AI 每日简讯 currently has 50 episodes available on PodParley. New episodes are automatically indexed when they're published to the podcast feed.

What is BearTalk AI 每日简讯 about?

今天的 AI 信息里,哪几件事真正值得你花时间了解?

How often does BearTalk AI 每日简讯 release new episodes?

BearTalk AI 每日简讯 has 50 episodes. Check the episode list to see recent publication dates and frequency.

Where can I listen to BearTalk AI 每日简讯?

You can listen to BearTalk AI 每日简讯 on PodParley by clicking any episode. We provide an embedded audio player for direct listening, and you can also subscribe via your preferred podcast app using the RSS feed.

Who hosts BearTalk AI 每日简讯?

BearTalk AI 每日简讯 is created and hosted by Bear Liu.
URL copied to clipboard!