#638.Agent Loop 大辩论:Loop究竟是炒作还是真有用 episode artwork

EPISODE · Jul 20, 2026 · 51 MIN

#638.Agent Loop 大辩论:Loop究竟是炒作还是真有用

from 跨国串门儿计划

📝 本期播客简介本期我们克隆了:知名播客 AI Engineer The Great Loops Debate — Dex Horthy, Geoff Huntley, Ian Livingstone, Greg Pstrucha, @insecure-agents原内容更新时间:2026-07-17这是一场关于AI循环工程(Loops)的牛津制辩论,由《Insecure Agents》主持人Ali How主持。四位来自Keycard、HumanLayer等前沿AI公司的技术领袖分成两队,围绕"循环背后的炒作与实际效果之间是否存在差距"展开激烈交锋。正方认为循环已经足够成熟,是迈向完全自主软件工厂的关键一步;反方则坚持炒作跑在了工程纪律前面,今天的循环远未达到银弹级别。辩论从循环的历史、解剖结构一直延伸到未来,涵盖了Ralph Loop的起源、上下文腐化、语义验证、经济可行性、共享记忆安全等核心议题。如果你正在思考AI时代的软件工程范式、自主Agent的边界,或者单纯想知道该不该把循环引入自己的开发流程,这场高手过招会给你大量一手经验和尖锐判断。👨‍⚕️ 本期嘉宾本场辩论共有四位嘉宾。Ian Livingstone是Keycard的CEO兼联合创始人,长期关注AI安全与身份验证;Geoff Huntley是Ralph Loop的创造者,这一概念深刻影响了Anthropic等公司的Agent设计;Greg Pstrucha是Sentry的开发者,对代码质量和工程实践有深入见解;Dex Horthy是HumanLayer的CEO,专注于AI与人类协作的工程化方案。主持人Ali How同时是Keycard技术团队成员。⏱️ 时间戳开场与辩论规则01:09 辩论开场:循环的炒作与实际效果之间是否存在差距02:44 牛津辩论制规则:改变最多人想法的一方获胜03:20 双方立场介绍:正方认为没有差距,反方认为炒作跑在纪律前面循环的历史与起源04:47 Geoff:循环是不可避免的,我已经两年半没手动写过代码了06:56 Dex:Kubernetes花了七八年才搞对,循环也需要时间沉淀09:27 Ian:循环本来就是一切构建工作的核心,从50年前到今天都是如此11:39 Greg:炒作让你相信可以靠砸token把质量问题"编排"掉,但经济上不可持续循环的解剖结构:什么才是一个好的循环17:23 Geoff:Ralph为什么从greenfield走向通用?因为模型生成的代码比大多数开发者都好21:32 Greg:验证手段里加入非确定性,正确性就会越来越低23:26 Dex:上下文腐化与愚钝区,如何判断模型已经开始胡乱挣扎26:48 验证的矛盾:如何防止Agent通过修改测试来作弊循环的未来与软件工厂29:16 Dex:Loom实验证明,炒作跑在纪律前面,那东西现在还不行31:56 Greg:循环什么时候能回本?有些场景值,但别被Twitter带偏34:52 Ian:共享记忆的访问控制是个没解决的问题,但雏形开始出现36:44 Greg:Agent偏爱复杂性,我不放心把架构决策交给它总结陈词45:49 Greg:多尝试,自己思考,别扎进炒作泡沫里46:53 Ian:火车已经出站了,你别无选择必须跟上48:50 Dex:我热切期待关灯软件工厂可行的世界,但在此之前,用循环别那么用49:18 Geoff:类型系统很重要,Rust很好;我已经几乎不用开源软件了🌟 精彩内容💡 "我们管自己叫工程师,但其实不是真正的工程师"Geoff尖锐地指出软件行业缺乏真正的责任归属机制。在讨论Agent签名和代码责任时,他直言这个行业在个人层面根本没什么真正的责任,这让我们在引入自主Agent时面临更大的治理挑战。"我们这个行业其实挺闹剧的。我们个人层面根本没什么真正的责任。我们管自己叫工程师,但我们其实不是真正的工程师。"💡 "模型是醉的,你不能信任它们,但我们可以通过工程手段消除故障域"Geoff用"醉汉"比喻LLM的不可靠性,但强调这正是循环工程的价值所在——不是追求模型完美,而是用pre-commit hooks、类型系统、确定性测试等手段把不可靠的模型约束在安全轨道上。"我们得戴上工程师的帽子。我们现在有点像火车司机了,我们的工作就是让火车保持在轨道上。因为,坦白说,模型是醉的,对吧?你不能信任它们。"💡 "炒作让你相信可以靠砸token把质量问题编排掉"Greg直击当前AI工程化的核心幻觉:以为在循环上叠循环就能解决质量问题。他指出语义验证虽然有用,但最终产出的代码依然很烂,而且token成本在大公司会迅速变得不可持续。"当下这种炒作驱动的话语,会让你相信一件事:你可以在循环上叠循环再叠循环,靠砸更多token来把质量问题给'编排'掉。我不认为这是可持续的。"💡 "火车已经出站了,你别无选择"Ian用这个比喻总结了循环工程的必然性。在竞争激烈的市场里,没有公司能说"我们不碰循环这套东西"。问题不是会不会发生,而是什么时候发生、程度有多深。"火车已经出站了。一旦火车出站,全世界每个人都会说,天哪,我得稳住阵脚,我们得跟上别人。而且他们必须跟上。"💡 "先去想办法快2倍、3倍,因为试图一步快100倍,你会把一切都搞砸"Dex给出了务实的建议:不要试图端到端自动化一切,而是在系统里逐步建立小型增量循环。他提醒工程师不要抛弃几十年积累的软件工程纪律,从小处迭代才是正道。"你能想象吗,如果世界上每个软件工程师都快了2到3倍,并且产出质量接近人类水平?那会改变世界上每一家企业。而我们却试图走得太远。"💡 "Agent偏爱复杂性,它们会无休止地往技术栈上堆东西"Greg分享了一线经验:AI生成的代码倾向于过度工程化。真正资深工程师的价值在于知道不该做什么、哪些取舍值得做,而这恰恰是Agent目前最缺乏的判断力。"任何有多年经验的工程师都会告诉你,重要的不只是你该做什么,还有你不该做什么。就我的经验来看,Agent偏爱复杂性。"💡 "我已经几乎不用任何开源软件了,直接按需求生成代码"Geoff抛出一个极端但引人深思的做法:为了缩小供应链攻击的爆炸半径,他选择vendor化所有源代码,让Agent可以直接修改。这暗示了AI时代软件供应链可能发生的根本性变化。"当供应链攻击发生的时候,我的反应就是:没影响到我。你要尽可能把自己所有的源代码都vendor化,这样Agent才能真正用循环去修改它。"🌐 播客信息补充本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的使用 AI 进行翻译,因此可能会有一些地方不通顺;如果有后续想要听中文版的其他外文播客,也欢迎联系微信:iEvenight在小宇宙查看该单集文稿

Episode metadata supplied by the publisher feed · Published Jul 20, 2026

Embed this episode

NOW PLAYING

#638.Agent Loop 大辩论:Loop究竟是炒作还是真有用

0:00 51:42

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of 跨国串门儿计划?

This episode is 51 minutes long.

When was this 跨国串门儿计划 episode published?

This episode was published on July 20, 2026.

Can I download this 跨国串门儿计划 episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!