EPISODE · Jun 19, 2026 · 13 MIN
Harness engineering:把会说话的模型,变成会干活的智能体(知识分析)
同样调 GPT / Claude,为什么有人能造出能改你整个代码库、自己跑命令查资料的智能体,你照着文档调同一个模型,却只会聊天?差的不是模型——是模型外面那一层「壳」,英文叫 harness。 这是「脑子借我一下 / Borrow My Brain」**知识分析** 线的第一期。不光讲概念——我们把一个最小的壳的**代码直接摊开、一行一行拆**:工具怎么定义、模型靠什么「认识」工具(schema 说明书)、三种消息角色(user / assistant / tool)怎么搭出一轮对话、那个 run 循环真实长什么样、再用一张架构全景图收口。最后真跑一次:四十行代码、没换更牛的模型,一个只会聊天的模型就开始自己列目录、读文件、跨文件推理,把活干完。演示是真跑的,不是演的。 ◾ 时间戳 00:01 抓手 · 同一个模型,为什么差这么多 00:56 心智模型 · 模型的三个先天残疾 01:58 为什么现在 · 模型学会了「工具调用」 02:47 ★ 工具:先给模型一份「说明书」(schema 拆解) 04:45 ★ 三种消息(user/assistant/tool)+ 真实循环代码逐行 07:12 ★ 架构全景图 · 模型↔壳↔工具 的一套来回 08:42 真跑 · 它自己转给你看 10:09 壳的五件套 · 上下文工程为什么最被低估 11:24 坑与边界 · 什么时候别搭壳 12:36 收口 · 先搭好壳 ◾ 壳的五件套 ① 循环(想一步·做一步·看结果) ② 工具 ③ 上下文工程(最被低估) ④ 沙箱权限 ⑤ 子智能体。 厉害的智能体,无非是把这五件套往死里打磨。 ◾ 一句话 想做能干活的智能体,发现它不好使时,别急着换更大的模型——先回头看你那层壳。十有八九,问题不在大脑,在身体。 ◾ 复现这个演示(40 行) 演示用的最小 harness 代码 + 沙箱 + 真实运行输出,都在仓库里: projects/borrow-my-brain/research/ep032_harness_engineering/demo/ 跑法:装 openai 包,配好 OPENAI_API_KEY,python minimal_harness.py。 (harness 概念模型无关,换成任意支持工具调用的模型都成立。) 下一步:自己给它加上第三样工具(比如能上网搜的),感受本事又涨一截。 ◾ 其他平台 Spotify · Apple Podcasts · 小宇宙 · 网易云 脑子借我一下 / Borrow My Brain @Borrow_My_Brain
Embed this episode
What this episode covers
同样调 GPT / Claude,为什么有人能造出能改你整个代码库、自己跑命令查资料的智能体,你照着文档调同一个模型,却只会聊天?差的不是模型——是模型外面那一层「壳」,英文叫 harness。 这是「脑子借我一下 / Borrow My Brain」**知识分析** 线的第一期。不光讲概念——我们把一个最小的壳的**代码直接摊开、一行一行拆**:工具怎么定义、模型靠什么「认识」工具(schema 说明书)、三种消息角色(user / assistant / tool)怎么搭出一轮对话、那个 run 循
Ready to play
Harness engineering:把会说话的模型,变成会干活的智能体(知识分析)
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.