EPISODE · Jun 20, 2026 · 12 MIN
上下文工程:给模型「收拾桌子」的手艺(知识分析)
跟 AI 聊着聊着它就变笨了,给它喂一大堆文档反而更糊涂?很多时候模型一点没变——是它的「桌子」乱了、满了。 这是「脑子借我一下 / Borrow My Brain」**知识分析** 线第 2 期。上一期讲 harness 时提过「最被低估的一件」,就是今天的主角:上下文工程。一个心智模型贯穿全集——模型的上下文窗口 = 一张**桌子**:它只对桌上当下的东西做反应、桌子有硬尺寸、还每聊一轮就多堆一摞纸。模型没有我们以为的那种记性,它的全部记性就是这张桌子。 ◾ 时间戳 00:01 抓手 · AI 聊着聊着怎么就变笨了 00:57 心智模型 · 上下文窗口 = 一张桌子 02:26 为什么「喂得越多反而越笨」· 迷失在中间(U 形) 04:07 ★ 真演示 · 看桌子怎么一步步爆掉(token 真数) 05:24 收拾桌子的四个动作 07:08 ★ 真演示 ·「压一压」真砍 token:1544 → 737 08:35 一张「好桌子」的布局 · 结构化上下文 09:51 坑与边界 · 什么时候别折腾 10:43 收口 · 做模型的桌面管理员 ◾ 收拾桌子的四个动作 ① 写出去(offload·写进外部记忆) ② 挑进来(retrieve·只取相关) ③ 压一压(compress·总结成便签) ④ 分桌子(isolate·子智能体各用小桌)。所有上下文工程的花活,都是这四下的排列组合。 ◾ 两个真问题 · 桌子会满:超过窗口上限就塞不下 / 把最早的挤下桌。 · 迷失在中间:模型对开头和结尾看得最清,关键资料埋进正中间,等于落进盲区。所以「最稳最重要的,放两头」。 ◾ 复现这个演示 token 增长 + 压缩的最小 demo(接上一期的 harness,用 tiktoken 真数 token)在仓库里: projects/borrow-my-brain/research/ep033_context_engineering/demo/ 跑法:装 openai 和 tiktoken,配好 OPENAI_API_KEY,python context_demo.py,自己改改预算看 token 怎么动。 ◾ 其他平台 Spotify · Apple Podcasts · 小宇宙 · 网易云 脑子借我一下 / Borrow My Brain @Borrow_My_Brain
Embed this episode
What this episode covers
跟 AI 聊着聊着它就变笨了,给它喂一大堆文档反而更糊涂?很多时候模型一点没变——是它的「桌子」乱了、满了。 这是「脑子借我一下 / Borrow My Brain」**知识分析** 线第 2 期。上一期讲 harness 时提过「最被低估的一件」,就是今天的主角:上下文工程。一个心智模型贯穿全集——模型的上下文窗口 = 一张**桌子**:它只对桌上当下的东西做反应、桌子有硬尺寸、还每聊一轮就多堆一摞纸。模型没有我们以为的那种记性,它的全部记性就是这张桌子。 ◾ 时间戳 00:01 抓手 · AI
Ready to play
上下文工程:给模型「收拾桌子」的手艺(知识分析)
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.