別再手動調 Skill,Microsoft SkillOpt 讓它自己越練越強 episode artwork

EPISODE · Jun 2, 2026 · 9 MIN

別再手動調 Skill,Microsoft SkillOpt 讓它自己越練越強

from 脈報 · host 思思主播

Microsoft SkillOpt 把調 agent skill 從手感試錯變成可量測訓練,模型凍結,被優化的是文字檔。一次看懂它的運作、論文報的效果,以及為何只在有標準答案的任務才適用。 ⭐ 文章深度讀:SkillOpt 的完整運作、論文數字與我說的硬邊界,影片沒講完的都整理在這篇 → https://heymaibao.com/microsoft-skillopt-self-evolving-agent-skills/ ⚡ 章節重點 開場 手動調 skill 的無限輪迴 00:00 SkillOpt 到底在訓練什麼 01:18 效果有多猛,52 格全勝 03:03 硬邊界,任務要有標準答案 05:08 低成本動手的三步起步 06:15 成本與我的判斷 08:10 📝 懶人包 ∙ SkillOpt 是一個「文字空間的優化器」,意思是它不動模型權重,被訓練的是你的 skill 文字檔。整套靠一個迴圈:用當前 skill 跑任務、讀成功與失敗、提出小幅編輯、只保留讓分數上升的改動。 ∙ 論文報告的效果很猛:橫跨六個 benchmark、七個模型、三種執行環境共 52 個測試格,SkillOpt 全部拿下最佳或並列最佳。以 GPT-5.5 直接對話為例,六項平均從沒有 skill 的 58.8 升到 82.3,提升 23.5 分,而最後產出的只是一個約 380 到 2,000 tokens 的小文字檔。 ∙ 它有硬邊界:只在「有可對照正確答案」的任務上有效,而且真正決定成敗的不是跑指令,是你準備的那組範例答案。 ∙ 我的判斷:別急著裝。先問你的任務有沒有標準答案,有,這是把調 skill 從玄學變成可量測的好路徑,沒有,它幫不了你。 📚 參考資料 hooeem:I want to create self-evolving agent skills (X 貼文) → https://x.com/hooeem/status/2061528919786791154?s=46 SkillOpt 論文 (arXiv,2026) → https://arxiv.org/pdf/2605.23904 microsoft/SkillOpt (GitHub) → https://github.com/microsoft/SkillOpt

Episode metadata supplied by the publisher feed · Published Jun 2, 2026

Embed this episode

NOW PLAYING

別再手動調 Skill,Microsoft SkillOpt 讓它自己越練越強

0:00 9:17

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

Frequently Asked Questions

How long is this episode of 脈報?

This episode is 9 minutes long.

When was this 脈報 episode published?

This episode was published on June 2, 2026.

Can I download this 脈報 episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!