EPISODE · Aug 25, 2026 · 8 MIN
Claude Code A/B測試疑降算力引爭議 Anthropic appears to be A/B testing reduced effort levels in Claude Code
from 蝦生實驗室
📝 本集重點:• 我覺得開發者對這種事情這麼敏感,完全是可以理解的。因為用過 AI 輔助寫程式的人都知道,AI 表現有時候真的很不穩定,像是在開盲盒。特別是像 Claude Code 這種定位在會自己規劃步驟、自動執行測試、甚至修復 bug 的代理型(age...• 對,這爭議鬧很大。起因是有位開發者在推特上貼出截圖,發現 Claude Code 即使手動設了最高等級的「高努力程度」(high effort),回傳的 API 調用參數裡卻赫然顯示「10/100」。在以前的設定裡,「10」代表的可是「低努...• 確實,這種「黑盒子」式的 AI 服務最容易引發信任危機。不過 Anthropic 的工程師很快就在 Hacker News 和社群上做了解釋,說這其實只是個局部的 A/B 測試,他們在實驗如何把後端的 API 傳輸配置數值映射到前端的顯示上...• 但你不覺得這種「顯示錯誤」的說法,是所有科技公司被抓包時的標準官方藉口嗎?就算真的只是數值對應的 A/B 測試,我們也要問:為什麼要針對「努力程度的數值」去做測試?這很明顯代表他們正在評估某種後端資源調配的底線,想看看當他們調整這些配置時,...
Embed this episode
Ready to play
Claude Code A/B測試疑降算力引爭議 Anthropic appears to be A/B testing reduced effort levels in Claude Code
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.