EPISODE · Jun 9, 2026 · 2 MIN
@cognition:Cognition 宣布 Claude Fable 5 整合至 Devin。 最新模型整合 Cognition 於 2026 年 6 月 10 日宣布,…
from EasyVibeCoding Podcast · host Cognition
Cognition 宣布 Claude Fable 5 整合至 Devin。 最新模型整合 Cognition 於 2026 年 6 月 10 日宣布,最新的「Claude Fable 5」模型現已全面支援 Devin 的各項服務,包括「Devin Cloud」、「Devin Desktop」以及「Devin CLI」。使用者可透過「Devin Cloud」的「Ultra」Agent 體驗此模型,該版本專為處理長週期任務與複雜除錯場景所設計。儘管效能提升,Cognition 透過調整「harness」設定,將「Ultra」的運行成本控制在預設 Devin Agent 的 140% 以內。 效能與基準測試 「Claude Fable 5」在 Cognition 自有的工程基準測試「FrontierCode」中獲得第一名。該基準測試專注於真實世界的工程任務,評估指標包含程式碼的「可合併性(mergeability)」與「品質」。 Claude Fable 5 在 FrontierCode 基準測試中取得 46.3% 的分數,榮登第一名,顯著超越 Claude Opus 4.8 與 GPT-5.5 等模型。 該模型具備優異的長週期推理與除錯能力。 支援開箱即用的工具泛化能力,涵蓋從「MCP」整合到電腦操作(computer use)等多種應用。 在提升評分表現的同時,優化了模型輸出與「token」使用量的比例,避免過度消耗資源。 根據 Cognition 官方推文,Claude Fable 5 在 FrontierCode 基準測試中榮登第一名,在不同的平均輸出 token 數量下皆展現出領先其他模型(如 Opus 4.8、GPT-5.5 等)的最高加權評分(最高達 46.2%)。 實際應用案例 Cognition 同步分享了金融科技公司「Nubank」利用 Devin 進行大規模程式碼重構的案例。面對擁有 8 年歷史、超過 600 萬行程式碼的單體架構 ETL 系統,Nubank 透過「Devin」將任務拆解並自動化處理: 透過針對性的微調(fine-tuning),Devin 在處理資料類別遷移任務時,速度提升 4 倍,單項子任務耗時從 40 分鐘縮短至 10 分鐘。 最終實現了 8 至 12 倍的工程效率提升,並將遷移成本降低超過 20 倍。 該專案證明了 Devin 在處理重複性高、邊緣案例複雜的工程任務時,能有效協助工程師將精力轉向核心業務開發。 欲了解更多資訊或開始使用,請造訪 Devin 官方網站 或閱讀 官方部落格說明。原文:https://easyvibecoding.app/curated/1860
Embed this episode
Ready to play
@cognition:Cognition 宣布 Claude Fable 5 整合至 Devin。 最新模型整合 Cognition 於 2026 年 6 月 10 日宣布,…
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.