DeepSeek 推出 DeepSeek-V4-Pro;Arena.ai 以每百萬 token 輸入 0.435 美元、輸出 0.87 美元評估其 Agent 開發性價比 episode artwork

EPISODE · Aug 13, 2026 · 5 MIN

DeepSeek 推出 DeepSeek-V4-Pro;Arena.ai 以每百萬 token 輸入 0.435 美元、輸出 0.87 美元評估其 Agent 開發性價比

from EasyVibeCoding Podcast · host DeepSeek

DeepSeek 推出 DeepSeek-V4-Pro;Arena.ai 以每百萬 token 輸入 0.435 美元、輸出 0.87 美元評估其 Agent 開發性價比。 產品更新 DeepSeek 表示,DeepSeek-V4-Pro 帶來多項面向生產環境的 Agent 升級,並讓使用者依任務複雜度調整 reasoning effort: low 適合簡單任務。 high 適合日常 Agent 工作流程。 max 適合複雜任務。 V4-Pro 與 V4-Flash 都支援這項設定。DeepSeek-V4-Pro 已在 app 與 web 版提供,使用者可透過「Expert Mode」啟用;API 也已開放,模型名稱維持不變,設定方式則需參考 API 文件。產品同時原生支援 OpenAI Responses API,並針對 Codex 提供一鍵設定。 API 定價 隨著 V4 系列推出,DeepSeek 將 API 定價改為區分尖峰與離峰時段。離峰價格比尖峰低 50%,官方認為這能讓使用者更彈性地安排工作負載。新價格將於 2026 年 8 月 16 日 16:00 UTC 起生效;原始公告未列出各模型的新單價,因此實際費率仍須以 API 文件為準。 DeepSeek-V4 API 新定價方案顯示離峰時段價格比尖峰時段低 50%,其中 DeepSeek-V4-Flash 離峰快取命中輸入價格為 $0.007,DeepSeek-V4-Pro 則為 $0.022。 第三方評測 Vals AI 表示,DeepSeek V4 Pro 0813 在 Vals Index 上提升 11 分,成為排名第 2 的開放權重模型;每項任務成本約為 0.14 美元,價格約是 Kimi K3 的 1/17,而 Kimi K3 是唯一排名高於它的開放權重模型。 來源:@ValsAI(回覆)|DeepSeek V4 Pro 0813 在 Vals Index 開源模型榜單中以 66.25% 的準確率位居第二,每項測試成本僅 0.14 美元。 Arena.ai 的 Code Arena: WebDev 初步結果則顯示: DeepSeek-V4-Pro(Max)得分 1607,整體約第 8 名,開放模型中排名第 2。 它落後 GPT-5.6 Sol(xHigh)的 1622 分,並低於 Kimi K3(Max)的 1674 分。 在 Text Arena 中,它以 1465 分約排名開放模型第 5,與 GLM-5.1 的 1467 分、GPT-5.6 Terra(xHigh)與 Grok 4.6(High)的 1464 分相當。 來源:@arena(回覆)|DeepSeek-V4-Pro (Max) 在 Text Arena 開源模型中獲得 1,465 分(AutoEval),位居第 5 名,與 GLM-5.1(1,467 分)相當。 Arena.ai 特別提醒,以上是早期 AutoEval 分數,由使用 Arena 人類偏好資料訓練的 Reward Model 自動投票,並非即時真人票選;隨著更多真人票數加入,排名仍可能收斂或變動。 來源:@arena(回覆)|DeepSeek-V4-Pro (Max) 在 Code Arena: WebDev Top 15 的 AutoEval 標註列直接顯示 1,607 分。 價格效益 Arena.ai 指出,DeepSeek-V4-Pro(Max)目前在 Code Arena: WebDev 以每百萬 token 輸入 0.435 美元、輸出 0.87 美元的價格,擊敗部分更高價模型,包括輸入/輸出價格為 5/25 美元的 Opus 4.8,以及 1.4/4.4 美元的 GLM-5.2。Arena.ai 認為,這款即將推出的開放權重模型可能改變 WebDev 評測中的效能與價格邊界。 來源:@arena(回覆)|DeepSeek V4 Pro (Max) 的 Pareto Frontier tooltip 直接顯示 Arena Score 1607 與每 1M tokens 混合價格 $0.76/M。 Agent 程式開發 Cline 表示,DeepSeek 悄然釋出 V4-Pro 0813;相較 4 月的 Preview 模型,它在 Terminal Bench 提升 15.8%,並以約為 Fable 5 的 1/57 成本達到相近表現。Cline 列出的模型規模為 1.6T 個參數、49B 個 active parameters,以及 1M context。Cline 進一步稱它是目前市場上價格效能最佳的模型,但這仍屬 Cline 的評價,不能視為涵蓋所有任務與評測的普遍結論。 DeepSeek-V4-Pro-0813 與多款模型在各項 Agent benchmark 表現各有高低,其中在 AutomationBench (Public) 以 31.8 分與 Cybergym 以 83.3 分取得領先或前列成績。 來源:@cline(回覆)|V4-Pro 0813 在 Terminal-Bench 2.1 以 87.9 分居次,表現逼近 Fable 5(88.0 分),且價格僅為每百萬 token 輸入/輸出 $0.435 / $0.87。 ClinePass 方案 DeepSeek-V4-Pro 現已可透過 ClinePass 使用。Cline 將 ClinePass 定位為以約五分之一價格提供開放權重模型的訂閱服務,並稱在目前價格下幾乎可不限量使用;首月促銷價為 4.99 美元,之後每月 9.99 美元。Cline 提供的安裝指令如下,執行前仍應由使用者自行核對套件來源與權限: `bash npm i -g cline ` 方案頁面:ClinePass。 深色網格背景與紫色漸層光暈上的白色文字與圖示,中央偏左為帶有兩道垂直長條的機器人頭像造型 logo,右側為白色粗體文字 cline.bot。原文:https://easyvibecoding.app/curated/2959-deepseek-launches-deepseek-v4-pro-open-weights-agent

Episode metadata supplied by the publisher feed · Published Aug 13, 2026

Embed this episode

Ready to play

DeepSeek 推出 DeepSeek-V4-Pro;Arena.ai 以每百萬 token 輸入 0.435 美元、輸出 0.87 美元評估其 Agent 開發性價比

0:00 5:51

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of EasyVibeCoding Podcast?

This episode is 5 minutes long.

When was this EasyVibeCoding Podcast episode published?

This episode was published on August 13, 2026.

Can I download this EasyVibeCoding Podcast episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!