EPISODE · Jul 11, 2026 · 1 MIN
Perplexity 將 Grok 4.5 模型整合至 Computer 平台,讓 Pro 與 Max 使用者能以更低成本執行高效的 Agent 研究任務
from EasyVibeCoding Podcast · host Aravind Srinivas
Perplexity 將 Grok 4.5 模型整合至 Computer 平台,讓 Pro 與 Max 使用者能以更低成本執行高效的 Agent 研究任務。 核心效能評測 Perplexity 執行長 Aravind Srinivas 指出,Grok 4.5 在內部開發的 WANDR 基準測試中表現優異,該測試用於衡量 Agent 的研究能力。根據官方評測數據: Grok 4.5 的效能表現超越了目前 Perplexity 內部的 GLM 5.2 後訓練模型,且兩者成本相當。 與 Claude Opus 4.8 相比,Grok 4.5 在 WANDR 測試中得分更高,但成本僅為其一半。 在 WANDR 基準測試中,Grok 4.5 取得了最高分(0.328),其成本($4.76/trial)僅約為 Claude Opus 4.8 的一半,且在相近成本下表現優於 GLM 5.2 + advisor。 服務整合與應用 Perplexity 正式將 Grok 4.5 納入其 Computer 平台的編排模型(orchestrator model)選項中,具體調整如下: 適用對象:目前僅開放給 Consumer Pro 與 Max 訂閱使用者。 運作機制:使用者可在 Computer 的 harness 環境中選用此模型,作為執行複雜研究任務的核心引擎。 成本比較:Grok 4.5 的成本約為 Claude Opus 4.8 的一半。 技術觀點 Aravind Srinivas 對 Grok 4.5 在 Computer harness 中的表現給予高度評價。WANDR 數據顯示,Grok 4.5 的得分高於 GLM 5.2,成本約為 Claude Opus 4.8 的一半。原文:https://easyvibecoding.app/curated/2451-perplexity-adds-grok-4-5-to-computer-platform
Embed this episode
Ready to play
Perplexity 將 Grok 4.5 模型整合至 Computer 平台,讓 Pro 與 Max 使用者能以更低成本執行高效的 Agent 研究任務
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.