EPISODE · Aug 13, 2026 · 11 MIN
Grok 4.6 – 一份實戰指南
from EasyVibeCoding Podcast · host eric zakariasson
Grok 4.6 – 一份實戰指南 Grok 4.6 上線了!我花了幾週時間,把它當成日常工作中的主要工具,處理一般的程式開發與知識工作,也特別用它做了幾個專案,想看看它在哪些地方能撐得住。 它各方面都做得不錯。最讓我印象深刻的,不是某一項能力有多大的躍進,而是它溝通的方式,以及它的速度。 高資訊密度的溝通 它很適合一起協作,並肩工作起來相當順手。摘要裡有大量真正有用的資訊,而不是把工作要求重新複述一遍;執行期間的簡短更新,也足以讓我知道現在是否需要介入。 在進行小幅變更時,它會保持安靜;等到開始處理大量檔案時,才會開始描述進度。要把這種分寸拿捏好,比你想像中需要更多調整。不過它偶爾還是會告訴我一些其實不需要知道的事情,這部分我們還在持續改善。 令人愉快的速度 4.5 其實也很快。4.6 不只快,還明顯更聰明,而這兩者結合起來,讓我更傾向採用同步的工作方式。與其一開始塞入大量 context,然後等待結果,我現在會先交代一個小任務,看看結果,再繼續往下做。只要開口要求,同一個 session 也能接著進入較長期的任務。 我會根據當月最好的模型擅長什麼,在同步與非同步之間切換。非同步工作能在我離開電腦時完成更多事情,但我會失去脈絡,最後只能在沒有前情的情況下,直接檢查一大份 diff。4.6 讓我重新偏向同步工作;如果我在意結果,這正是我比較希望採用的方式。 我也用 Remotion 為這兩個專案製作了一支 launch video!那幾週大多是一般的日常工作。它替我瀏覽網站,包括透過點擊 provider 的主控台來建立 API key。它也替正在執行的應用程式進行功能與視覺 QA。它把我的收件匣整理到只剩下幾個真正需要回覆的討論串,這種感覺永遠都很好。它還幫我草擬 Cursor SDK Bridge 和 /rename-chat 的 launch 貼文。 簡短提示詞,嚴格驗證 那幾週裡,我花了一部分時間比較不同的 prompting 風格。長提示詞與短提示詞之間的差異,以及像「work very hard」這類特定措辭是否會改變結果。我發現,措辭幾乎完全沒有影響。 長度確實有影響,但方式和我原本想的不一樣。長提示詞能換來更高的具體性,所以如果你確切知道自己想要什麼,就把它寫下來。短提示詞則會把更多決策交給模型自行判斷。過去,這種取捨會讓人傾向把所有事情都寫清楚。但 4.6 的判斷品味已經夠好了,通常只要一個短提示詞,再加上清楚的偏好,就能得到不錯的結果。 我給它一份詳細的 feedback widget 規格,包含工作階段擷取、伺服器端處理器和雲端 Agent 派送;它完整地端到端處理了整個專案,而且結構很合理。除非你要求它拆分元件,否則它確實會在不同元件中重複相同內容。手上有長規格時,長規格依然完全有效。 我做的其中一個專案是試算表應用程式,並且各自把同一個任務交給兩個模型兩次。第一次執行時,我提供了一份兩頁的規格,涵蓋我能想到的每個工具列項目、鍵盤快速鍵與公式。第二次則只給了三句話。 `text Build a polished Sheets/Excel-style app in Next.js and an AI chat that can analyze the sheet. Use the Cursor SDK for all AI features. Preload a realistic sample workbook so it looks good immediately. ` 兩個應用程式最後幾乎一模一樣。真正改變結果的,是多加了一句話: `text Verify the function and design after implementation, and keep on iterating and verifying until it's production ready. ` 那幾週裡,我找到最具槓桿效果的事情,就是這一行!加上這句後,模型會開啟應用程式,點擊實際的使用者操作路徑,確認巢狀公式是否正確計算,並修正它發現的問題。如果沒有穩定的瀏覽器操作能力,這些都無法運作,也就不可能形成這個迴圈。 當輸出比較難以檢查時,同樣的原則也成立。在 3D 場景上說「改善材質」完全沒有進展;但改成「擷取目前畫面、列出其中有哪些問題,然後只修正那些問題」,就立刻有效。 從這裡開始的每一次比較,都會在彼此隔離的 workspace 中,使用相同的提示詞交給兩個模型執行,因此後面的內容不是我對上個月結果的記憶。 Grok 4.5 介面中整合 Gridforge 試算表與右側 Gridforge AI 側欄的對照圖 展開畫面重點左側視窗標題顯示「Grok 4.5」,下方為 Gridforge 試算表介面,包含工作表名稱「Northwind Analytics – FY2026」、上方工具列(包含 AI 按鈕)、試算表儲存格內容(顯示 ARR 為 $5,136,000.00、MRR 為 $428,000.00 等財務指標)、左下角分頁標籤(Overview, Revenue, Funnel, Cohorts 等),以及右側的「Gridforge AI」側欄(標示「Cursor SDK - workbook-aware」),側欄內提供「Analyze workbook」、「Suggest formulas」、「Create chart idea」、「Presentation outline」等按鈕,以及輸入框文字「Ask about ARR, funnel conversion, cohorts, or request formula/chart/presentation help. Answers use the Cursor SDK when configured and cite workbook cells.」與底部輸入框。右側視窗標題顯示「Grok 4.6」,畫面為空白白色區域。 你也不需要告訴它要努力工作,或持續推進直到完成。它自己就會繼續執行一段不短的時間。更重要的是,你要說清楚「完成」代表什麼,否則它會替你決定。 進一步挑戰 我從小玩了多到不太合理的《世紀帝國 II》,累積了幾千個小時。所以我第一個想嘗試的專案,就是重現這款遊戲。我要求它製作一款瀏覽器策略遊戲,包含經濟系統、建造、戰鬥、戰爭迷霧、目標,以及一個新玩家不看說明也能讀懂的 HUD。 Grok 4.5 與 Grok 4.6 介面與遊戲畫面比較 展開畫面重點左側畫面標題為 Grok 4.5,上方顯示資源數值:木材 250、糧食 220、石材 120、人口 4/10,右上角顯示「HOMESTEAD AGE」。左側欄位為 OBJECTIVES(目標),包含: Gather wood near the Hall (已勾選) Build a Cottage for population (已勾選) Raise a Watch Barracks (已勾選) Train Spear-Guards (已勾選) Destroy the Raider Camp across the ford 下方中央為遊戲地圖,右下角為小地圖與操作提示(WASD / Drag pan、Scroll zoom、LMB select、RMB command、B build)。 右側畫面標題為 Grok 4.6,右上角播放控制列顯示暫停、播放倍速、時間 00:09 與 fps。上方顯示資源數值:木材 130、糧食 160、石材 80、礦石 60、人口 6/10。右側欄位為 OBJECTIVES(目標),包含: Stock the stores (Harvest 150 timber and 100 grain [lifetime gathered]) Raise the village (Complete 2 Cottages and a Yard.) Arm the vale (Field 6 Wardens or Slingers and research Bronze Edges.) Break the host (Raze the Cinder Outpost beyond the river.) 中央為等距視角遊戲畫面,帶有文字提示「Left-click a laborer or drag a box around your people.」。下方欄位左側為小地圖與「Vale map - click to pan」,中央為「NO SELECTION」與「Focus Hearthhall」按鈕,右側為「COMMANDS」(Select people or a hall to issue orders.)。底部顯示快捷鍵提示(LMB select、drag box、RMB command、WAS…
Embed this episode
NOW PLAYING
Grok 4.6 – 一份實戰指南
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.