我一直在開發 devpub,這是一個開源 CLI,用來發布和追蹤 Dev.to 上的文章。上週我在 Cursor 裡新增一個分析功能,進入了完整的 vibe coding 模式,連續快速下提示:
「為 API 用戶端加入快取。」
「修好速率限制器。」
「讓分析更快。」
三個提示,立刻產生三段程式碼。我繼續往下做。兩天後我才發現,所謂的「修好」其實悄悄破壞了我的重試邏輯;所謂的「快取」根本沒有失效策略;而「更快」則是代理把用來防止 Dev.to 封鎖我 API 金鑰的安全節流給拿掉了。
這些提示裡都沒有說清楚哪些不能改。也都沒有指定我怎麼知道它真的做對了。我是在順著思路寫的,而代理也確實做了我要求的事。只是那不是我真正的意思。
就在那時,我試了 NexPath,一個給 AI 程式碼代理用的提示品質層。它夾在你和代理中間,當你送出含糊提示的瞬間先攔下來,並提供一個更強化的版本。我當時想:何不拿 devpub 來試試?這是一個我非常熟悉的真實程式碼庫,還有我真的會打出來的真實提示。如果它在這裡有效,那它在哪裡都有效。
每個使用 AI 程式碼代理的開發者,都有一個類似的故事。不是因為這些代理很差。恰恰相反,它們非常擅長把你給的內容變成程式碼。問題在於我們給了它們什麼。
「修好這個。」 「讓它能跑。」 「整理一下程式碼。」 「加上驗證。」
這些提示看起來很有效率。代理立刻回應。程式碼出現。你接著做下一件事。但六個提示之後,你的程式碼庫已經朝著你沒規劃的方向長了,帶著你沒明說的假設,跳過了你沒要求的檢查。
同樣的錯誤一再重演:沒有驗收標準、沒有回滾計畫、沒有提到哪些不應該改。不是因為我們不懂,而是因為順著節奏做事時,很容易省略這些步驟。
我原本以為答案是更有紀律一些:更會寫提示,每次都寫得更長、更詳細。
這個想法大概只維持了三天。
NexPath 不是另一個程式碼代理。它不會產生程式碼。它不會取代你的代理。它也不試圖耍聰明。它夾在你和 AI 代理之間,當你送出一個含糊的提示時,它會先暫停一下,然後說:「這裡有一個更符合你意思的加強版。要不要改用這個?」
我最簡單的說法是:NexPath 是那個防止 AI 產生的程式碼變成一團亂的東西。
工作流程如下:
你的原始意圖在整個過程中都保持可見。沒有任何內容會在未經你同意下自動送出。如果提示不需要強化,NexPath 就會保持安靜。
當強化機制啟動時,它不是重寫你的提示,而是用以下內容包住你的原始需求:
這裡有一個我在 devpub 測試時的真實例子。我輸入了:
修好速率限制器
NexPath 把它強化成類似這樣:
修正 DevtoClient._throttle() 中的速率限制器。範圍:只修改 src/devpub/api/devto.py 中的時間戳追蹤邏輯。不要變更 RATE_LIMIT_REQUESTS 或 RATE_LIMIT_WINDOW 常數。不要修改 _request() 裡的重試邏輯。驗收:仍然維持 30 秒視窗內 30 次請求的限制,且不會有超過 30 秒的 sleep。驗證:修改後執行 pytest tests/test_api.py。
這才是我一開始就應該寫的內容。但我沒有,因為我當時正在順著思路做事。
再來一個。我輸入了:
把所有草稿都以已發布狀態推送到 dev.to
NexPath 標示出風險並補上:
將所有草稿文章推送到 Dev.to,並將 published 設為 true。警告:這是破壞性操作。已發布文章會立即對讀者可見,而且不容易取消發布。範圍:只修改文章 payload 中的
published欄位。安全:先列出所有受影響的文章,並在繼續前確認數量。回滾:記錄所有被修改的文章 ID,以便必要時恢復為草稿。驗證:發布後檢查每個文章 URL 是否回傳 200。
「直接做」和「小心地做」之間的差異,會在最恰當的時機浮現出來。
我在兩個環境中測試 NexPath:一個是在我筆電上的 Cursor,用來體驗 devpub 的彈出視窗;另一個是在我的 EC2 伺服器上的 Claude Code,用來壓測 CLI 並深入查看內部運作。
git clone https://github.com/hi0001234d/nexpath.git
cd nexpath
npm install # 16 秒,298 個套件
npm run build # 建置 + 1,175 項測試驗證
npm link
nexpath install # 自動偵測我的代理,寫入 hooks
nexpath status 指令會給你完整資訊:提示儲存統計、hook 活動、設定狀態、環境偵測等。這個 CLI 的可觀測性程度讓我有點意外。結構化 JSON 日誌、正確的錯誤程式碼、可除錯的輸出。
隱私做得不錯。 所有資料都放在 ~/.nexpath/。一個 SQLite 資料庫在本機儲存你的提示。唯一對外的呼叫是到 OpenAI API(用 GPT-4o-mini 做分類)。遙測預設關閉,而且在設定中已確認。秘密資訊遮罩會自動把儲存的提示中的 API 金鑰移除。
工程品質紮實。 來自三人團隊,卻有 1,803 個 commit。只有 VS Code 擴充功能就有 1,175 項測試。結構化記錄。環境偵測(作業系統、WSL、CI、devcontainer)。具備 keychain 整合的完整設定系統。這不是那種週末黑客松做完 demo 就丟著不管的專案,雖然它確實起源於那裡(MLH 的 AI Hackfest 2026)。
它知道什麼時候該閉嘴。 系統會把你的提示分類到不同開發階段(想法、架構、實作、測試等),只有在偵測到階段轉換或缺少某些訊號時才會介入:例如缺少規格、跳過測試策略、採取高風險捷徑。當你的提示已經很有結構時,它就不會打擾你。
彈出視窗體驗真的順。 在 Cursor 裡,你輸入提示、按下 Enter,NexPath 會先停一下。彈出視窗顯示你的原始提示與強化版。你選一個,它就自動送出。沒有情境切換、沒有複製貼上、沒有額外視窗。它很自然地融入工作流程,而不是打斷它。
環境感知非常完整。 nexpath env 指令會在本機探測你的作業系統、辨識 WSL、devcontainer、CI pipeline、shell 類型、專案框架、版本控制、測試執行器與部署設定。它會利用這些上下文來調整何時以及如何介入。這種情境感知在開發者工具中非常少見。
API 金鑰處理還有一點不順。 NexPath 需要 OpenAI API 金鑰(用於 GPT-4o-mini)。他們的文件說,當沒有金鑰時,會優雅地退回到本機分類。實際上,在第一個提示之後,後續呼叫會拋出未處理的 OpenAIError: Missing credentials 例外,而不是安靜地降級。這是 v1 階段的邊緣狀況,很容易修,但如果你在沒有先設定金鑰的新機器上安裝,這點值得注意。
CLI 建議機制和 VS Code 彈出視窗是兩個不同系統。 送出時的彈出視窗(Cursor/Windsurf)是主要產品。它會在你按下 Enter 的瞬間攔截每個提示。Claude Code 的 CLI 建議機制則是另一套機制,會先累積 session 歷史再介入。在我的 CLI 壓測中,它記錄了 18 個提示,卻一次都沒有介入,因為它需要更長的 session 上下文才能偵測出有意義的轉換。彈出視窗沒有這個限制。它會獨立評估每個提示。如果你用的是 Claude Code,體驗會比 Cursor/Windsurf 的彈出視窗安靜得多。
目前只有單一 LLM 供應商。 它現在使用 gpt-4o-mini 作為分類模型,這是很合理的 v1 取捨,但對於已經使用其他供應商的團隊來說,彈性會受限。API 成本很低(一天只要幾分美分),但如果能支援多供應商,對已經有 Anthropic 或 Groq 設定的團隊會更友善。
| 代理 | 狀態(2026 年 8 月) |
|---|---|
| Claude Code | ✅ 透過 CLI + MCP hooks 支援 |
| Cursor | ✅ 透過 VS Code 擴充功能支援(送出時彈出視窗) |
| Windsurf / Devin | ✅ 透過 VS Code 擴充功能支援(送出時彈出視窗) |
VS Code 擴充功能(給 Cursor 和 Windsurf 用)會在送出時攔截提示,並直接顯示彈出視窗。Claude Code 則是透過 CLI 的 hook 系統,在每次提示送出之間觸發。
要注意的重要差異是:Cursor/Windsurf 的體驗是經過打磨的那一個。你輸入、按 Enter、NexPath 攔下來、顯示彈出視窗、你選擇、它送出。Claude Code 則是透過終端機 hook 運作,視覺感較弱,但功能上可用。
如果你符合以下情況,NexPath 會很有意義:
如果你已經能持續寫出詳細、有結構的提示,或你是在做不太需要品質的小型原型,那它的幫助就比較有限。
NexPath 本身是免費的(Apache 2.0,開源)。唯一的費用是你使用 OpenAI API 金鑰帶來的 GPT-4o-mini 用量。以一般的程式開發 session 來說,大約每天是 0.01 到 0.05 美元。幾乎可忽略,但不是零。
NexPath 解決的是我自己的問題:我在順著思路時常會寫出偷懶的提示,而那些偷懶的提示會產生日後反咬我的程式碼。能在送出當下,而不是出事之後,先攔下來的品質層,這個想法真的很有用。
我在 devpub 上測試了它,這是我自己的開源專案,有真實的 API 用戶端、真實的速率限制、真實的上線推送流程。我平常會隨手下的提示(像是「修好速率限制器」、「把所有草稿以已發布狀態推送」)都被加強得更明確、更有範圍,也更安全。這就是它的價值。
它在 Cursor/Windsurf 上的實作(送出時彈出視窗、選擇版本、自動送出)設計得很好。Claude Code 的 CLI 體驗還需要更多打磨。底層工程很認真,隱私模型也很誠實,而且團隊出貨速度很快(上線前 48 小時內就合併了 20 多個 PR)。
它完美嗎?不是。API 金鑰處理還有點粗糙。單一供應商模式限制了彈性。CLI 建議機制需要更長的 session 才會啟動。不過對一個來自三人團隊、版本號是 v0.1.4 的開源工具來說,它是在對的地方解決對的問題,而 Cursor/Windsurf 的彈出視窗體驗也確實做得很不錯。
我會繼續裝著它。它第一次攔下我原本會不假思索送出的危險提示時,就已經值回票價了。
自己試試看:
NexPath 正在舉辦 Launch Feedback Challenge(到 2026 年 9 月 2 日結束)。他們想要的是誠實回饋,不是稱讚。如果你試過之後有任何想法,不管好壞,歡迎到 他們的討論串 分享。
你對提示品質的做法是什麼?你每次都會寫很詳細的提示,還是也會掉進「修好這個」的陷阱?歡迎在留言區告訴我。
歡迎追蹤我,了解更多 AWS 架構、DevOps 和 AI 基礎架構相關內容:
作品集 | LinkedIn | Dev.to | YouTube | Email | AWS Builder Center | X