三個角色,一份流程
Claude/Codex:用對話建立與修理流程
你告訴它要查哪個網站、哪些條件會改、想看到什麼結果。agent 讀懂網頁後,把操作寫成流程,試跑並請你確認;壞了再用對話修理。目前完整使用路徑以 Claude Code 實測,Codex 尚待驗證。
Kav:照著方法做,核對有沒有完成
Kav 是在你電腦上執行的程式。它開啟專屬 Chrome、填欄位、送出查詢,再檢查輸入是否填對、結果是否符合流程設定。無法證明完成時,就回報原因與截圖。
判斷題交給 Claude;Kev 是選配
引擎先抓好文字,再交給 Claude 理解口語條件、比較候選。Kev 只在 pick 文字比對不唯一、需求為單一屬性時選用;沒有 Kev 或無法選定就停下交回 Claude。591 實驗顯示兩條件與比較級仍不適合 Kev。高鐵、台銀抓資料都不經模型。
少掉的,是重複摸索與往返
每次查詢仍會打開網站、取得當次資料。不同的是,固定的填表、送出和讀表交給 Kav 在一次工具呼叫內執行,Claude 不用每一步都重新看畫面、決定動作。結果以有欄名的資料回來,Claude 再整理成回答。
高鐵既有實測的 Kev 呼叫為 0,加速來自可重用流程與本機程式。看工具呼叫、流程宣告與回傳內容。
第一次確認,之後重用
- 說出需求。指定網站、會變動的條件與預期結果。
- 試跑看看。Claude 建立流程,Kav 試跑,讓你確認結果是否正確。
- 存起來。確認後成為可重用的流程。
- 換條件再用。下次只說新日期或站名,不必重新摸索每一步。
流程本身是資料,不是要求你維護的程式。仍需要安裝環境,以及能呼叫工具的 Claude Code。
網站變了,就說哪裡不對
例如「結果不對,這個才是抵達時間」。Claude 依流程方法檢查、修正並重跑,再回報改了什麼。
這項能力還在驗證。目前修復只在一個網站、兩種壞法上盲測;不能據此保證所有改版都能自動修好。
說不清楚,也可以示範
錄製功能讓使用者在 Kav 的 Chrome 操作一次,標記要的結果,再把示範轉成流程。第 1 階段高鐵真人驗收已通過;多步驟與用示範修流程仍待真人驗收,已於 2026/10/07 暫停;591 示範發現的兩個轉換缺口尚未修復。
知道邊界,才用得安心
- 不替你登入、付款、下單或破解驗證碼。
- 網站阻擋自動化時會停止並說明原因。
- 執行與程式驗證在本機,不等於所有資料都留在電腦。Claude 仍可能透過雲端處理需求與工具結果。
- 程式核對的是流程宣告的條件;不代表模型最後的回答一定不會誤讀。
- 目前主要在 Mac 與 Claude Code 上實測,其他環境有待驗證。