CODEX APP PLUS
SLIDE 01 / 07
01
Codex App user seminar
3 tools · 1 workflow 給正在開發的人

Token 很貴,
不要讓 agent 一直繞路。

開發做到一半,最痛的不是 agent 不會做;是它忘了自己做過什麼、每個小工都重讀一遍、明明可以並行卻全部排隊。這場 seminar 用三個工具,把昂貴的脈絡留給真正需要思考的地方。

少重讀 少重複 多平行
地圖先留路徑,工班再分頭施工,最後由主 agent 驗收。
今天的主題:把 token 花在產出,不要花在迷路。 往下或按 →
02
The pressure is real

你感受到的 token 壓力,很多時候不是功能太多。

而是 agent 一直在付「重新找路」的費用:重新讀工具輸出、重新確認已做過的決定、重新把同一份背景交給另一個 worker。

長任務不是一篇 transcript;它其實是一條走過的路。

如果只留下結論,下一次 resume / compaction 後,agent 仍可能忘記「為什麼會走到這裡」。
01 / INPUT開始做任務目標、限制、要改哪裡
02 / OUTPUT工具吐出很多東西log、diff、測試結果
03 / COMPACT脈絡被壓縮只剩下模糊印象
04 / REREAD再走一次重新找證據、重新確認
05 / LOOPtoken 又花一輪真正的實作反而更慢
核心洞察不是叫 agent「記住全部」,而是讓它知道:目前走到哪裡、證據放在哪裡、下一步該做什麼。
脈絡重複 同工重讀 平行機會消失
03
The toolkit in one picture

三個工具,不是三個零件。
是一條比較省力的工作流。

先把路線留下,再決定要不要分工;要分工時,叫一個真正能動手、但不搶走主 agent 最終判斷權的 worker。

01 / MAP

任務地圖

context-canvas-codex

把目標、決策、依賴、blocker 與驗證節點留在本機;大塊證據用指標回到原始檔案,遇到 meaningful checkpoint 再做一次 bounded reflection。

少走冤枉路
02 / DISPATCH

工班調度器

baton-fanout-skill

不是看到大任務就亂派 worker;先判斷獨立性、寫入所有權與收尾方式,再用最小可靠拓撲平行施工。

少做無效分工
03 / TOOLKIT

工程技能正本

smart-agentic-engineering-toolkit

把 planning、review、測試、delegation、recovery 與 release evidence 放在單一 canonical repo;這裡只保留版本鎖定 pointer。

少一份漂移副本
04
01 / Context Canvas Codex

給 agent 一張
會留證據的任務地圖。

把 agent 想成在走迷宮:走著走著,可能忘記自己已經探索過哪一條路。地圖把「目前的形狀」留在手邊,讓它更快回到正確路線。

1
Keep the shape留下目標、決策、依賴與下一步,不把整本日記塞回腦袋。
2
Keep the receipts短摘要指回原始 diff、測試或研究結果;需要時再回去看證據。
3
Resume with a route遇到 resume、compact、handoff,不用從零猜「我們做到哪裡」。
好懂的比喻:像網頁 cache 一樣,熟悉的地形不用每次重新勘探;走到岔路時再重驗證據,選一個 bounded 的繼續、調查或升級方向。Reflection 只是建議,不會接管 agent。
goal / exit ref / original evidence
點一個節點:地圖不是漂亮的圖,它是下一次回來時的路標。
05
02 / Baton Fanout Skill

主 agent 負責設計與監工,
不必親手砌每一塊磚。

蓋房子時,設計師要守住格局、品質與安全;真正砌牆、搬磚、鋪線,可以交給專門工班。Baton 的重點不是「多派幾個」,而是先踩煞車、再做值得的 fan-out。

SUGGESTED CODEX APP SETUP
GPT-5.6-terra / high主 Codex agent
設計、監工、收斂
baton-fanout-skill先判斷是否值得
再決定怎麼分工
spawn: luna / max原生 per-spawn override
在明確邊界內施工
01 / OUTCOME要交付什麼?
02 / DIRECT主 agent 自己做更快嗎?
03 / INDEPENDENCE工作真的獨立嗎?
04 / OWNERSHIP誰擁有每個寫入?
05 / CLOSURE誰整合、驗收、報告?
主 agent / Architect設計圖、邊界、最後判斷
Worker A整理資料層
不碰 UI
● READY
Worker B補一個 bounded patch
不碰 shared config
● BUILDING
Worker C跑獨立檢查
只回報證據
● CHECKING
06
03 / Native Subagent Routing

Codex 已能原生派 Luna,
不用再繞一層 CLI bridge。

MAIN AGENT已收斂的施工 brief目標、驗收條件、允許路徑與禁止寫入
NATIVE SPAWNLuna / max workermodel 與 effort 直接成為 subagent 參數
RETURN主 agent 驗收重讀實際 bytes、檢查 scope、跑 focused tests
Worker 回來了→ 還不是完成;完成要等主 agent 重新讀檔、驗證與收斂。

Codex 的 [agents] defaults 是省略參數時的 fallback;真正需要依 task class 路由時,由 Baton 判斷後在原生 spawn 明確指定 modelreasoning_effort。穩定 codegen 與低判斷力 scout 可先用 Luna/max,高風險判斷仍留給合適的 Terra/Sol lane。

1
Task class first先判斷 Luna/max 是否足夠;不拿便宜模型承擔架構、安全或 release judgment。
2
Explicit native routespawn 直接帶 model/effort;每個 writer 都有 exclusive paths 與 stop conditions。
3
Main agent closes the loop主 agent 自己檢查 proposal、套用、跑測試,最後才對結果負責。
native subagentexclusive ownershipverify centrallyno blind retry
07
The three-tool loop

三個工具合起來,
省的不是思考,是重複的來回。

下面是概念示意,不是 benchmark。用來說明「工作形狀」怎麼改變。

01任務進場把目標講清楚
02留下路線知道已經走過什麼
03平行施工只拆真正獨立的工序
04驗收收斂主 agent 對結果負責
08
Your next Codex task

想開始?
把這句話貼給 Codex。

依各自 canonical source 安裝,再回到你的下一個長任務:讓地圖守住脈絡、讓 Baton 決定分工,讓 engineering toolkit 提供可驗證的施工與收斂流程。

01Map first先知道自己走到哪裡
02Fan out with brakes只把值得平行的工序拆開
03Verify centrally最後判斷永遠留在主 agent
INSTALL PROMPT / COPY THIS
我想依 canonical sources 安裝:1. https://github.com/phenomenoner/Chatgpt-Codex-App-Plus 的 context-canvas-codex;2. https://github.com/phenomenoner/baton-fanout-skill 的 baton-fanout-skill;3. https://github.com/phenomenoner/smart-agentic-engineering-toolkit 的 commit e64c60f946fb42289ffaabecd59660a4940c0826,驗收回報須區分模擬、回放與真實派工,列明預算及人工步驟。不要從舊 bundle 複製 toolkit skills。
TIP 01 / VISUAL
Codex 也可以直接幫你生圖

要做圖卡時,可以跟它說:「請製作一張 Infographic,並使用『圖文一體』生成,讓文字和畫面一起完成。」

TIP 02 / READABLE
把任務結論整理成可打開的頁面

請 agent 把重點結論、待確認事項與下一步整理成 HTML,直接用瀏覽器開,閱讀、展示和分享都更方便。

TIP 03 / REUSE
把好用的流程整理成 skill

如果某個流程以後還會用到,請 agent 整理成 skill,標註適用情況與範圍;確認適合長期共用後,再全域安裝,方便日後自動參考。