影片把問題講得很直接:Claude 做完設計後,常常還是由同一段對話判斷自己有沒有做好。同一個 context 既負責執行又負責驗收,容易把原本的盲點一起帶進修改,結果就是人得一直補一句「再改好一點」。
Jack Roberts 示範的 gauntlet loop,會另外啟動三種 critic:The Brief 檢查有沒有照需求做、The System 檢查是否符合設計系統、The Craft 則看排版、視覺細節與完成度。每個 critic 都使用新的 context,不與原本的製作流程共享判斷;檢查沒過就退回修改,直到符合事先寫下的標準。影片把這件事形容成「讓品味變成一份檢查清單」。
來源:影片畫面擷取自 YouTube/Jack Roberts
他接著用三個難度示範成果:先從 Instagram carousel 的網址與參考風格做出一套 AI 工具圖卡,再用自己的設計系統生成 10 至 15 秒的 HTML 動畫,最後把一個網站概念改成可以操作的 404 頁面。這些都是作者自己的 demo,不是獨立比較測試,但足以看出這套方法的重點不是一個神奇 prompt,而是讓多次檢查與修改自動跑完。
來源:影片畫面擷取自 YouTube/Jack Roberts
代價是 tokens。影片其中一輪跑了 10 輪、共 31 次 critic,畫面列出的用量約為 73 萬 Haiku tokens 與 119 萬 Sonnet tokens;另一個 gauntlet loop 約用了 200 萬 tokens,互動式網站的示範則提到約 300 萬 tokens。作者因此建議把完整迴圈留給模板、hero asset 或之後會重複使用的大作品,小工作交給較便宜的模型處理,而不是每張圖都跑滿整套流程。
來源:影片畫面擷取自 YouTube/Jack Roberts
Claude Design just got 10X Better... I'm Done / Jack Roberts · 在 YouTube 觀看 ↗