YTGET

貼上影片網址

YouTube 影片筆記

換任務就開新對話,三招有效控管AI額度消耗

原片標題:AI 額度老是不夠用?三招省 Token 的實戰方法

我原本以為省 Token 就是叫 AI 回話簡短一點,結果 Gary 直接點破這招根本沒用,因為對話視窗早就累積幾萬個 Token 了,你省那幾個字根本是杯水車薪。這支影片把每次送出指令時背後被塞進去的四層 Context 拆開給你看,看完才懂額度為什麼燒這麼快。

系統把四層 Context 打包塞給 AI
系統把四層 Context 打包塞給 AI00:50
  1. 00:46拆解每次送出指令時,背後被塞進去的四層 Context
  2. 02:58破除「Prompt 寫短一點」的迷思,真正該控管的是整包 Context
  3. 03:56第一招:換任務就開新對話,別讓舊進度繼續燒額度
  4. 05:14第二招:精簡掛載的 MCP Server,工具說明文件超吃 Token
  5. 05:57第三招:先搜尋再餵給模型,別把整份 PDF 直接丟進去
  6. 07:03自動壓縮不是萬靈丹,重要規格要自己整理成 Markdown
  7. 07:58第三動作:用 Prompt Caching 讓輸入成本直接打一折
  8. 09:31送出前問自己兩個問題,判斷該開新對話還是繼續聊
編輯錯誤指令取代重新回覆
編輯錯誤指令取代重新回覆05:04

換任務就開新對話,別讓舊進度繼續燒額度

很多人習慣一個視窗聊到底,剛改完登入功能又順手丟一份不相干的報表進去。但模型還背著上一段任務所有的程式碼跟報錯紀錄,等於每問一句新問題都在為舊進度白燒額度。Gary 說得很直接:任務告一段落就果斷開新視窗,讓 AI 從零開始,這是最立竿見影的一招。

果斷開新視窗讓 AI 從零開始
果斷開新視窗讓 AI 從零開始04:35

先搜尋再餵給模型,別把整份文件丟進去

處理大專案時,很多人習慣把上百頁 PDF 或幾千行程式碼整包丟給 AI 自己撈。但如果問題有明確的關鍵字或錯誤代碼,先用搜尋工具找出最相關的段落,只把真正需要的內容餵進去,每次請求的 Token 就能從好幾萬瞬間降到幾百。這個動作多花不到一分鐘,省下的額度卻很可觀。

只把搜尋到的相關段落餵給 AI
只把搜尋到的相關段落餵給 AI06:16

Prompt Caching 是省錢關鍵,但要注意快取壽命

Claude 或 OpenAI 都有 Prompt Caching 機制,以 Claude Opus 5 為例,命中快取後輸入價格直接打一折。但要吃到這個優惠有兩個前提:同一個 session 不能空超過一小時,中途也不要換模型或調整思考強度,否則快取全部失效,等於整段對話從頭重算一次全額。

值得下載嗎

值得,這支影片把省 Token 從「省錢」提升到「清理 AI 工作環境」的層次,三招都是日常就能立刻上手的操作習慣,看完馬上能改善你的額度焦慮。

這支影片值得下載收藏嗎?
本文由 AI 依影片字幕整理,未經人工複核,內容以原片為準。

連線中

擷取畫面

輸入時間點,例如 3:20、3.20 或 200

影片皆已含音訊。檔案越大準備時間越久,完成前請保持頁面開啟。

加到書籤列,看影片時一鍵解析

把右邊這顆按鈕拖曳到瀏覽器的書籤列。之後在 YouTube、Facebook、X 的影片頁面按一下,就會直接跳來這裡解析,不用複製貼上網址。

YTGet 下載

瀏覽器基於安全考量會擋下直接點擊,請用拖曳的方式加入。 手機請改用瀏覽器的「分享」功能開啟本站再貼上網址。

YTGET·影片筆記