TL;DR
脈絡視窗是 AI 任一時刻能「看見」的有限對話切片 —— 視窗之外的一切對模型而言等同停止存在。讓視窗保持小、乾淨、且專注於單一主題,AI 就會敏銳、快速、且便宜好用。
類比
別再把 AI 想成心智。請想像地球上最出色的櫃檯職員,在一張恰好四英尺寬的桌子前工作。
你送的每則訊息,都是一張放在桌子右緣的紙。而這位職員有一條不可打破的儀式:撰寫每則回覆前,都要重新閱讀桌上的每一頁紙 —— 從左到右,每次都是,毫無例外。 不略讀。沒有「我記得那段」。全面重讀,為每個答案,永遠如此。
現在是殘酷的細節:桌子永遠不會變大。 它在出廠時就是固定尺寸。當新的一頁送達而沒有剩餘空間時,最舊的頁面會從左緣滑落 —— 不是進抽屜,不是進檔案櫃,而是進碎紙機。職員不會哀悼它們。職員甚至注意不到它們不見了。
那張桌子就是脈絡視窗。當人們說「AI 忘了我的指示」時,沒有任何遺忘發生。承載那些指示的那一頁只是滑出了邊緣。職員依然出色 —— 只是桌子太滿了。
最後一個和你荷包有關的細節:這位職員按頁收費。由於每則回覆都需要重讀整張桌子,你留在那裡的雜物越多,你為每個生成的字詞付出的就越多。一張擁擠的桌子不只是混亂的職員 —— 還是一位昂貴的職員。
運作原理與 Uzu 的聊天槽
在底層,大型語言模型不會「記住」你的對話 —— 它每回合都重新閱讀。它能看見的文字以 token 計量(把一個 token 想成大約四分之三個字),而那個可見區域就是脈絡視窗。裝得下的會被讀取;裝不下的會被摘要化或丟棄。
以下是任一時刻實際擺在桌上的東西:
| 桌上有什麼 | 對你的意義 |
|---|---|
| 系統指示 | AI 的常設命令 —— 你還沒開口就佔了空間 |
| Persona 與角色 | 職員在每則回覆前重讀的角色卡 |
| 你最近的訊息 | 最新的頁面 —— 永遠完整可見 |
| AI 自己的回覆 | 沒錯,它也會重讀自己說過的話 —— 冗長的回覆會把你擠出去 |
| 附件與貼上的文字 | 桌上最重的頁面,遠遠超過其他 |
這正是 one-shot 提示這類技術如此有效的原因:一則完整、精確的指令會留在桌上,一回合又一回合地為你效力。這也是為什麼 few-shot 提示 —— 把成品範例貼進提示 —— 很強大但桌面空間昂貴:每個範例都是職員永遠重讀的一頁。
因為脈絡是資源,Uzu 應用就把它當資源對待。Uzu 會送出聊天中大約最後二十則訊息,並自動把較舊的回合壓縮成摘要 —— 把它想成一位職員定期把最舊的頁面釘成一份薄薄的摘要,讓重要的線索在桌子不溢出的情況下存活。而且 Uzu 刻意限制你能同時開啟的聊天數量,並隨你的等級擴展。每個開啟的聊天都是另一張你要花錢維護的桌子,所以死掉的對話不只是雜亂 —— 它們排擠了真正重要的工作。
經濟系統也是相連的:模型重讀的每個 token 都是已處理的 token,這就是為什麼乾淨的脈絡視窗比受污染的消耗更少 G-Credits。精確省錢兩次 —— 一次在你寫提示時,一次在之後的每一回合。
所以工作規則很簡單:
一張桌子,一個工作。 每個聊天一個主題,紙上只留 essentials,在雜物花你的錢之前先碎掉它。
常見陷阱
- 用一個永恆的聊天過完你的一生。 那個先規劃旅行、再問租約、又除錯食譜的聊天,是一張被無關紙張埋沒的桌子。每個新主題都值得新的聊天 —— 全新的桌子,完整的注意力。
- 重複仍然可見的指示。 如果你的 one-shot 提示落在十二則訊息之前、而對話仍然很短,重述它只是花 token 重述它。只有當規則明顯滑出邊緣時才重複 —— 對話冗長、限制消失。
- 貼上四十頁文件只為問一個問題。 任何桌上最重的一頁都是原始文件傾倒。先擷取相關段落,或使用專門的工具 —— 在 Uzu 中,附加的 PDF 會成為持久脈絡,被有效率地引用,而不是每則訊息都整份重新運送。
- 把視窗誤當記憶。 脈絡視窗是工作空間,不是儲存空間。它是桌子,不是硬碟 —— 關掉聊天,桌子就被清空。任何你想保留的都必須刻意保存(寫下來,或存成你的應用支援的記憶)。
- 和一個「忘了」的 AI 爭辯。 當模型牴觸舊指示時,它不是固執 —— 那一頁掉下了桌子。不要對抗症狀;重述關鍵限制,或開一個更乾淨的聊天讓它靠近頂端。
常見問題
什麼是 AI 的脈絡視窗?
脈絡視窗是 AI 模型一次能處理的最大文字量 —— 以 token 計量。它包含你的指示、對話歷史、AI 自己先前的回覆,以及任何附加文件。視窗之外的任何東西都無法影響當前答案,這就是為什麼冗長的對話終究會「失去」最早的指示。
為什麼 AI 會忘記我在同一個對話裡較早說過的事?
因為模型從未真正儲存它們 —— 它只重讀裝得進脈絡視窗的內容。隨著對話增長,較舊的交換會超出視窗而被摘要或丟棄。AI 不是粗心;最早的頁面確實離開了它的視野。
更大的脈絡視窗等於 AI 記憶嗎?
不,混淆兩者會造成無盡的挫折。脈絡視窗是暫時的工作空間:它隨對話存在而存在,且每回合重讀。記憶 —— 如某些應用提供的已存事實與回憶系統 —— 是獨立、刻意建立的儲存層,能在單一聊天之外存活。大視窗:更寬的桌子。記憶:檔案櫃。兩者你都需要,而且它們做不同的工作。
下一課
以下是沒人警告初學者的部分:當 AI 錯的時候,上述一切都依然運作完美。桌面乾淨時,模型牴觸你指示的機率較低 —— 但它仍可能以全然、平靜的自信陳述錯誤。那不是你提示的 bug。那是自信的錯覺,每個大型語言模型內建的面無表情,學會看穿它是 AI 中唯一最重要的防禦技能。
繼續下一課:自信的錯覺
離開前的練習:打開你持續最久的聊天,像桌子稽查員一樣閱讀它。哪些頁面還在賺它們的空間 —— 哪些在三個主題前就滑出了邊緣?乾淨地開啟下一個聊天,並在第一則回覆中注意差異。