小說卡文怎麼救?舊稿丟回去叫 AI 續寫只會更爛,我救斷頭稿的 4 步

目錄

💡 核心結論速覽 (TL;DR)

  • 小說卡文最沒用的一招,就是把整包舊稿丟回去叫 AI 續寫:Anthropic 官方工程文件把這個現象叫 context rot——脈絡窗裡的 token 越多,模型準確回想其中資訊的能力就越差,而且「這個特性在所有模型上都會出現」。
  • 第 1 步不是續寫,是 compaction:官方定義是「把接近上限的內容摘要後,用摘要重開一個新的脈絡窗」,並且明講它是第一道槓桿。對小說來說=保留已成立的設定與沒收的伏筆,丟掉重複的場景描寫。
  • 風格對齊靠三家的「設定層」,不是靠形容詞:ChatGPT 自訂指令 Free/Go 只有 1,500 字元、Plus 以上 5,000 字元;Claude 免費帳號最多建 5 個 Projects(同一頁官方卻又寫 paid plans only,自己打架);Gemini 官方把 Gem 指令拆成角色/任務/背景資訊/格式四段。
  • 先做這件事再開工:打開你的斷頭稿,只做第 1 步——把它壓成一張「已成立事實+未收伏筆」的清單。壓不出來,代表卡的不是 AI,是你自己還沒決定故事要往哪走。

那份稿子還在資料夾裡。八萬字,最後一次存檔停在某一章的中間,主角剛推開門,然後就沒有然後了。

小說卡文最痛苦的不是寫不出來,是「我明明寫了這麼多,卻不敢回去看」。而多數人回去看的第一個動作,是把整個檔案複製起來丟給 AI,說「請接著往下寫」。我也這樣做過。拿回來的東西通常有兩種:一種是把前面某個路人寫成了主角的青梅竹馬,另一種是語氣突然變得很有禮貌,像是換了一個人在寫。

問題不在你的稿子不夠好,也不在模型不夠強。小說卡文後要救回斷頭稿,關鍵不是找更強的模型,而是先把舊稿壓縮成一份模型讀得完的文件——因為脈絡越長,模型準確回想其中細節的能力越差。

你以為你把整本書「交給」它了,實際上你只是把一堆字倒進一個會越讀越模糊的空間裡。這篇我把自己救斷頭稿的四步拆開講,並且對照三家官方文件裡真的查得到的規格。順便回答一個很多人沒想過的問題:為什麼餵得越多,反而寫得越差?


小說卡文時,把整包舊稿丟回去為什麼反而更糟?

把八萬字整包貼回去給 AI,得到的結果通常比只貼最後兩章更差,原因是模型的注意力是有預算的,不是塞越多讀得越熟。這件事有官方說法,而且講得比創作圈清楚很多。

Anthropic 在一篇談脈絡工程的工程文章裡直接給了名字:context rot。原文的意思是,隨著脈絡窗裡的 token 數增加,模型從那段脈絡裡準確回想資訊的能力會下降;有些模型衰退得比較平緩,但這個特性在所有模型上都會出現。同一篇還講了另一件我覺得更有畫面的事:LLM 和人一樣有「注意力預算」,每多一個 token,就多消耗一點這個預算。

為什麼會這樣?官方給的解釋是架構層面的。Transformer 讓每個 token 都能注意到其他所有 token,n 個 token 就產生 n² 對關係;脈絡越長,捕捉這些關係的能力就被拉得越薄。還有一句更少人提到的:模型的注意力模式是從訓練資料的分布長出來的,而訓練資料裡短序列本來就比長序列常見,所以模型對「橫跨整篇的依賴關係」經驗較少、專用參數也較少。

翻成寫小說的話:你的第 3 章埋的伏筆和第 47 章的回收,剛好就是模型最不擅長的那種「跨整篇的依賴關係」。你把全稿丟進去,等於押在它最弱的能力上,然後怪它記性差。

我自己是繞了一段冤枉路才承認這件事的。剛開始卡稿時,我的直覺反應是換模型——同一份稿子換一家丟進去,崩的地方換了位置,數量沒有變少。那時候才願意面對:需要修的不是它讀的能力,是我餵的方式。如果你想先看看不同模型在長篇上到底差在哪,我在同一組題目餵給六家模型的那輪對照裡整理過,但先說結論——換模型解決不了餵法的問題。

這段你可以帶走的判斷:如果你已經試過「整包丟回去」而且結果不理想,不要再試第二次、也不要急著加錢升級方案。接下來三步要做的事,全部都是在減少你丟進去的量。


第 1 步:小說卡文後先做 compaction,不是叫它續寫

救斷頭稿的第一步不是叫 AI 續寫,是把舊稿壓縮成一份可以取代它的文件。這個動作有正式名字,叫 compaction

Anthropic 的定義寫得很直白:把一段接近脈絡窗上限的內容拿去摘要,然後用這份摘要重新初始化一個新的脈絡窗;官方還特別說,compaction 通常是脈絡工程裡「第一道槓桿」,目的是讓長線的一致性變好。重點在「重新初始化」這四個字——不是在舊對話後面接著講,是開一個乾淨的新場,只帶著摘要進去。

更有參考價值的是官方講的取捨標準。他們在自家工具裡的做法是:保留架構決策、還沒解決的問題、實作細節;丟掉重複的工具輸出與訊息。把這條規則換成小說的語言,我自己是這樣分的:

壓縮時 小說裡對應的東西 為什麼
一定要留 已成立的設定決策(誰死了、哪條規則不可違反、哪段關係已經翻臉) 這些一旦被改掉,後面全部要重寫
一定要留 還沒收的伏筆與懸而未決的問題 對應官方的「未解決的問題」,是續寫時唯一的方向感
一定要留 影響後續的細節(信物、傷疤、口頭禪、某人不知道某事) 對應官方的「實作細節」,崩最多的就是這一格
可以丟 重複的場景描寫、同一種情緒的第三次鋪陳 對應官方的「重複輸出」,占字數但不帶新訊號
可以丟 你自己已經打算刪掉的段落 留著只會讓模型把它當成既定事實

那大綱要壓到多細?官方也有講,而且用了一個很好記的說法:right altitude,中文可以理解成「站在對的高度」。它是兩種失敗模式中間的甜蜜點——一端是把複雜邏輯寫死成一長串脆弱的規則,另一端是給一堆空泛的高層指引,假設對方早就懂你在說什麼。官方對「好的脈絡」下的定義更是一句可以貼在桌上的話:找出能讓期望結果發生的最小高訊號 token 集合

白天寫 PRD、晚上寫小說的我對這句特別有感。寫需求文件時我早就知道,把每個邊界條件都寫死的規格書最後沒人看得懂,但只寫「要做得好用」也等於沒寫。小說大綱一模一樣:把每章都寫成三百字流水帳,模型會照著抄成沒有呼吸的東西;只寫「男主終於原諒她」,它會自己編一整章你沒同意的過程。

我實際的做法是這三步:

  • 開新對話,只丟舊稿,指令是「不要續寫,把它壓成三份清單:已成立的事實、還沒收的伏筆、會影響後面的細節」
  • 自己逐條看過,把它記錯的改掉——這一步不能跳,它一定會有記錯的
  • 把改好的清單存成獨立檔案,從此以後只餵這份,舊稿收起來

下一步:現在就打開你的斷頭稿試第 ❶ 步。如果壓出來的「未收伏筆」那欄是空的,恭喜你找到真正卡住的原因了——不是 AI 寫不出來,是故事本身沒有懸念在推。


第 2 步:風格錨點怎麼抽?形容詞是最沒用的那種指令

小說卡文之後最常見的第二個症狀,是續出來的段落「意思對,但不是我寫的」。要修這件事,關鍵是別再用形容詞描述你的文風,改成抽出三種可以被驗證的東西。

「溫柔細膩」「冷冽克制」「大氣磅礴」——這類詞對模型來說訊號極弱,因為它們不可驗證。你我心中的「細膩」根本不是同一件事。我自己抽風格錨點只抽這三格,因為這三格都能用「有沒有做到」直接檢查:

  • 句子的物理特徵:你的段落通常幾句話?對話占多少?有沒有慣用的斷句方式(很多人自己沒發現,自己的稿子裡逗號多到嚇人)
  • 敘事距離:你習慣貼著角色的意識寫,還是站遠一點看?——這一格改變了,讀者立刻會覺得「換人了」
  • 你的禁區:你從來不寫的東西。我自己的禁區是「角色把心裡話全部說出來」,一旦 AI 讓角色把動機解釋得清清楚楚,那段一定要重寫

抽的方法很省事:挑三段你自己最滿意的原稿,丟進去問它「這三段在句長、敘事距離、資訊揭露方式上有什麼共同點」,然後把它的答案當草稿,自己改。它會講一些漂亮但沒用的話,那些刪掉;留下你看了會點頭的那幾條。這份東西就是你的風格錨點,之後每次開新場都要帶。

如果你想更系統地處理不同類型的語感差異,言情、懸疑、武俠這幾種類型各自真正卡住的地方我另外拆過一篇,那篇的重點在「怎麼寫指令」,這篇的重點在「怎麼從你既有的稿子反推」,方向剛好相反。

下一步:先把「你的禁區」那一格寫出來,一句話就好。這格通常是三格裡最快寫完、也最能立刻擋掉爛續寫的一格。


第 3 步:三家的設定層放哪?官方上限對照(Claude、ChatGPT、Gemini)

Claude、ChatGPT、Gemini 三家消費端都有「設定層」,可以把大綱和風格錨點存成長期設定、不必每次對話重貼一遍,但三家的字元與檔案上限差很多,官方公布的詳細程度也不一樣。這是我實際去讀官方說明頁整理出來的:

設定層 Claude ChatGPT Gemini
帳號層(套用到所有對話) Instructions for Claude,官方未公布字元上限 自訂指令:Free/Go 1,500 字元;Plus、Pro、Enterprise、Business、Education 5,000 字元 個人化設定,官方未公布字元上限
專案層(只套用該專案) Project instructions;免費帳號最多建 5 個 project Projects,專案數不限 Gem,官方未公布數量上限
可帶檔案數 官方未公布專案檔案數上限 Free 5/Go・Plus 25/Edu・Pro・Business・Enterprise 40,同時最多上傳 10 個 可上傳檔案當背景資訊,官方未列數量
官方給的指令結構 Skills:官方原文寫「套用基於你自己的寫作或偏好的溝通模式」 未提供固定結構 角色/任務/背景資訊/格式四段

這張表裡有三件事值得單獨拉出來講。

第一,Claude 的官方說明頁自己在打架。同一篇文章的中段寫「Projects 對所有使用者開放,包含免費帳號,免費使用者最多可以建立五個專案」,但同一頁最後的「怎麼選功能」段落卻寫「當你需要針對特定專案的指引時,使用 project instructions(僅限付費方案)」。一頁之內兩種說法。

我不知道哪個才是現行狀態,所以我兩個都貼給你——如果你是免費帳號要靠專案存設定集,登入自己點一次比讀任何說明都準。這種官方自己講不清楚的地方,其實也是我後來養成「凡事自己點一次」習慣的原因。

第二,ChatGPT 那個 1,500 字元真的很緊。如果你用的是免費方案,想把整份風格錨點塞進帳號層的自訂指令,大概寫到「敘事距離」那格就滿了。這是一個很少人算的成本差異——不是算誰的模型比較聰明,是算「我的設定寫不寫得下」。想知道各家方案的額度到底怎麼算,我另外寫過把週額度一天燒光那次的實際狀況,長稿反覆餵回去是很吃額度的行為,這件事要先有心理準備。

第三,Gemini 那份官方範本藏了一個彩蛋。官方在「建立自訂 Gem 的訣竅」裡直接附了一個內建的「文字編輯者」Gem 範本原文,明寫它可以編輯「論文、小說、書信等」、要「提供逐行修改,說明背後原因」——但同一份範本也寫了一句:「預設寫作中級(高中)程度,並提供適當的回饋。」

這解釋了一件很多人抱怨過的事:為什麼請 Gemini 改稿,回來的意見常常像高中作文老師的評語。因為官方預設的就是那個程度。你要它用別的標準看你的稿,就得自己在 Gem 指令裡把「角色」那段改掉。

順帶一提,Gemini 那頁繁中版本身標註了「可能含有使用 AI 技術翻譯的內容,也許會有錯誤」——官方自己這樣講,我引用時也照實說一聲。

下一步:登入你主要用的那一家,把第 1、2 步產出的兩份文件放進專案層(不是每次對話重貼)。放完之後,之後每次續寫的開場白可以短到只有兩句。


第 4 步:續寫節奏怎麼控?一次讓它寫多長才不會又卡文

控制 AI 續寫的節奏,指的是每次只讓它寫到一個明確的段落終點就停,而不是放它一路寫下去。這裡我要先誠實講一件事:沒有任何一家官方給過「一次續寫幾字最好」的建議值。你在網路上看到的「一次 3,000 字最佳」「只餵最後兩章」都查不到出處,所以我不引。

官方能給的只有兩件事。一是原則——前面講過的「最小高訊號集合」。二是一個硬規格:Claude 的開發者文件寫明,具備 1M token 脈絡窗的那批模型,單次請求最多可以生成 128k output tokens;其餘模型(含 Sonnet 4.5)是 200k 脈絡窗。但這是 API 端的參數,消費端聊天介面沒有對應的公告數字,所以我不會拿它去換算「你在 App 裡一次能寫幾章」——那樣算是在編。

那我自己怎麼判斷?我用的是「一個決定」原則:一次只讓它寫到「故事發生一個不可逆的決定」為止,寫到那裡就停。可能是三千字,也可能只有八百字。理由很簡單——一個不可逆的決定發生之後,後面所有內容都建立在它之上;如果那個決定不是你要的,讓它繼續寫下去的每一個字都是浪費。

實際節奏長這樣:

  • 開新場,只帶壓縮後的大綱+風格錨點+前一段的最後三百字
  • 明講這一段要走到哪個決定為止
  • 拿回來先只看那個決定對不對,對了再看文筆,不對就直接重來不要修
  • 這段定稿後,把新產生的事實補回你的大綱檔——這步最容易忘,忘了下一場就會開始崩

❹ 那步之所以關鍵,是因為它就是在手動做 compaction 的循環:每寫完一段就重新壓縮一次,讓帶進下一場的東西永遠維持在小而高訊號的狀態,而不是讓對話自己長胖到失焦。這也是為什麼我說設定集撐不過二十章的問題其實不在模型——那篇談的是從零開始怎麼建設定,這篇談的是稿子已經寫壞了怎麼倒推回去,兩篇是同一套邏輯的兩個方向。

下一步:下次續寫前,先寫一句「這段要走到____決定為止」。光是逼自己填這個空格,就會發現有些段落你根本還不知道要寫什麼。


救小說卡文我踩過的三個坑:三個都跟「捨不得」有關

救小說卡文這四步我自己跑過幾輪,踩到的坑講起來有點難為情,因為三個都源自同一種心情——捨不得。

坑一:捨不得只餵摘要,還是偷偷把全稿也貼上去。「反正多給一點總比較保險吧」——這是最直覺也最錯的想法。多貼的那八萬字不是保險,是在稀釋你精心整理過的那份大綱的訊號。官方那句「最小高訊號集合」的重點在「最小」兩個字,不是在「高訊號」。我現在的做法很粗暴:壓縮檔存好之後,舊稿收進另一個資料夾,開新場時根本不打開它。

坑二:捨不得刪它寫壞的段落,想用「修」的。續回來的段落如果方向是錯的,去逐句改它會比重寫更慢,而且改完通常有一種說不上來的縫合感。真的不推,原因是模型已經沿著錯的方向建立了一整段的內部邏輯,你只改表層文字,底下那層錯的骨架還在。方向錯了就整段丟掉,重講一次你要的那個決定。

坑三:捨不得承認自己其實還沒想好。這個坑最傷。我有一次卡了很久,一直覺得是工具的問題,換模型、改指令、重寫大綱,折騰了好幾輪。最後在壓縮舊稿的時候發現——「未收伏筆」那一欄我根本填不出三條。故事沒有懸念在推,當然寫不下去。那次之後我把「壓縮出來的伏筆欄有沒有東西」當成一個檢查點:填不出來,就不是 AI 的問題,是大綱的問題,去改大綱不要再開新對話了。

還有一個不算坑但值得提醒的:續寫出來的段落如果讀起來有種說不上來的塑膠感,那多半跟卡文無關,是另一組問題。哪些特徵會讓讀者一眼看出稿子不是人寫的我整理過一份清單,其中有幾個判準跟大家以為的不一樣。


這套小說卡文救援流程適合誰、不適合誰?先量一下你的稿子

救斷頭稿的四步流程不是萬用的,它解決的是很特定的一種狀況:稿子夠長、你回不去當初的狀態、但故事本身還有懸念在推。用錯地方會白費力氣,所以先量一下你的稿子。

適合你,如果——

  • 你手上有超過三萬字的殘稿,而且真心想寫完(字數越多,compaction 的效益越大)
  • 你卡住的原因是「回不去那個狀態」,不是「不知道要寫什麼」
  • 你願意花一到兩小時整理那份壓縮檔(這是唯一的前置成本,但它一次做完可以用很久)
  • 你已經有付費方案,或至少願意接受免費方案的設定層比較擠這件事

不適合你,如果——

  • 你的稿子還不到一萬字:直接重開比較快,壓縮的效益不夠付整理的成本
  • 你要的是「一鍵幫我寫完」:搜尋結果裡那類工具很多,但那是另一種需求,這篇不處理
  • 你的「未收伏筆」欄填不出東西:先回去改大綱,這四步救不了沒有懸念的故事
  • 你打算把成品拿去投稿或出版:那你要先確認的是另一件事——各平台對 AI 參與的規則差很多,我把三大平台的條款逐條讀過一遍,結論跟很多人想的不一樣;權利歸屬那塊則在官方函釋和平台條款互相打架的那篇

至於成本,這套流程本身不需要額外付費工具,三家的設定層在免費方案都有,只是額度和字元上限比較緊。真正的成本是你的時間——第一次整理壓縮檔大概一到兩小時,之後每次續寫多花五分鐘更新它。以我自己的經驗,這個交換是划算的,因為省下的是「重看八萬字找自己寫過什麼」的那種時間,而那種時間才是真正讓人不想回去打開檔案的原因。

如果你還在決定要用哪一家當主力,或想看看整個 AI 工具版圖,可以從我按需求分類整理的那份工具總覽開始;如果你想要的是多個模型分工的完整寫作流程,起稿、修文、補資料各交給誰那篇會比這篇更全面,這篇只專攻「救回一份已經停住的稿子」。


FAQ 常見問題

小說卡文時,該換一個更強的模型還是先整理稿子?

先整理稿子。換模型改變的是「讀的能力」,但 context rot 是所有模型都會有的特性——Anthropic 官方原文寫得很清楚,有些模型衰退比較平緩,但不會消失。我自己換過一輪,崩的地方只是換了位置,數量沒有變少。花一小時做壓縮檔,比升級方案更有機會解決問題;如果壓縮完還是不順,那時候再考慮換模型也不遲。

AI 續寫和「一鍵續寫」工具有什麼差別?要不要直接買一個?

差別在前提。搜尋結果裡那類工具多半假設你「還沒有稿子」或「只需要接最後一段」,強項是快速給你三個劇情走向。但你手上如果已經有數萬字,真正的瓶頸不是生成速度,是模型讀不到你前面寫了什麼——這個瓶頸換工具解決不了,要靠壓縮。我的建議是先用手上已有的訂閱把這四步跑一輪,跑完還覺得缺什麼,再去看工具。

免費方案能不能跑完這四步?還是一定要付費?

能跑,但會擠。以官方公布的數字看,ChatGPT 自訂指令免費是 1,500 字元、付費 5,000 字元,專案檔案數免費 5 個、Plus 25 個;Claude 官方說明頁寫免費帳號最多建 5 個專案(不過同一頁另一段又寫專案指令僅限付費方案,兩種說法並存,建議自己登入點一次確認)。實際影響是:免費方案下你可能得把風格錨點寫得更精簡,或改成每次對話開頭貼一次。流程本身不會不能跑。

壓縮後的大綱要寫多細?寫太細會不會反而綁死 AI?

會,而且官方也點出了這個張力。Anthropic 用 right altitude(對的高度)描述這件事:一端是把邏輯寫死成一長串脆弱規則,另一端是空泛到沒有具體訊號的高層指引,好的位置在中間。我的實務判準是——每一條都要能用「有沒有做到」檢查。「男主很傲嬌」不能檢查,「男主從不主動說想念,只用行動」可以檢查。寫到每條都通過這個測試就夠了,不用更細。

每次續寫完都要更新大綱檔嗎?可不可以寫完整章再一起補?

可以,但不要拖過一整章。更新大綱這件事本質上就是在手動做 compaction——把新產生的事實壓回那份最小高訊號集合裡。拖越久,下一場帶進去的資訊就越舊,模型會依據過期的設定往下寫,然後你又要回頭修。我的習慣是每一段定稿就補,補的時候只寫「新增了什麼不可逆的事實」,通常兩三行就結束,比事後回頭翻整章快得多。


💡 追劇族讀者推薦

寫小說的人通常也很會追劇——而且追劇時最有感的往往就是「這條線收得漂不漂亮」。最近這幾部我剛好都查過線上看的管道,順手放在這裡:


寫在最後:AI 救得回稿子,救不回你還沒做的決定

整理完這四步之後,我自己最大的體會其實有點反高潮:這套流程真正在做的事,是逼你把「我到底想寫什麼」講清楚。壓縮大綱是在講清楚已經發生了什麼,抽風格錨點是在講清楚你要什麼調性,控制續寫長度是在講清楚下一步要走到哪。三件事都做完之後,AI 才有東西可以接。

所以那些「餵了全稿還是寫不下去」的時刻,很多時候不是技術問題。是我們把一份還沒想清楚的稿子丟出去,期待有人幫我們想清楚。這件事沒有工具做得到,Claude、ChatGPT、Gemini 都一樣——它們能幫你省下重讀的時間,但沒辦法替你決定故事要往哪走。

但反過來說,一旦你想清楚了,它們確實能把你從「重看八萬字」的地獄裡撈出來——而那正是多數斷頭稿真正死掉的原因:不是寫不下去,是不想再打開了。

如果你也在寫長篇,我自己出過一本小說《夜空下的羽翼》,稿子是自己一個字一個字寫的,AI 幫的是潤稿、排版和轉檔那些事。寫的時候我還沒有這套流程,如果那時候就有,大概能少走很多冤枉路。

今天就做一件事:打開那份你不敢看的稿子,不要讀它,只做第 1 步——壓成「已成立事實/未收伏筆/關鍵細節」三張清單。壓完之後你會知道,卡住的到底是 AI,還是那個一直沒被決定的轉折。


參考資料

 

延伸閱讀