AI寫小說實測:Chatgpt各模型V.S DeepSeek、Grok3、Claude模型對決

目錄

先說結論:這篇是 2025 年 AI 寫小說實測舊版紀錄,主要用來看 ChatGPT 4o、4.5、o1、o3 mini、DeepSeek、Grok3、Claude 當時在同一 份小說細綱下的截圖與差異;如果你要做現在的工具選擇,請先看 2026 持續更新 AI 寫小說模型對決:ChatGPT、Claude Opus、Gemini、Grok、DeepSeek 怎麼選?

怎麼讀這篇:想看最新排名就跳 2026 新版;想比較模型進步,就看本文保留的 7 款 2025 模型截圖、模型順序與主要結論;想開始創作,先用同一份大綱測 2-3 個工具、各跑 500 字試水溫;想付費,再確認官方方案、上下文限制、商用規則與取消方式。

你現在的需求

這篇舊文怎麼看

下一步

找最新 AI 寫小說工具

不要把 2025 舊版結果當今天排名

先看 2026 新版完整實測:五大模型同題對決

比較模型進步幅度

看舊版截圖、同一份細綱與各模型弱點

再對照新版模型測試

要付費寫長篇小說

用本篇判斷文風和錯誤類型

確認 ChatGPT PricingClaude 方案xAI Grok 模型頁

預算有限先練習

看 DeepSeek 與免費工具能不能跑出初稿

搭配 2026 年最值得試的 8 款免費 AI 工具,DeepSeek API 變動可看 DeepSeek 官方變更紀錄

引言

如果你是從 Google 搜「AI寫小說」「ChatGPT 寫小說」「DeepSeek 寫小說」進來,先把這篇當成 2025 版實測紀錄。它的價值不是告訴你今天哪個模型最新,而是保留同一份小說細綱、同一段 500 字測試下,各模型當時的文字節奏、角色塑造和失誤方式。

坦白說,如果你只想找今天最頂級的模型,請直接看我 2026 年的新版實測;但如果你想看懂各大 AI 家族的「基因脾氣」和文字節奏,這篇保留的同題材對照截圖,就是最好的教科書。我這邊也補上更清楚的選擇邏輯與下一步連結,避免你把舊模型名誤當成今天的購買建議。

背景介紹與實測方法

各模型背景介紹

這一段先把當時測過的工具講清楚。你可以把它當成舊版參賽名單,不要把每個模型名稱都當成今天仍然最推薦的選項:

  1. ChatGPT系列:本篇保留 2025 年測試時的 4o、4.5、o1、o1 pro、o3 mini-high 與 o3 mini 截圖;如果你要看現行方案與可用功能,請回 ChatGPT Pricing 確認。
  2. DeepSeek:這裡保留當時中文初稿與創意速度的觀察;現行 API 模型名稱、停用時程與更新,建議看 DeepSeek 官方變更紀錄,不要只依舊文判斷。
  3. Grok3:本篇保留 Grok3 在文學氣息、創意與跳躍感上的舊版表現;如果你要使用新 Grok API 或模型,請看 xAI Models
  4. Claude:本篇保留 Claude 3.7 Sonnet Extended 的寫作觀察;如果你在考慮長文、小說、程式或高頻使用,請先看 Claude 方案說明

實測方法詳解

這不是官方跑分,也不是所有模型的最新排名;它是一份同題材創作手感對照。為了讓舊版結果仍然可讀,本次實測當時採用了以下方法:

  1. 統一提示詞:所有模型均使用相同的小說第一章細綱,要求生成前500字文本,以消除提示詞變化帶來的偏差。
  2. 多版本測試:對ChatGPT各版本進行單獨測試,觀察其在文本風格、情感鋪陳、情節構建及人物描寫上的差異。
  3. 截圖展示:生成文本後,我保留各模型輸出的截圖,讓你直接看文字質感、段落節奏和失誤類型。

各模型寫小說能力實測結果

ChatGPT多版本測試結果

針對ChatGPT系列,筆者分別測試了以下版本,具體表現如下:

【ChatGPT 4o】

  • 我的感覺:4o 像一個很穩的第一版代筆,句子乾淨、起承轉合清楚,讀起來不太需要費力。
  • 適合做什麼:用來先跑一個大眾小說感的場景骨架,確認開場、人物出場和敘事順序有沒有成立。
  • 要小心:它的安全感也會變成缺點。角色聲音容易太平均,每個人都像在說漂亮但不太有記憶點的話;如果要拿來接長篇,後面一定要人工補人物口吻和衝突選擇。
     
ChatGPT 4o 生成小說
ChatGPT 4o 生成小說

【ChatGPT 4.5】

  • 我的感覺:4.5 比 4o 更願意停在人物反應上,不會只急著把事件往前推;它比較會寫「主角此刻為什麼卡住」。
  • 適合做什麼:如果你已經有角色設定,4.5 可以拿來試一段情緒衝突,看看角色在壓力下會不會有比較像人的反應。
  • 要小心:它有時會把情緒寫得太滿,像每段都在提醒讀者「這裡很有感情」。我修稿常常修到翻白眼,一邊碎碎念一邊把那些煽情形容詞砍掉;留下的動作、選擇和對話,才是讀者真的會記住的東西。這種「情緒過載」是 2025 年 GPT-4.5 的招牌脾氣,2026 年的新 ChatGPT 還會這樣嗎?同題對照我放在 2026 那篇實測裡,可以直接翻來看。
ChatGPT 4.5 生成小說
ChatGPT 4.5 生成小說

 

【ChatGPT o1 與 o1 pro】

  • 我的感覺:o1 比較像快速把場景骨架拉出來,o1 pro 則會多補一些鏡頭和情緒停頓。
  • 適合做什麼:卡在「這一章到底要怎麼開始」時,可以讓它先丟一版,再由作者決定要保留哪個視角、哪個衝突。
  • 要小心:不要把速度當成品質。提示詞沒有寫清楚人物關係和章節目的時,它會很快跳到下一個情緒點,留下中間缺一口氣的銜接。
     
ChatGPT o1生成小說
ChatGPT o1  生成小說
ChatGPT o1 pro 生成小說
ChatGPT o1 pro 生成小說

 

【ChatGPT o3 mini-high 與 o3 mini】

  • 我的感覺:這組更像摘要型初稿,短、乾淨、重點明確,但不像完整小說開場。
  • 適合做什麼:拿來測一個場景能不能成立,或把混亂的大綱整理成可寫的段落順序。
  • 要小心:如果你要的是第一章的空氣感、人物壓抑感或伏筆,它會不夠厚。它適合當草圖,不適合直接當正式段落。
     

ChatGPT o3-mini-high 生成小說
ChatGPT o3-mini-high 生成小說

所以這幾個 ChatGPT 版本我不會只用「誰比較強」來排。比較實際的分法是:4o 拿來跑穩定骨架,4.5 拿來測情緒戲,o1 / o1 pro 拿來突破卡住的開頭,o3 mini 系列則適合整理場景方向。

DeepSeek寫小說實測

DeepSeek 的價值不是「寫得最細」,而是很快把一個可能的切角丟出來。它有時會給出比較衝的畫面或轉折,適合拿來打破你原本太保守的想法。

  • 我會怎麼用:先讓它跑一版粗稿,再把有用的場景點子拆出來,交給其他模型或自己重寫。
  • 要小心:它的節奏很容易快過角色動機。看到突兀轉折時,不要急著刪掉,可以先問自己:這個轉折如果要成立,前面需要補哪個伏筆?這點在 2025 年是 DeepSeek 的硬傷,2026 年的新模型有沒有把這個問題解掉?你可以先看我 2026 那篇實測,再回頭比對。
     


Grok3寫小說實測

Grok3 比較有「怪味」和畫面感,適合在故事太平的時候拿來試反套路。它不一定最穩,但有時會把場景推到比較意外的位置。

  • 我會怎麼用:拿它做靈感發散,尤其是世界觀、場景氣氛、旁支角色的怪點子。
  • 要小心:漂亮畫面不等於好章節。Grok3 的段落有時像一顆顆鏡頭剪在一起,真正要發表前,作者還是要重接人物動機和場與場之間的因果。這種「畫面感蓋過邏輯」是 2025 年 Grok3 的硬傷,2026 年的 Grok 新模型有改進嗎?同一段大綱我也丟給新版跑過,可以到 2026 那篇實測直接比對。
     
Grok3 生成小說
Grok 3 生成小說

Claude寫小說實測

Claude 到 2025 年已經不是新興工具了,它更像是長文修稿和角色語氣整理的主力選手。這次截圖給我的感覺是:它不一定最會製造爆點,但比較願意照顧段落節奏。

  • 我會怎麼用:把前面模型跑出的粗稿交給 Claude,請它檢查角色是否前後矛盾、對話是否太像旁白。
  • 要小心:Claude 有時會太禮貌、太平順,衝突感會被磨掉。寫小說時,必要的難聽話、錯誤選擇和尷尬停頓,還是要作者自己放回去。
  • Claude 3.7 Sonnet Extended 生成小說
    Claude 3.7 Sonnet Extended 生成小說

2026 補充:另一種思路——工具型 AI 小說生成器(Genspark)

本段為 Genspark 提供帳號協助完成的實測。

前面這幾個工具邏輯都一樣:細綱寫得越細,它寫得越貼我要的。Genspark 走的是另一條路——它叫「AI 小說產生器」,畫面上只有三件事:選類型、寫一句開頭、定一個調子,按「開始產生」就一次生出整篇。等於把「寫 prompt」這步從我身上拿掉了。

Genspark AI小說產生器實測
Genspark AI小說產生器實測

我故意只丟一句話:投資諮詢公司的江瀾在咖啡廳撞上神秘男陸沉,偷聽到一段可能翻盤的對話。這比我平常餵 ChatGPT、Claude 的細綱短了好幾倍,它卻自己補出公司名、咖啡廳名、一樁醫養園區標案,連對手的父親都被寫進陰謀,七章加結局都齊了,腦補密度超出我預期。成品是排版好的 HTML,封面配分章全文,質感不差,但方向對、細節不照我走——細綱裡江瀾穿深藍、陸沉穿深灰,它自己改成淺灰和黑。

它生出來的這篇《雨夜標案》我原樣放在我的副站心象館裡,大家可以實際去查看閱讀全文。

所以它適合的不是手上已有完整設定的人,而是只握著一個點子、想快點看到完整故事長相的人。寫網文前試水溫、要一份能改的初稿骨架、或想省下打長 prompt 的力氣,它都接得住。

要小心的也是同一件事:你幾乎不能補指令。三個欄位填完就一鍵全產出,中途沒有對話框能再交代「我要繁體不要簡體」或「先只給我開頭」——它一次把全文寫完,你沒得喊停,連主角穿什麼都它說了算。習慣一章一章慢慢磨的人,會不太適應這種交出去就收不回的感覺。

Genspark AI生小說實測過程
Genspark AI生小說實測過程

實測案例分析:哪一種 AI 寫小說更適合你?

文本流暢度與語言風格分析

我看 AI 小說輸出時,不會只看句子順不順。句子順其實是最基本的,真正要看的是三件事:角色講話有沒有不同聲音、轉折是不是靠事件推動、讀完前 500 字後會不會想知道下一章。

  • 4o 最穩,但也最容易變成「正確的大眾小說口吻」。
  • 4.5 和 o1 pro 比較會補情緒,但要小心漂亮形容詞太多。
  • Claude 適合整理段落和角色語氣,當第二輪修稿工具比當靈感爆破工具更好。
  • DeepSeek 和 Grok3 適合破局,適合找意外角度,不適合無修稿直出。

情節連貫性與人物刻畫分析

如果你要寫長篇,真正的考題不是前 500 字看起來多漂亮,而是下一章會不會崩。AI 最常見的問題是第一段很有氣氛,第三段就忘記人物真正想要什麼。

  • 穩定連貫:ChatGPT 4o、Claude。
  • 情緒張力:ChatGPT 4.5、o1 pro。
  • 創意切角:Grok3、DeepSeek。
  • 需要作者補強的地方:人物口吻、伏筆回收、長篇節奏、同一角色在不同章節的選擇一致性。

實測案例對比

所以這篇舊文比較像一份「模型手感紀錄」,不是今天的採購排行榜。若只看當時那輪同題測試,我會這樣分工:

  • 要先跑穩定初稿:用 4o 或 Claude。
  • 要補角色內心戲:試 4.5,再人工刪掉過度煽情的句子。
  • 要突破開頭卡關:試 o1 / o1 pro,先拿方向,不要直接定稿。
  • 要找意外畫面或反套路:用 DeepSeek 或 Grok3 發散,再回頭重接邏輯。

實用建議與創作靈感

根據需求選擇適合的AI工具

如果你今天真的要開始用 AI 寫小說,我不會建議你照舊文把所有模型都試一輪。比較實際的做法是先看你的創作目標:

  • 重視長篇架構、伏筆和章節連貫:優先比較 ChatGPT 與 Claude,再用 Claude、ChatGPT、Gemini 比較 補充付費選型。
  • 重視文字質感、角色內心和對話修稿:先試 Claude,再把同一段輸出交給 ChatGPT 做結構檢查。
  • 重視速度、創意切角和大量草稿:可以把 Grok 或 DeepSeek 當作發想工具,但不要直接把初稿當完稿。
  • 只是想免費練習:先從 為什麼還是建議先找免費 AI 工具替代品 挑 1-2 個工具,不要一開始就綁月費。

我的選法:真正要寫長篇時,我會先用 AI 做大綱、人物矛盾和章節節奏,再人工改人物語氣。AI 可以加速,但小說的辨識度仍然要靠作者自己的取捨。

同一段故事,丟給 2-3 個模型試

說實話,每個模型脾氣都不同。我會拿同一段角色設定、同一個章節目標,丟給 2-3 個工具試跑;不要急著判斷誰最強,先看哪一版最接近你想寫的故事。

有時候最好的做法不是選一個模型從頭寫到底,而是讓 4o 或 Claude 穩住骨架,用 4.5 補情緒,再把 DeepSeek 或 Grok3 的怪點子拆出來重寫。這樣比較像創作,不像把題目丟給 AI 交作業。

AI 初稿一定要人工修

AI 生出來的東西,我會先當半成品看。第一輪先刪掉漂亮但沒用的形容詞,第二輪檢查角色是不是還記得自己的目標,第三輪才調句子節奏。

如果一段文字每一句都很順,卻沒有任何一句讓你覺得「這就是這個角色會說的話」,那它還不是小說,只是一段很會裝成小說的草稿。

總結與行動呼籲

回頭看這篇 2025 舊版實測,我會把它的結論說得更白一點:AI 可以幫你把第一版文字生出來,但它不會自動替你做小說家的選擇。

  • 要穩定開場:ChatGPT 4o 或 Claude 比較安全。
  • 要多一點情緒戲:ChatGPT 4.5、o1 pro 可以試,但修稿時要砍掉空泛形容詞。
  • 要找怪一點的切角:DeepSeek、Grok3 有用,但不能省掉後面的邏輯整理。
  • 要真的寫成長篇:請先建立角色表、章節目標和伏筆清單,再讓 AI 寫,不要讓模型自己決定故事往哪裡跑。

這也是我現在比較保守的看法:AI 很適合陪你拆大綱、試場景、找文字方向;但一部小說最後能不能被記住,還是取決於作者願意刪掉多少漂亮廢話,留下多少真正會痛的選擇。

下一步怎麼做

如果你對 AI 寫小說充滿好奇,建議不要只看哪個模型「最強」。請先準備同一份角色設定、世界觀、章節目標和 500 字測試長度,把 2-3 個工具放在同一條件下比較。

說到這裡,雖然本文主要討論寫小說的 AI,其實日常裡還有很多免費 AI 能用來幫你寫大綱、生圖、甚至做聲音。先用免費工具跑出一段真正想改的文本,再決定要不要付費,會比只看模型名稱更可靠。

AI寫小說常見問題

這篇 AI 寫小說實測還值得看嗎?

值得,但要把它當成 2025 年舊版實測紀錄。它適合看 ChatGPT、DeepSeek、Grok3、Claude 當時在同一份小說細綱下的截圖與差異;如果你要做現在的工具選擇,請先看 2026 新版。

現在要看最新 AI 寫小說模型該看哪一篇?

建議先讀 跳到 2026 新版:五大模型同題比較與我的選擇邏輯,再回來看這篇比較模型進步幅度。舊文的價值是做歷史對照,新文才適合當作目前選型入口。

AI 寫小說該選 ChatGPT、Claude、Grok 還是 DeepSeek?

如果你要穩定架構和長篇控制,優先比較 ChatGPT 與 Claude;如果你想找創意切角或速度,可以看 Grok;如果預算有限、只想跑中文初稿,DeepSeek 可以作為低成本試寫工具。真正選擇前,仍要看官方方案與最新模型頁。

用 AI 寫小說一定要付費嗎?

不一定。靈感發想、大綱拆解、短段落試寫可以先用免費版;如果你要長篇上下文、穩定輸出、商業作品或大量改稿,再考慮付費方案。付費前先用一個真實章節測試,不要只看模型排名。

AI 寫出來的小說需要人工修改嗎?

需要。AI 可以幫你生成初稿、測試敘事節奏和補角色互動,但角色一致性、伏筆回收、情緒層次和文風辨識度仍要靠作者修改。最安全的用法是把 AI 當成共筆助手,而不是直接把輸出當成完稿。

結語

這篇舊文的任務,是保留當時那輪 AI 寫小說實測的原始觀察,讓你看見模型在文字、節奏、角色和創意上的差異。若你現在要真的開始創作,先用本文找出常見問題,再用新版實測與官方方案確認工具,最後回到自己的故事裡慢慢打磨。

 

延伸閱讀