💡 核心結論速覽 (TL;DR)
- 最多人卡住、也最少人講的那一道:OpenAI 說明中心寫得很白——除了 Enterprise,其他所有方案處理文件時「會從檔案中擷取數位文字,並捨棄所有圖片」。掃描出來的 PDF 對它來說是一疊圖,不是字。
- 官方硬數字:單檔 512MB、文字與文件檔每檔 2M token、CSV 與試算表約 50MB、圖片每張 20MB;速率是每 3 小時 80 個檔案,免費帳號每天只有 3 個。
- 越重試越慘:遇到 ChatGPT 無法上傳檔案時,官方明寫「上傳失敗的嘗試有時也會計入上傳速率上限」,連按五次重傳只會把當天額度燒光。
- 現在就做:打開那份 PDF,用滑鼠試著選取一段文字——選不到就是圖,先跑 OCR 再丟;選得到,再往下排查大小、格式、額度這三道。
檔案拖進去,轉圈轉了半天,跳出一行「發生未知錯誤」。或是更氣人的版本——它說讀到了,然後開始跟你討論一段那份檔案裡根本不存在的內容。
先給方向:ChatGPT 無法上傳檔案這件事,多數時候不是它壞掉,也不是你的網路有問題。真正卡住的是六道很具體的門檻,而其中最常中的那一道,官方文件裡早就寫清楚了——它會把你檔案裡的圖片整個丟掉。
我每天用 AI 超過十小時,手上同時付著好幾家的高階方案,把整疊 PDF、試算表、簡報丟進去讀,是我一天裡重複最多次的動作。
真正讓我改掉習慣的不是「傳不上去」那種——那種至少會報錯。是有一次它明明讀完了、也回答得頭頭是道,我對照原檔才發現:它引用的那幾個數字,全在一張我掃描進去的表格圖裡,而它從頭到尾沒看到那張圖。它是憑上下文猜的。
那次之後我把三家的官方上限頁面並排打開,逐條對過一遍。這篇就是那份對照的結果——照順序排,你大概第二道就會找到自己卡在哪。
AI 讀不到檔案,先分清楚是「傳不上去」還是「傳上去了卻讀錯」
ChatGPT 無法上傳檔案這個症狀,實際上包含兩種完全不同的故障,解法方向相反。第一種是檔案根本沒進去:跳錯誤訊息、卡在進度條、上傳鍵直接反灰。第二種是檔案進去了、AI 也正常回你了,但它讀到的東西跟你以為的不一樣。
第二種危險得多,因為它不會報錯。你不會知道要懷疑它,只會覺得「這個 AI 好像有點笨」。
Dcard 上有一則討論串我印象很深,發文的人說 GPT 跟他解釋了一段那份 PDF 裡根本不存在的內容。那不是模型幻覺失控,那是它真的什麼都沒讀到,只好從檔名和你的提問去推測。
所以排查順序要先分流:
- 會跳錯誤/傳不上去 → 直接跳到門檻②(大小)、③(格式)、④(額度)
- 傳得上去但答案怪怪的 → 幾乎都是門檻①(沒有文字層)或門檻⑤(試算表結構)
- 你給的其實是一個網址不是檔案 → 那是完全另一套機制,看門檻⑥
這段可以帶走的一件事:下次覺得 AI 讀檔「怪怪的」,先別急著怪模型,回頭確認它到底讀進去了多少字。
門檻①:你的 PDF 裡根本沒有文字,官方原文是「捨棄所有圖片」
ChatGPT 除了 Enterprise 方案之外,處理文件檔案時只做文字擷取。OpenAI 說明中心的檔案上傳常見問題寫得非常直接:
ChatGPT Enterprise 支援 PDF 檔案的視覺擷取功能。其他所有方案和文件檔案僅支援文字擷取。也就是說,ChatGPT 會從檔案中擷取數位文字,並捨棄所有圖片。
把這句話翻成人話:一份掃描出來的 PDF,對它來說是一疊沒有字的圖片,擷取到的文字量是零。不是讀得少,是讀到零。
這解釋了兩件一直被誤解的事。第一,為什麼「換瀏覽器、清快取」對這種情況完全沒用——問題不在傳輸,在擷取。第二,為什麼它會開始亂講:手上沒有內容,又要回答你,只好用檔名和你的問句去補。
這不是 AI 特有的毛病。W3C 的網頁無障礙技術文件早就把這件事定性過:
A document that consists of scanned images of text is inherently inaccessible because the content of the document is images, not searchable text.
掃描版 PDF 對螢幕閱讀器、對搜尋引擎、對 AI,全都是同一種「打不開的盒子」。W3C 給的解法也跟我要講的一樣:先做 OCR(光學字元辨識),把圖上的字變成真的字。
10 秒自測法:怎麼知道你的 PDF 有沒有文字層
不用裝任何東西,三步驟:
❶ 用任何 PDF 閱讀器打開那份檔案。
❷ 用滑鼠拖曳,試著選取內文的一段字。
❸ 選得到、可以複製 → 有文字層,這道過關;整頁被當成一張圖選起來、或什麼都選不到 → 就是它,先去 OCR。
還有一個更快的版本:按 Ctrl+F(Mac 是 Command+F)搜一個你確定畫面上有的詞。搜不到就是沒有文字層。
順帶一提,PDF 這個格式從設計上就沒有保證「裡面一定有字」——它保證的是「在哪台電腦上看都長一樣」。這兩件事完全不同,很多人是在這裡誤會的。
不想花錢做 OCR,有免費的路
最省事的一條:把 PDF 或照片丟進 Google 雲端硬碟,右鍵選「使用 Google 文件開啟」。Google 官方說明頁寫明這個動作會嘗試把圖片裡的文字轉成可編輯的內容。
轉完之後你會得到一份純文字的 Google 文件,複製貼上或另存成 .docx 再丟給 AI,命中率會完全不一樣。
我自己的習慣是掃描件一律先過這一關再說。中文的辨識結果不會完美,表格排版常常跑掉,但對「讓 AI 至少讀得到內容」這個目的來說已經夠用了。要精準的表格數字,我會直接手動貼成純文字,不賭 OCR。
門檻②:檔案多大會被擋?官方硬數字一次列給你
ChatGPT 的上傳限制不是一個數字,是五個各自獨立的天花板,任何一個先撞到都會失敗。以下全部來自官方說明中心,不是社群推估。
| 限制項目 | 官方上限 | 什麼時候會撞到 |
|---|---|---|
| 單一檔案大小 | 512MB(硬性上限) | 高解析度掃描件、含大量圖片的簡報 |
| 文字與文件檔 token | 每檔 2M token | 數百頁的合約、論文、整本電子書 |
| CSV 與試算表 | 約 50MB(依每列大小而定) | 幾十萬列的原始資料匯出檔 |
| 單張圖片 | 20MB | 相機原檔、未壓縮的截圖拼接 |
| 帳號儲存空間 | 每位使用者 25GB/每個組織 100GB | 長期累積,聊天/Projects/自訂 GPT 共用同一池 |
幾個容易誤會的點,值得單獨拉出來講。
2M token 的限制不適用於試算表。官方特別註明了這一條,所以試算表看的是那個約 50MB 的門檻,不是 token。
25GB 是共用池。聊天裡傳的、Projects 裡放的、自訂 GPT 當知識庫上傳的,全部算同一個額度。很多人「明明沒傳幾個檔卻說已達上限」,就是被歷史累積的檔案吃掉的。
要查現在用掉多少,官方指路是 ChatGPT 的「設定 > 儲存空間」。但速率配額查不到——官方直接說明目前不會顯示滾動式上傳速率用了多少、剩多少。這點下一道門檻會再提。
下一步可做的事:現在就去「設定 > 儲存空間」看一眼數字。如果已經逼近 25GB,先刪掉舊對話裡不需要的附件,比研究任何排錯教學都有效。
門檻③:ChatGPT 上傳檔案支援的副檔名只有 8 種,你的 .gdoc 不在裡面
ChatGPT 官方在支援檔案類型的說明頁只點名了 8 種副檔名:XLSX、XLS、CSV、TSV、DOCX、PPTX、PDF、TXT。同一頁還單獨補了一句,目前不支援 .gdoc,建議先匯出成 .pdf 或 .docx。
這裡要講清楚一件事,免得誤導你:官方給的是「支援清單」,不是「禁止清單」。名單外的副檔名不代表一定會被擋,但也不在保證範圍內——不確定的時候,轉成名單上的格式最快。
實際會踩到的通常是這幾種情況:從蘋果生態系直接匯出的文書檔、雲端服務原生格式的捷徑檔、以及手機相簿丟出來的非常規圖片格式。共通點是,它們在你的裝置上看起來很正常,但傳出去就不是那回事了。
我的處理原則很簡單:只要不是那 8 種,我一律先另存成 PDF 或 DOCX,不花時間試。試錯的成本比轉檔高——這一點在下一道門檻會變得很現實。
門檻④:ChatGPT 無法上傳檔案時,為什麼「一直重試」反而讓你更慘
ChatGPT 的上傳速率是每 3 小時最多 80 個檔案,免費使用者每天最多 3 個檔案,官方還註明尖峰時段可能再往下降。但真正該記住的是這句:
上傳失敗的嘗試有時也會計入上傳速率上限。
失敗的也算。這一條解釋了無數人的體感——第一次失敗,重傳,還是失敗,連按五次,然後開始跳「已達上傳限制」。你不是運氣差,是自己把額度燒完的。
加上前面說的「速率配額查不到」,就變成一個很討厭的組合:你看不見還剩幾次,又會在不知情的狀況下扣掉。所以我的做法是——同一份檔案失敗兩次就停手,先去排查前面三道門檻,不做第三次。
如果你是在 Projects 裡撞牆,那是另一組數字:Plus 每個專案最多 20 個檔案,Pro、Team、Education、Business 是每個專案 40 個。自訂 GPT 又是另一套,每個 GPT 生命週期內最多 10 個檔案。
還有一個很多人漏掉的動作:官方 FAQ 自己就建議,上傳異常時先去看服務狀態頁確認是不是全站性事件。有時候真的不是你的問題,而你花了半小時清快取。
額度這件事本身是另一個大題目,各家算法完全不同。免費版的天花板我另外逐條對過官方,有 5 項額度其實根本沒解除;付了 Plus 還是會撞牆的話,那個 5 小時上限到底怎麼算值得先搞懂;而 Gemini 那邊是兩道牆的設計,先搞清楚哪一道會先擋你。
門檻⑤:試算表傳得上去,數字卻對不起來
試算表是所有檔案類型裡最容易「假成功」的一種:它幾乎不會上傳失敗,但 AI 讀到的內容跟你打開看到的可能差很遠。
先講有官方依據的部分。試算表不受 2M token 限制,改看約 50MB 的大小門檻。Claude 那邊則更明確——Anthropic 說明中心寫明 XLSX 要能上傳,必須先在帳號裡啟用程式碼執行與檔案建立功能,沒開就是傳不了。
接下來這段官方沒有寫,是我實際操作累積的判斷,我把界線標清楚。三家官方頁面都沒有列出試算表的例外情況,所以以下不是規則,是我遇到問題時的檢查順序:
❶ 多工作表:我會先確認 AI 到底看到了幾張表。最快的驗證是直接問它「這個檔案有幾個工作表,各叫什麼名字」,答不出來或少報,後面的分析就不用看了。
❷ 公式與樞紐:儲存格裡是公式還是計算結果,讀出來可能不一樣。要精準時我會另存一份「選擇性貼上為值」的乾淨版本再丟。
❸ 密碼與巨集:有保護的活頁簿我一律先解除再上傳,不賭它能不能處理。
說實話,這三步我不是一開始就會做的,是被錯誤的數字坑過才養成的。試算表最麻煩的地方就在於,它錯得很安靜。
如果你的需求是真的要 AI 在試算表裡幹活,而不只是讀一讀,那有兩條更省事的路:與其一直重傳,不如請它直接寫公式幫你清資料,或是讓 AI 直接在 Excel 裡動手,但要先過那 3 道安裝門檻。想知道它到底靠不靠得住,我拿財務模型實測過三家,最高分只有 87.3。
門檻⑥:你給的是一個網址,不是一個檔案
貼網址請 AI 去讀,跟上傳檔案走的是完全不同的機制,卡住的原因也完全不同。上傳是把內容送進去,貼網址是請它自己出門去拿——而對方可能根本不開門。
最常見的兩種狀況:一種是雲端硬碟的分享連結權限沒開,AI 拿到的是登入頁不是檔案;另一種是目標網站在伺服器層就把 AI 的爬蟲擋掉了。
第一種很好解,把連結權限改成「知道連結的任何人」再貼一次就行。但我更常直接下載成檔案再上傳——省掉一整層變數,也不用擔心對方哪天改權限。
第二種就複雜多了,而且跟你的瀏覽器、快取、VPN 全都無關。這題我另外整理過一篇:如果你貼的是網址不是檔案,我掃完 18 個網站的 robots.txt 才想通問題出在哪。
同一份掃描 PDF,換一家真的讀得到嗎?三家官方規格對比
會,但條件比你想的嚴格,而且只有一家把規則寫出來了。這張表全部依官方說明頁整理,官方沒公布的欄位我不補推估。
| 項目 | ChatGPT | Claude | Gemini |
|---|---|---|---|
| PDF 裡的圖與掃描檔 | 僅 Enterprise 有視覺擷取;其他方案「捨棄所有圖片」 | 100 頁以內連圖表一起分析;101–1000 頁只讀文字 | 官方未公布 |
| 非 PDF 文件裡嵌的圖 | 捨棄 | 官方明寫讀不到 | 官方未公布 |
| 單檔大小上限 | 512MB | 500MB(對話)/30MB(專案) | 100MB(影片 2GB) |
| 單次可傳檔案數 | 每 3 小時 80 個(免費每天 3 個) | 每次對話最多 20 個 | 同一提示詞最多 10 個 |
| PDF 頁數上限 | 受 2M token 限制 | 1000 頁 | 官方未公布 |
最值得注意的是第二列。Anthropic 的官方頁把非 PDF 文件的規則寫得很老實:
For non-PDF documents: Claude extracts text only from these files. If they contain embedded images, Claude won't be able to read or interpret them.
換句話說,「圖片被丟掉」不是 ChatGPT 獨有的問題,只是每一家丟的範圍不一樣。Word 檔裡貼滿截圖的那種文件,兩家都讀不到;差別在於同樣的內容如果是 100 頁以內的 PDF,Claude 會看,ChatGPT 不會。
所以這份檔案該丟給誰?
適合換 Claude 的情況:掃描件、含圖表的財報或投影片轉出的 PDF、100 頁以內、你在意的資訊真的長在圖上。這是目前唯一有官方白紙黑字保證會看圖的消費級方案。
不需要換的情況:純文字的合約、論文、程式碼、匯出的純資料 CSV。這類檔案三家表現差距不大,為此多開一個訂閱不划算。
成本怎麼算:如果你一個月只會遇到兩三次掃描件,先用免費 OCR 轉檔再丟給現有工具,成本是零;要是每週都在處理掃描文件,那才輪得到考慮多付一份訂閱。
下一步:先確認你手上「讀不到」的檔案是不是真的都是掃描件——很多人以為要換工具,其實轉個檔就解決了。真的需要橫向比較,三家付費方案該怎麼選我整理成一篇了;不想為了讀一份檔案就多付一筆,我每天在用的 8 款免費 AI 工具,免費額度其實就夠應付大多數文件。
我現在丟檔案前會先做的 3 件事
這三個動作加起來不到一分鐘,但幫我省掉的重傳次數大概是十倍以上。
❶ 選一段字:打開檔案,滑鼠拖過去選一段內文。選不到就是圖,直接去 OCR,不要浪費上傳額度。
❷ 看副檔名:不是那 8 種官方點名的格式,先另存再說。轉檔 10 秒,試錯要 3 小時。
❸ 傳完先驗一句:不要一上傳就開始問正事。先問一句「這份檔案總共幾頁、第一段的原文是什麼」,答得出來才繼續。這一步是我從那次被掃描表格坑過之後才加上的,也是三步裡最有用的一步。
檔案順利讀進去之後才是真正的重點——怎麼問才問得出東西。這部分我另外寫過:啃整疊 PDF 報告的 7 個技巧和提示詞,還有同一份 PDF 丟給三家,誰整理得最像人話的實測。如果你根本不想每次手動拖檔案,有個免終端機的做法能讓它直接整理你電腦裡的檔案。
FAQ 常見問題
ChatGPT 上傳檔案出現「發生未知錯誤」,該先做哪一件事?
先看服務狀態頁,再看檔案本身,最後才動瀏覽器。順序很重要:官方 FAQ 自己就建議先確認是不是全站事件,這一步 10 秒鐘。排除之後,把檔案另存成 PDF 或 DOCX 再傳一次。同一份檔案不要連試超過兩次——失敗的嘗試也會計入速率上限,你會把額度耗光卻什麼都沒解決。
免費版和付費版,差的到底是上傳次數還是讀取能力?
兩者都差,但差最多的是次數。免費使用者每天最多 3 個檔案,付費是每 3 小時 80 個,這是量級差距。讀取能力方面,「捨棄所有圖片」這條規則對免費和一般付費方案一視同仁,只有 Enterprise 例外。所以如果你是為了讓它看懂掃描件而升級 Plus,那筆錢不會解決問題。
掃描版 PDF 一定要先 OCR 嗎?有沒有不花錢的做法?
對 ChatGPT 來說幾乎是必須的,但不用花錢。把檔案丟進 Google 雲端硬碟、右鍵用 Google 文件開啟,就會嘗試把圖上的字轉成可編輯文字。
另一條路是換工具——Claude 對 100 頁以內的 PDF 會直接分析圖表。要精準的表格數字,我還是建議手動貼成純文字,OCR 的表格排版很容易跑掉。
手機傳得上去、電腦卻傳不上去,是誰的問題?
這種「單一裝置失效」的情況通常不在官方限制裡,因為額度是綁帳號不是綁裝置。既然同一個帳號在手機上正常,速率和儲存空間就都還沒滿。
剩下的變數集中在那台電腦的瀏覽環境——擴充套件、公司網路的安全代理、或瀏覽器本身。最快的驗證是換一個瀏覽器或開無痕視窗傳同一份檔案,兩分鐘就能分辨是裝置問題還是帳號問題。
同一份檔案,該選 ChatGPT、Claude 還是 Gemini?
看那份檔案的資訊長在哪裡。資訊在文字上,三家差距不大,用你原本就有訂閱的那家最划算。資訊長在圖上、又是 100 頁以內的 PDF,Claude 是目前唯一有官方保證會分析視覺元素的消費級選擇。
要一次傳很多檔的話,注意 Claude 每次對話上限 20 個、Gemini 同一提示詞上限 10 個,ChatGPT 反而是量最寬的那個。
寫在最後:讀不到,通常不是模型的錯
把六道門檻走一遍你會發現,ChatGPT 無法上傳檔案這件事,真正跟「AI 聰不聰明」有關的幾乎沒有。是文字層、是大小、是副檔名、是額度——全都是很無聊、很物理的東西。
我覺得最值得記住的還是那句官方原文:擷取數位文字,並捨棄所有圖片。知道這一句,你就不會再對著一份掃描件反覆重傳,也不會再相信一個沒讀到內容卻回答得很流暢的答案。
老實說,AI 讀檔這件事到現在還是很不透明——配額看不到、失敗原因不會講、各家規則還都不一樣。在那之前,我們能做的就是把可控的部分先控好:選一段字、看副檔名、驗一句話。
如果你也在把 AI 塞進日常工作流,我在部落格上還整理了不少實際踩過的坑,從免費工具怎麼挑到付費方案怎麼分流都有,有興趣可以接著看下去。
參考資料
- OpenAI 說明中心|檔案上傳常見問題(上限數字、速率、視覺擷取原文出處)
- OpenAI 說明中心|支援哪些檔案類型?
- Anthropic 說明中心|上傳檔案到 Claude
- Google 說明|在 Gemini 應用程式中上傳檔案
- Google 說明|將 PDF 與圖片檔轉換為文字
- W3C WAI|WCAG 2.2 Techniques・PDF7(掃描影像式文件的無障礙定性與 OCR 建議)
- 維基百科|光學字元辨識
- 維基百科|可攜式文件格式
- OpenAI 服務狀態頁