家裡一定有那疊紙:保單條款、租約、手機門號合約、家電說明書、莫名其妙的繳費通知。字都認得,合起來就是看不懂。現在很多人會直接拍照丟給 AI 說「幫我摘要一下」——這一步就錯了,因為摘要是把東西壓小,而你真正想知道的是「哪一條會害到我」。這篇整理 Google、OpenAI、Anthropic 三家官方文件寫明的做法,把它壓成三個你今晚就能照做的步驟,重點是讓 AI 讀完之後,你敢相信它講的話。
先講清楚:這件事原廠自己怎麼定義
「把文件丟給 AI 讀」不是什麼野路子玩法,三家原廠的官方文件都寫得很清楚,只是大部分人沒去翻。
Google 的 Gemini 說明中心〈上傳並分析檔案〉那頁寫著,Gemini 支援大多數檔案類型,包含 PDF、圖片、文件、試算表;同一則提示詞最多可以加 10 個檔案,影片以外的檔案上限 100 MB。官方對用途的描述是請它「解答問題、生成摘要並取得特定內容的分析結果」。
OpenAI 的 File Uploads FAQ 更有參考價值,它直接把「上傳檔案能做的事」分成三類:Synthesis(綜合、比對兩份文件)、Transformation(換句話說、把複雜的東西講簡單)、Extraction(把指定的東西抓出來)。官方自己舉的例子包括「Upload a PDF and have ChatGPT find any references to a certain topic」跟「Pull out relevant quotes from a document」。注意這裡:官方把「抓出原文引句」當成一個獨立用法,跟摘要是分開的。
Anthropic 那份〈Reduce hallucinations〉官方技術文件則講了另一半——怎麼讓它不亂編。裡面第一條就是「Allow Claude to say "I don't know":明確給它承認不確定的許可,這個簡單的技巧可以大幅減少錯誤資訊」。第二條是「Use direct quotes for factual grounding」,面對長文件時,先要它逐字抄出原文引句,再開始做事。第三條「Verify with citations」更狠:要它替每個結論找一句支撐的原文,找不到就把那個結論撤掉。
三份文件湊起來,答案就浮出來了:AI 讀文件的能力是真的,但你要的不是「摘要」這個動作,是「抽出原文 + 允許它說沒寫」這組動作。下面三步就是把這件事變成你手機上打得出來的話。
步驟 1:先遮個資,再講清楚你是誰
核心動作
拍照或上傳之前,先把身分證字號、生日、地址、帳號、金額遮掉。iPhone 內建的「標示」用麥克筆塗兩下就好,Android 相簿的塗鴉工具也一樣。接著開場白先講三件事:我是誰、我要決定什麼、什麼時候要決定。
為什麼要這樣做
Google 的 Gemini 隱私說明頁寫得很直白:對話會有人工審閱員檢查以改進服務,官方原話是「如有機密資訊不想讓審查員看到,或不願供 Google 用於提升服務,請勿輸入」。同一頁也說明,關掉活動記錄之後,暫時對話仍會保留 72 小時。這不是嚇你不要用,是提醒你:遮掉的那些數字,AI 本來就不需要它們才能讀懂條款。你要的是條文的意思,不是它幫你核對帳號。
至於「講清楚你是誰」,是因為同一份租約,對房客跟對房東要看的地方完全相反。你不講,它只能給你一份誰都適用、也就是誰都用不上的說明。
可以直接照抄的講法
「我是這份租約的房客,下週要決定要不要簽。你等一下讀的時候,站在房客的立場看。」
小結:先遮個資是保護自己,先報身分是讓它有立場。
步驟 2:別說「幫我摘要」,要它先抄原文
核心動作
把指令從「幫我摘要」改成兩段式:第一段要它逐字抄出相關條文,第二段才要它解釋。而且每一條都要標出在第幾條、第幾頁。
證據跟範例
這就是 Anthropic 官方講的 direct quotes 做法,也是 OpenAI 分類裡的 Extraction。官方範例的結構是:先「Extract exact quotes from the policy that are most relevant」,找不到就直接說「No relevant quotes found」,第二步才是「Use the quotes to analyze」,並且明講「Only base your analysis on the extracted quotes」。
翻成中文可以直接這樣打:
第一步:把這份文件裡跟「提前解約」「違約金」「押金退還」有關的條文,一字不改地抄出來,每條前面標第幾條、第幾頁。找不到就寫「文件裡沒有這一項」。
第二步:只根據你剛剛抄出來的那幾條,用國中生聽得懂的話解釋每一條對我的影響,不要用文件以外的知識。
為什麼這樣做差很多
摘要是「壓縮」,壓縮一定會丟東西,而合約裡最會害人的往往就是那句最短、最不起眼的但書。先抽原文則是「定位」——你拿到的是一份可以回頭翻書對照的清單。差別在於:摘要要你相信它,抽原文是讓你可以查它。
步驟 3:給它說「沒寫」的權利
核心動作
在指令裡加一句:「文件裡沒寫的就說沒寫,不要用一般常識補。」再加一句驗收:「每個結論後面配一句原文,配不到的那條就自己刪掉。」
為什麼
Anthropic 官方文件把這寫成第一順位的技巧,理由很現實:模型被問到一個問題時,預設行為是「生出一個看起來合理的答案」。你沒給它說不知道的空間,它就會用最像合約會出現的句子填上去——而保單裡最常出問題的,剛好就是「這份保單有沒有寫某某狀況理賠」這種「有沒有」的問題。沒寫,才是那個要命的答案。
官方那句 verify with citations 的做法也值得抄:讓它產出結論之後,回頭替每一句話找原文,找不到就撤回。這等於免費多做一輪自我檢查。
收尾一定要做的一件事
最後補一句:「根據以上內容,列出我應該回頭問對方的 3 個問題。」這句話把 AI 放回它該待的位置——它是幫你讀完、幫你列問題的助理,不是幫你做決定的律師或業務。你拿著那 3 個問題打電話去問,才是這整套流程真正的產出。
三種問法,拿到的東西差在哪
- 「幫我摘要這份保單」→ 拿到一段讀起來很順、但你不知道漏了什麼的文字,也無法查證。
- 「這份保單有沒有理賠 OO」→ 拿到一個是或否,而它很可能是猜的,因為你沒允許它說沒寫。
- 「先逐字抄出相關條文+標頁碼,再只根據這些條文解釋,沒寫就說沒寫,最後列出我該問對方的 3 個問題」→ 拿到一份可回查的清單、一份人話翻譯、一組行動。
同樣一份文件、同樣一個 AI,差別全在你怎麼開口。
我自己怎麼用這套
我的工作是做教育訓練,講白話一點就是「翻譯」:把原廠丟過來那份幾十頁、滿滿規格與條件的文件,翻成第一線同仁三句話就能講給客人聽的說法。這幾年做下來我很確定一件事——翻譯最容易出包的地方,從來不是艱深的技術名詞,是那些「原文其實沒寫、但大家想當然耳」的部分。名詞查得到,沒寫的東西查不到,最後就變成台前講錯、台下客訴。
所以我在用 AI 讀任何一份原始文件時,一定卡兩道:第一道是要它把原文抄出來給我看,我自己會回去翻那一頁;第二道是明講「沒寫就說沒寫」。這兩道不是不信任 AI,是我知道自己會偷懶——它講得越順,我越容易照單全收,然後把它的猜測當成原廠的規格講出去。加了這兩句之後,我讀一份文件的時間大概砍掉一半以上,而且錯的地方它會自己舉手,不會硬掰。
教課的時候我也都這樣講:AI 不是幫你省掉「看懂」,是幫你省掉「找」。找到之後,看懂的責任還是你的。
套用之前,有幾點要注意
- 它不是律師、不是保險業務、不是客服。牽涉到金額、理賠、法律責任的最終確認,一定要問人。這套流程的價值是讓你「問得出好問題」,不是取代對方的正式回覆。
- 拍照品質會直接影響結果。手機拍條款請拍正、不要斜、不要有陰影;字太小就分頁拍。它讀不到的字,會變成它猜的字。
- 越舊、越冷門的文件越要查。小公司自己擬的合約、多年前的舊版條款,都不在模型熟悉的範圍內,這時「先抽原文」這步更關鍵。
- 敏感文件就別上傳。照 Google 官方那句話的邏輯:你不想被別人看到的內容,本來就不該輸入。真的很敏感,就自己逐條打成文字、把個資拿掉再問。
小結
把三步濃縮成一句話:先遮個資並報上你的立場,再要它抄原文而不是給摘要,最後給它說「沒寫」的權利。這三句都不是什麼高深的提示詞技巧,全部寫在三家原廠自己的公開文件裡,只是沒人翻。
今天晚上就可以試:把家裡那份你放了三個月不敢打開的文件拿出來,遮掉個資,照上面的講法打一次。你會發現讀完它的不是 AI,是你自己——只是這次有人幫你把該看的那幾行圈出來了。
換你了:家裡最讓你投降的那份文件是哪一種?保單、租約,還是家電說明書?
本文整理改寫自以下官方文件:
- Google Gemini 說明中心〈上傳並分析檔案〉:support.google.com/gemini/answer/14903178
- Google Gemini 應用程式隱私說明(人工審閱與資料保留):support.google.com/gemini/answer/13594961
- OpenAI Help Center〈File Uploads FAQ〉:help.openai.com/en/articles/8555545-file-uploads-faq
- Anthropic 官方文件〈Reduce hallucinations〉:platform.claude.com/docs/en/test-and-evaluate/strengthen-guardrails/reduce-hallucinations
留言
張貼留言