Google 文件語音輸入怎麼用?官方 Live 上線:Gmail、Docs、Keep 三個新做法

Google 在 9 月 3 日把 Gemini Audio 模型放進 Gmail、Docs 和 Keep,開出三個叫「Live」的語音功能。跟以前的語音輸入差在哪?以前是你講一句、它打一句;現在你可以問信箱、可以用講的長出一份文件初稿、可以把一團亂的碎念丟進去讓它自己收成清單。這篇整理官方公布的內容、誰現在用得到,還有把話講給 AI 聽的時候要注意什麼。

Google Workspace 語音功能上線

誰發的、什麼時候發的

來源是 Google 官方部落格 The Keyword,2026 年 9 月 3 日,作者是 Google Workspace 產品副總裁 Yulie Kwon Kim。官方的一句話是:「Three new voice-activated features will change the way you use Google Workspace products.」(三個新的語音功能,會改變你使用 Google Workspace 產品的方式。)

技術底子是 Gemini Audio 模型,Google 在今年 I/O 已經先預覽過,這次是正式上線到三個 App。同一套音訊模型的準確度提升,我在Gemini 3.5 Transcribe 那篇整理過官方的錯字率數字,那是這次語音功能能做到「聽懂」而不只是「聽寫」的前提。

Google 官方公布 Workspace 語音功能
圖/Google 官方 The Keyword(來源

以前的語音輸入,為什麼用一用就放棄

語音輸入不是新東西,手機鍵盤上那顆麥克風按鈕存在很多年了。但真的拿它來工作的人不多,原因很單純:它只做聽寫。

你講的當下是跳躍的,講到一半想到別的,前面提過的後面又講一次。這些全部原封不動變成文字之後,你面對的是一大坨沒有標點、沒有段落、順序也亂掉的文字,整理它的力氣不比自己打字少。所以大部分人試兩次就回去用鍵盤了。

這次三個 Live 功能想解決的就是這一段。它們不是把「聽寫」做得更準,是把「講完之後的整理」也接走。

Gmail Live、Docs Live、Keep Live 各做什麼
三個 Live 各自解決一件事(本站自製資訊圖)

Gmail Live:Gmail 搜尋不到那封信,改用問的

做什麼:用對話的方式搜尋你的信箱。官方舉的例子是「What's my flight's gate number?」(我那班飛機的登機門是幾號?)跟「What's going on at my kid's school this week?」(我小孩學校這禮拜有什麼事?)。你不用先想出正確的關鍵字,直接問你想知道的那件事,Gmail Live 會掃過信箱,把答案講給你聽。

為什麼這件事有感:Gmail 的搜尋一直很強,但強的是「你知道要搜什麼」的時候。實際上找不到信的情境通常是相反的——你記得有這件事,但不記得寄件人是誰、主旨寫什麼、也不確定是上個月還是上上個月。這種時候關鍵字幫不了你,問句才可以。

一句小結:搜尋是你去對答案,問是它幫你找答案。

Docs Live:Google 文件用講的寫,它會幫你長結構

做什麼:官方用的詞是「thought partner and co-writer」——想法夥伴兼共同作者。你對著 Docs Live 講,它一邊聽一邊幫你把文件的結構搭出來,不是把你講的話原樣貼上去。官方特別寫了一句「with your permission」:經過你同意,它可以去你的 Gmail、雲端硬碟、Chat 和網路上,把相關的細節抓進這份文件裡。

為什麼這件事有感:寫東西最卡的從來不是打字速度,是盯著空白頁不知道從哪句開始。用講的門檻低很多,講著講著想法就出來了,而結構這件事本來就是 AI 比較擅長的。

要注意的地方:「經你同意去抓 Gmail 和雲端硬碟」這句話兩面看。方便是真的方便,但你要清楚它抓進來的是你自己的資料,同意之前先想一下這份文件之後會給誰看。

一句小結:它幫你從零到一,一到十還是你自己來。

Keep Live:把一團亂的碎念丟進去

做什麼:官方直接用了「brain dump」這個詞。你想到什麼就講什麼,不用先想架構,講重複也沒關係,Keep Live 在背景把這串意識流拆開、分類,收成有結構的清單和筆記,你一個字都不用打。

為什麼這件事有感:Keep 本來的定位就是「怕忘記所以先記一下」。但用久了會發現,記下來的東西越積越多、越來越亂,回頭找的時候一樣沒用。這次的更新等於是在你記東西的當下就先做一次整理。

一句小結:倒腦袋的門檻降到零,回頭才找得回來。

那跟 Gemini Live 差在哪?

這是我看到這則公告第一個想到的問題。8 月底 Gemini Live 那次更新也有一條「用講的管信箱」,兩邊聽起來很像。差別在你人在哪裡:

  • Gemini Live:你在 Gemini App 裡面,它是一個助理,幫你跨到 Gmail、行事曆去執行動作(搜尋、摘要、標星號、封存)。
  • Workspace 的三個 Live:你人就在 Gmail、Docs、Keep 裡面,語音是這個 App 內建的一種輸入方式,產出直接落在你正在編輯的那份文件、那則筆記上。

簡單講,一個是叫助理去做事,一個是自己動手但改用嘴巴。要「產出一份東西」的時候,後者順很多。

誰現在用得到?台灣什麼時候有?

官方寫的是本週開始分批推出,訂閱層級分得很細:

  • Gmail Live、Keep Live:Google AI Plus、Pro、Ultra 訂閱者
  • Docs Live:Google AI Pro、Ultra 訂閱者(Plus 沒有)
  • Google Workspace 企業版:官方只寫「即將推出」,沒給日期

官方全文沒有提台灣的開放時程,也沒有提支援哪些語言。這是我一定要講清楚的一件事:這類功能過去的慣例是英文先上,中文和其他地區後面才跟。所以你現在打開 Google 文件,找不到這個功能是正常的,不用懷疑自己設定錯了。

三個 Live 功能的訂閱層級與開放狀況
誰現在用得到(本站自製資訊圖)

我自己怎麼用「講的」餵 AI

這件事我已經做很久了。我平常用 Typeless 這類語音輸入法,日記、想法、要交代 AI 的事,大多不是打出來的,是講出來的。

我發現一個蠻有意思的落差:跟人講話要有脈絡,講得零散對方會聽不懂,所以我們會下意識地先在腦中排好順序再開口,那個「排順序」的動作其實很耗力氣。跟 AI 講話不用這樣拘謹。想到什麼講什麼,前面講過後面又重複也沒關係,它自己會去抓脈絡、把同一類的內容併在一起。

之前規劃一套比較大的訓練專案時,我就是這樣做的。整個計畫的方向、要達成什麼、認證怎麼設計,想到什麼講什麼,講出來的東西沒有架構、順序也亂。但整理完之後出來的文件,比我自己坐下來一段一段打還完整——因為我把力氣花在「想」,沒有花在「排版」。

這套做法我叫它「碎念法」,跟 Keep Live 這次要做的事幾乎是同一件。差別只在以前要自己把碎念貼進 AI 裡再下一次指令,現在它內建在你記筆記的地方。

用語音餵 AI 的三個原則
怎麼講,它才幫得上忙(本站自製資訊圖)

開始用之前,有三件事先想一下

  1. 它抓進來的資料,你要自己看過。Docs Live 會去 Gmail、雲端硬碟撈東西補進文件,撈得對不對只有你知道。文件交出去之前自己讀一遍,這一步省不了。
  2. 公開場合不要用。語音輸入最大的限制不是技術,是你旁邊有沒有人。在辦公室對著電腦講一份文件,實務上比想像中難。這功能對在家工作、通勤、走路的人比較有用。
  3. 先講目的和對象,再講內容。「幫我寫一份活動說明」跟「幫我寫一份給沒接觸過這個活動的人看的說明,重點在流程和時間」,出來的東西差很多。這條不只適用語音,打字問也一樣。

小結

這次更新真正的改變不是「Google 多了語音輸入」——那個早就有了。改變的是語音從「輸入方式」變成「工作方式」:以前你得先想清楚才開口,因為講出來的東西還要自己整理;現在你可以邊講邊想,讓整理變成它的工作。

對本來就習慣用嘴巴思考的人,這是一個門檻直接被拿掉的更新。對習慣打字的人,值得試一次的理由是:你會發現自己講的內容,比打出來的多很多。

延伸閱讀


本文整理改寫自 Google 官方部落格 The Keyword〈Use your voice to get more done in Gmail, Docs, and Keep〉,作者 Yulie Kwon Kim(VP, Product, Google Workspace),2026 年 9 月 3 日發布。功能開放範圍與時程以官方公告為準。

留言