請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

不必先寫完美Prompt!AI大神卡帕西教你「10分鐘碎念法」:對AI意識流輸出,比想清楚更有效!

數位時代

更新於 5小時前 • 發布於 10小時前 • 李先泰

跟 AI 對話,多數人的直覺是先想清楚要問什麼,再字斟句酌寫出一段完美提示詞(prompt)。但「vibe coding」一詞的創造者卡帕西(Andrej Karpathy)台灣時間 7 月 22 日在 X 上分享的習慣,恰好反過來:懶得打字時,他會切到語音,對著 AI 放空碎念 10 分鐘,全程意識流,講得亂七八糟也沒關係。

依他自己的觀察,AI 整理後的版本往往比原本更清楚,後續需要修正的地方也比較少。

卡帕西是 OpenAI 創始成員、前特斯拉(Tesla)AI 資深總監,2026 年 5 月起加入 Anthropic 投入預訓練研究。

這套方法為什麼可能有效?

先說結論:語音讓你幾乎不花力氣,就能把背景、限制與顧慮一次補給 AI;依卡帕西的觀察,大型語言模型(LLM)很擅長從這些雜亂的輸入中,推測並整理出你想表達的重點。

卡帕西的解釋是,AI 常常需要更多線索才能理解你要做什麼,但你懶得打字,給的資訊就少。與其擠出一段精簡卻漏東漏西的文字,不如用講的,把背景、目的、卡住的點、還沒想通的猶豫全部倒出來。他觀察到,LLM 回述那團思緒的版本,「往往比你一開始講的乾淨許多」。

換言之,這個方法賭的不是你表達得多好,而是模型從脈絡推測意圖的能力。當 AI 回述的版本與你想的一致,兩邊就完成他所說的「對頻」(mind meld,指想法同步);依他的經驗,之後需要修正的地方也就變少。

一般做法 卡帕西碎念法 輸入方式 想清楚再逐句打字 切到語音,想到什麼講什麼 AI 拿到的線索 精簡,可能漏掉背景與顧慮 較容易補充完整的背景、限制與顧慮 你花的力氣 高,得先自己整理思緒 降低長篇輸入門檻,整理交給 AI 可能結果 產出後常需來回修改 期待先對齊;卡帕西自述修正變少,效果因人而異

想跟著做,有哪些語音聽寫工具?

卡帕西並未交代自己用哪一套語音工具,貼文裡寫的「/voice」與 Claude Code(Anthropic 的 AI 程式開發工具,在終端機裡執行)的語音聽寫指令同名,只是可行選項之一。由於不少用戶可能沒聽過這個指令,以下依官方文件整理使用重點:

  • 怎麼開:在 Claude Code 輸入 /voice 就能啟用,第一次會跳出麥克風權限請求。預設是「按住空白鍵講話、放開自動轉成文字」;輸入 /voice tap 可改成點一下開始、再點一下送出。語音和打字可以混用,講到一半改用鍵盤修字也行。

  • 哪裡能用:本機的終端機(macOS、Windows、Linux)與 VS Code 擴充功能。因為麥克風必須在本機,網頁版 Claude Code 與 SSH 遠端連線都不支援。

  • 帳號限制:必須用 Claude.ai 帳號登入才有這個功能;用 API 金鑰或企業雲端平台(如 AWS Bedrock)接入的環境不提供。

  • 中文還不行:官方聽寫語言清單目前支援 20 種語言(含日文、韓文),沒有中文;語言設定不在清單內時,會退回英文辨識。

  • 不另外收費:語音轉錄不消耗 token,也不計入用量額度。

工具 怎麼用 留意 Claude Code 語音聽寫(/voice) 輸入 /voice 後按住講話,或點一下開始、再點一下送出 需 Claude.ai 帳號登入、本機使用;官方聽寫語言目前無中文 ChatGPT 聽寫 手機 App 點麥克風圖示錄音,轉成文字後可先編輯再送出 官方提醒轉錄非逐字紀錄,送出前先檢查 系統內建聽寫(iOS/Android/Mac) 鍵盤上的麥克風,任何輸入框都能用 免費,支援中文

想用中文碎念,可改用替代工具Typeless;進階玩家若想讓 Claude Code 進一步支援雙向語音對話,可再研究開源專案 VoiceMode,需自行安裝與設定。

實際碎念時的 3 個小技巧

卡帕西的原話其實很短,本文把可以照做的部分整理成三個小技巧:

  • 開頭先「自首」:第一句先講「以下是語音轉文字,我會講得比較跳,錯字請包涵」,讓模型把辨識錯字當成雜訊處理,不會被奇怪的字詞帶偏方向。

  • 別管邏輯,想到什麼講什麼:跳來跳去、自我矛盾、講到一半改口都沒關係,這些看似雜訊的細節,反而是模型理解你的線索。你不是在下指令,而是把腦袋裡的東西倒給它。

  • 講完請 AI 回述:先別急著要成品,請它用自己的話重述一次你要做的事、列出不確定的地方、一次反問 2 到 3 個問題。這樣若回述版本理解歪了,能在動工前抓出來;確認一致,再讓它去寫文件、寫程式或擬企劃。

這招什麼時候別用?

需要精確事實與數字的工作,以及你想保住的核心能力,別全交給碎念。實際風險有三種:

  • 轉錄可能出錯:語音轉文字不是逐字紀錄,OpenAI 官方也提醒轉錄結果可能與實際說的話有出入。重要的名詞與數字,送出前先掃一眼。

  • AI 可能補入你沒講的內容:卡帕西 2023 年有個著名論點:LLM 本質上是「做夢機器」(dream machines),幻覺不是故障,而是模型隨時在做的事。它能把碎念整理得又順又完整,也可能把你沒講到的部分填錯。先前介紹過的卡帕西 AI 知識庫設定法提過類似風險:小錯一旦被存下來當成事實,會像雪球一樣越滾越大。

  • 錄音會上傳雲端:Claude Code 與 ChatGPT 的語音功能,都是把錄音送到伺服器處理,不是在本機轉錄。涉及公司機密或個資的內容,開口前先想一下。

最後是能力問題。把「整理思路」長期外包給 AI,自己組織想法、動筆寫作的肌肉可能鈍化。一個實用的平衡做法是,讀完 AI 的產出後,自己動手把理解重寫成幾條精煉重點。腦力激盪、規劃草案放心碎念;涉及精確數字、事實引用或對外發布的內容,AI 整理的版本務必逐項核對。

對中文使用者還有一個加分點:用支援中文的聽寫工具碎念時,中英夾雜、想不到精準的中文詞就直接講英文,AI 多半也能整理成通順的中文,不必為了「講乾淨」而卡住。

如果你常苦惱提示詞怎麼寫都不到位,不妨反過來試試卡帕西的方法:先把腦中的東西全部倒出來,再讓 AI 整理;先確認它聽懂,再讓它動工;最後,把事實查核與關鍵判斷留在自己手上。下次打開 AI,深呼吸,講就對了。

延伸閱讀:松下BBU霸主地位鬆動?AI機櫃改寫競爭規則,順達、AES-KY如何逆襲搶單?

資料來源:Andrej Karpathy X 貼文《TechCrunch》Karpathy 2023 年 X 貼文Claude Code 語音聽寫官方說明ChatGPT 聽寫官方說明VoiceMode 專案頁

本文初稿為AI編撰,整理.編輯/ 李先泰

延伸閱讀

楊植麟是誰?打造Kimi K3引爆美中角力,他為何放棄蘋果高薪回中國創業?
AI兆元資本支出大噴發!台積電資金活水,如何把台廠推向黃金成長期?
「加入《數位時代》LINE好友,科技新聞不漏接」

查看原始文章

更多理財相關文章

01

霸氣!黃仁勳夫妻豪捐24億資助「加州百年名校」 新學院直接冠名

太報
02

預售屋慘爆1/代銷最痛苦年代!「月銷」不到1戶成常態 中部大老喊「快逃!」

CTWANT
03

台股攻頂就拉回!杜金龍揭佈局1時機:有望挑戰6萬點

民視新聞網
04

〈美股早盤〉AI支出與百美元油價施壓!主要指數開低 道指一度崩逾600點

anue鉅亨網
05

超微AI大會來了/AMD合作大咖Anthropic再宣布投資50億美元 挑戰輝達霸主地位

鏡報
06

2檔ETF「重押記憶體巨頭」慘跌!專家推「黃金配置」避雷

民視新聞網
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...