中文比英文貴?
按字元數計,中文每個字約需 0.7–1 個詞元,英文每個字元(連空格、標點)只約 0.2 個——同樣 100 個字元,中文貴三至五倍。
但一個中文字承載的意思比一個英文字母多得多。改為比較「同一句話」(下表),結果完全不同:
模型並不是逐「字」閱讀,而是先把文字切成一段段的詞元(token),再按詞元數量收費。貼上任何文字,下方三個分詞器會即時重新計算。
建議先按「中文段落」與「English paragraph」各看一次,再試「一份三頁報告」,留意詞元數如何隨文字長度與語言改變。
同一段文字,交給不同公司的分詞器(tokenizer),會切出不同數量的詞元。每一個色塊就是一個詞元;把滑鼠移到(或點選)色塊,可以看到它在詞表(vocabulary)中的編號。
計數不包含透過程式介面(API)呼叫時額外加入的少量格式詞元(例如標示「這一句是用戶說的」的標記),因此真實用量會略高於此處顯示。長文只繪出前 600 個詞元的色塊,但數字一律為全文精確值。
當你透過程式介面(API)直接使用模型——這也是本課程之後建立個人 AI 助理的方式——服務商按「每百萬個詞元」收費。下方價格表是 2026-09 的公開價格(人民幣 ¥),可以直接修改試算。
| 供應商/模型 | 本段作為輸入 | ¥10 可貼上 | 20 次/天 × 10 週 |
|---|
| 供應商/模型 | 輸入 | 輸出 | 快取命中 |
|---|
GPT-4o 以美元計價且不在本課程使用,故不列入價格表;其詞元數僅供比較切法。
模型本身不會記住上一輪說過甚麼:聊天程式背後的 API 每一輪都要把整段對話歷史重新送給模型。以目前這段文字作為每一輪的訊息,看看詞元數如何累積。
按字元數計,中文每個字約需 0.7–1 個詞元,英文每個字元(連空格、標點)只約 0.2 個——同樣 100 個字元,中文貴三至五倍。
但一個中文字承載的意思比一個英文字母多得多。改為比較「同一句話」(下表),結果完全不同:
課堂討論用,每題兩分鐘。
第 2 題可引導的方向:錢主要花在一再重新送出的歷史,而不是新的一句;可以先請模型摘要前文再開新對話、只送報告中相關的段落、把「討論」與「查閱」分開,以及善用供應商的快取命中價。