學測物理模擬卷 V1|第 7 題
第一部分:選擇題(單選&多選)
Anthropic 開發的 Claude 系列大型語言模型在進行推論(文字生成)時,伺服器會消耗電能。一般而言,模型越大、推論過程越複雜,可能需要較高的推論功率;但若輸出速度也較快,則完成同樣輸出量所需時間可能較短,因此總耗能不一定只由功率大小決定。
某測試節點在相同硬體條件下,量測三種模型回答問題時的平均推論功率 P 與平均輸出速度 r,並列出各模型的單一對話 token 上限,結果如表(7)。其中,推論功率 P 是指模型運轉並產生輸出時的平均耗電功率,且此功率僅消耗於輸出 token(讀取輸入與其他過程的耗電忽略不計,即耗電時間等於產生 token 的時間);平均輸出速度 r 則定義為每秒輸出的 token 數(本題中可將 token 視為模型輸出文字的基本單位);單一對話 token 上限指一段對話中,所有輸入與輸出累計可使用的 token 總量。
假設每次查詢的輸出 token 數固定,且模型在輸出期間的功率近似為定值,且一段對話中,每次下達指令與模型回應的內容都會累積佔用該對話的 token 上限,直到達到上限為止。(1 度電=1 kWh=3.6×10⁶ J)
表(7):
| 模型 | 推論功率 P(kW) | 輸出速度 r(token/s) | 單一對話 token 上限 |
|---|---|---|---|
| Opus 4.8 | 12 | 40 | 1,000,000(1M) |
| Fable 5 | 15 | 75 | 1,000,000(1M) |
| Sonnet 5 | 5 | 20 | 1,000,000(1M) |
- 推論功率 P 越大,則代表每 token 能耗一定越高。
- Fable 5 的推論功率 P 最大,故最不省電
- 若以每個 token 能耗計算,則 Fable 5 最省電
- 若三者模型輸出 token 的時間完全一致,則 Sonnet 5 所消耗的電能最大
- 單位時間內 Fable 5 可以輸出最多的 token 數
提示
每 token 能耗 = P ÷ r(功率除以輸出速率)。逐一算 Opus、Fable、Sonnet 的 P/r 再比較。
正確答案
正解:C、E
詳解
A. 錯誤。每 token 能耗為 P/r,功率大但速率也大時未必較高;例如 Fable P 最大卻最省電。
B. 錯誤。Fable 5 雖 P 最大,但 P/r = 15/75 = 0.2 為三者最低,反而最省電。
C. 正解。P/r:Opus 12/40 = 0.30、Fable 15/75 = 0.20、Sonnet 5/20 = 0.25,Fable 最小最省電。
D. 錯誤。時間相同時能耗 = P×t,Fable 的 P(15)最大,故 Fable 能耗最大而非 Sonnet。
E. 正解。單位時間輸出量即輸出速度 r,Fable r = 75 為三者最高。