學測物理模擬卷 V1|第 8 題
第一部分:選擇題(單選&多選)
Anthropic 開發的 Claude 系列大型語言模型在進行推論(文字生成)時,伺服器會消耗電能。一般而言,模型越大、推論過程越複雜,可能需要較高的推論功率;但若輸出速度也較快,則完成同樣輸出量所需時間可能較短,因此總耗能不一定只由功率大小決定。
某測試節點在相同硬體條件下,量測三種模型回答問題時的平均推論功率 P 與平均輸出速度 r,並列出各模型的單一對話 token 上限,結果如表(7)。其中,推論功率 P 是指模型運轉並產生輸出時的平均耗電功率,且此功率僅消耗於輸出 token(讀取輸入與其他過程的耗電忽略不計,即耗電時間等於產生 token 的時間);平均輸出速度 r 則定義為每秒輸出的 token 數(本題中可將 token 視為模型輸出文字的基本單位);單一對話 token 上限指一段對話中,所有輸入與輸出累計可使用的 token 總量。
假設每次查詢的輸出 token 數固定,且模型在輸出期間的功率近似為定值,且一段對話中,每次下達指令與模型回應的內容都會累積佔用該對話的 token 上限,直到達到上限為止。(1 度電=1 kWh=3.6×10⁶ J)
表(7):
| 模型 | 推論功率 P(kW) | 輸出速度 r(token/s) | 單一對話 token 上限 |
|---|---|---|---|
| Opus 4.8 | 12 | 40 | 1,000,000(1M) |
| Fable 5 | 15 | 75 | 1,000,000(1M) |
| Sonnet 5 | 5 | 20 | 1,000,000(1M) |
- 40 度
- 80 度
- 120 度
- 160 度
- 200 度
提示
輸出總量約等於 token 上限;輸出時間 = 上限 ÷ r,能耗 = P × 時間,再換算成度(kWh)。
正確答案
正解:B
詳解
A. 錯誤。40 度低估;未用足 25000 s 的輸出時間。
B. 正解。Opus 輸出約 10⁶ token,時間 = 10⁶ ÷ 40 = 2.5×10⁴ s;能耗 = 12 kW × 2.5×10⁴ s = 3×10⁵ kWs ÷ 3600 ≈ 83 度 ≈ 80 度。
C. 錯誤。120 度高估約 1.5 倍。
D. 錯誤。160 度約為正解的兩倍。
E. 錯誤。200 度嚴重高估。