返回「學測物理模擬卷 V1」題庫

學測物理模擬卷 V1|第 8 題

第一部分:選擇題(單選&多選)

Anthropic 開發的 Claude 系列大型語言模型在進行推論(文字生成)時,伺服器會消耗電能。一般而言,模型越大、推論過程越複雜,可能需要較高的推論功率;但若輸出速度也較快,則完成同樣輸出量所需時間可能較短,因此總耗能不一定只由功率大小決定。

某測試節點在相同硬體條件下,量測三種模型回答問題時的平均推論功率 P 與平均輸出速度 r,並列出各模型的單一對話 token 上限,結果如表(7)。其中,推論功率 P 是指模型運轉並產生輸出時的平均耗電功率,且此功率僅消耗於輸出 token(讀取輸入與其他過程的耗電忽略不計,即耗電時間等於產生 token 的時間);平均輸出速度 r 則定義為每秒輸出的 token 數(本題中可將 token 視為模型輸出文字的基本單位);單一對話 token 上限指一段對話中,所有輸入與輸出累計可使用的 token 總量。

假設每次查詢的輸出 token 數固定,且模型在輸出期間的功率近似為定值,且一段對話中,每次下達指令與模型回應的內容都會累積佔用該對話的 token 上限,直到達到上限為止。(1 度電=1 kWh=3.6×10⁶ J)

表(7):

模型推論功率 P(kW)輸出速度 r(token/s)單一對話 token 上限
Opus 4.812401,000,000(1M)
Fable 515751,000,000(1M)
Sonnet 55201,000,000(1M)
今甲生為了使用 Opus 4.8 校正「學測物理模擬卷」,故需連續下達多次指令。假設每次甲生下指令後,該對話中新增的平均 token 數為 1000 個。若下達指令所新增的 token 相對甚小故可以忽略不計,則當此對話達到「單一對話 token 上限」時,請問此模型在回應時總共消耗的電能最接近下列何者選項?
  1. 40 度
  2. 80 度
  3. 120 度
  4. 160 度
  5. 200 度
提示
輸出總量約等於 token 上限;輸出時間 = 上限 ÷ r,能耗 = P × 時間,再換算成度(kWh)。
正確答案

正解:B

詳解
A. 錯誤。40 度低估;未用足 25000 s 的輸出時間。
B. 正解。Opus 輸出約 10⁶ token,時間 = 10⁶ ÷ 40 = 2.5×10⁴ s;能耗 = 12 kW × 2.5×10⁴ s = 3×10⁵ kWs ÷ 3600 ≈ 83 度 ≈ 80 度。
C. 錯誤。120 度高估約 1.5 倍。
D. 錯誤。160 度約為正解的兩倍。
E. 錯誤。200 度嚴重高估。

查看全部題目+答案+詳解所有公開題庫

所有公開題庫(含題目與詳解全文)