返回「學測物理模擬卷 V1」題庫

學測物理模擬卷 V1|第 7 題

第一部分:選擇題(單選&多選)

Anthropic 開發的 Claude 系列大型語言模型在進行推論(文字生成)時,伺服器會消耗電能。一般而言,模型越大、推論過程越複雜,可能需要較高的推論功率;但若輸出速度也較快,則完成同樣輸出量所需時間可能較短,因此總耗能不一定只由功率大小決定。

某測試節點在相同硬體條件下,量測三種模型回答問題時的平均推論功率 P 與平均輸出速度 r,並列出各模型的單一對話 token 上限,結果如表(7)。其中,推論功率 P 是指模型運轉並產生輸出時的平均耗電功率,且此功率僅消耗於輸出 token(讀取輸入與其他過程的耗電忽略不計,即耗電時間等於產生 token 的時間);平均輸出速度 r 則定義為每秒輸出的 token 數(本題中可將 token 視為模型輸出文字的基本單位);單一對話 token 上限指一段對話中,所有輸入與輸出累計可使用的 token 總量。

假設每次查詢的輸出 token 數固定,且模型在輸出期間的功率近似為定值,且一段對話中,每次下達指令與模型回應的內容都會累積佔用該對話的 token 上限,直到達到上限為止。(1 度電=1 kWh=3.6×10⁶ J)

表(7):

模型推論功率 P(kW)輸出速度 r(token/s)單一對話 token 上限
Opus 4.812401,000,000(1M)
Fable 515751,000,000(1M)
Sonnet 55201,000,000(1M)
若以「每輸出一個 token 所消耗的電能」作為能源效率指標(是否省電的判斷依據),關於上述三者模型的比較,下列敘述何者正確?(多選,應選兩項)
  1. 推論功率 P 越大,則代表每 token 能耗一定越高。
  2. Fable 5 的推論功率 P 最大,故最不省電
  3. 若以每個 token 能耗計算,則 Fable 5 最省電
  4. 若三者模型輸出 token 的時間完全一致,則 Sonnet 5 所消耗的電能最大
  5. 單位時間內 Fable 5 可以輸出最多的 token 數
提示
每 token 能耗 = P ÷ r(功率除以輸出速率)。逐一算 Opus、Fable、Sonnet 的 P/r 再比較。
正確答案

正解:C、E

詳解
A. 錯誤。每 token 能耗為 P/r,功率大但速率也大時未必較高;例如 Fable P 最大卻最省電。
B. 錯誤。Fable 5 雖 P 最大,但 P/r = 15/75 = 0.2 為三者最低,反而最省電。
C. 正解。P/r:Opus 12/40 = 0.30、Fable 15/75 = 0.20、Sonnet 5/20 = 0.25,Fable 最小最省電。
D. 錯誤。時間相同時能耗 = P×t,Fable 的 P(15)最大,故 Fable 能耗最大而非 Sonnet。
E. 正解。單位時間輸出量即輸出速度 r,Fable r = 75 為三者最高。

查看全部題目+答案+詳解所有公開題庫

所有公開題庫(含題目與詳解全文)