七個模型,同一份考卷(Artificial Analysis Intelligence Index v4.3.2)。資料擷取:2026-10-08。點任一列看明細。
名次只在這七個模型之間比。Artificial Analysis 各模型頁上的名次母數不同(有的寫 /182、有的寫 /225),不能跨頁直接比名次,所以本表只用原始數字重排。
| 情境 | 優先考慮(依這份評測,待我實測) | 為什麼 |
|---|---|---|
| 大量雜活:搜尋、分類、格式整理 | GPT-6 Luna | 每 1 美元分數 543,是第二名的約 2.7 倍。 |
| 要準一點的日常工作、寫程式、操作電腦 | Haiku 5.5 | 平價層裡分數最高(43),每題 $0.21 仍便宜;但 Max 版首字要等 7 分鐘,適合背景跑。 |
| 即時對話、要馬上回 | Gemini 3.8 Flash/Haiku 4.5 | 首字 24 秒、14 秒,等待最短;Haiku 4.5 在這份考卷分數 17,比較適合簡單問答。 |
| 長文件:逐字稿、整份資料 | GPT-6 Luna | Haiku 5.5 超過 10 萬 Token 單價漲 5 倍,Luna 到 27.2 萬才加價。 |
| 重要判斷、難題、審稿 | GPT-6 Sol/Sonnet 5.5/Opus 5.5 | 分數 48 到 58。Sol 每題 $1.04,是 Sonnet、Opus 的五分之一左右,先試 Sol,不夠再升級。 |
分數、速度、Token 用量、每題成本、首字延遲:Artificial Analysis 各模型頁(2026-10-08 擷取)。
Haiku 5.5 長文件加價:Claude 官方定價頁。GPT-6 Luna 長文件加價:eesel 定價整理(第三方整理,非 OpenAI 官方頁)。
台幣以 1 美元約 32 元換算。每題成本是 Artificial Analysis 考卷的平均題,實際工作的花費依任務長短不同,請看相對倍數,不要看絕對金額。