全站模型 85 折 🎉 相對模型開發商官方標價再省 15%。瀏覽模型 →
部落格
ApiFlux Team閱讀時間 25 分鐘

Claude API 定價 2026:Token 成本、模型與省錢方案

Claude API 2026 定價:每百萬 Token 模型費率、Batch API 五折、Prompt 快取成本、速率限制、ApiFlux 閘道器價格,以及成本計算器。

Claude API 定價 2026:Token 成本、模型與省錢方案

目錄

Claude API 每百萬輸入 Token 收費 $1–$10,每百萬輸出 Token 收費 $5–$50(Haiku 4.5 到 Fable 5.1),截至 2026 年 9 月 4 日。Batch 處理為非同步任務提供標準費率五折;Prompt 快取有獨立的寫入和讀取定價。對於透過閘道器路由的團隊,ApiFlux 公佈的 Claude Sonnet 5 價格為 $1.70 輸入 / $8.50 輸出 / 每 MTok——即 Anthropic 標價的 85%——但這是廠商公佈的宣告,非獨立審計費率。價格具有時效性,制定預算前請重新核對 Anthropic 實時定價。

速覽

  • Claude API 按使用量計費,非固定月訂閱。
  • 輸入和輸出 Token 費率不同,輸出更貴。
  • Haiku 4.5 標準費率最低($1 / $5 每 MTok)。
  • Sonnet 5 是通用候選,$2 / $10 現為標準定價。
  • Batch API 為非同步任務提供標準 Token 價五折。
  • Prompt 快取僅在快取 TTL 內複用穩定字首時有效。
  • ApiFlux 公佈標價的 85%(如 Sonnet 5 為 $1.70 / $8.50)及 $1 起始額度,均為廠商宣告。

快速回答:Claude API 多少錢?

Anthropic 官方 Claude API 當前標準模型費率:

模型輸入 / 每 MTok輸出 / 每 MTok適用場景
Claude Fable 5.1$10$50高難度推理與長週期 Agent 任務,受可用性限制
Claude Opus 5$5$25複雜編碼、Agent 與企業級工作負載
Claude Sonnet 5$2$10通用型速度與能力平衡(現為標準定價)
Claude Haiku 4.5$1$5快速、低成本任務與高吞吐工作負載

來源:Anthropic 定價文件,核驗日期 2026 年 9 月 4 日。

官方價 vs ApiFlux——標價對比(ApiFlux 資料為廠商公佈,核驗日期 2026 年 9 月 4 日):

模型Anthropic 官方(入 / 出)ApiFlux 標價(入 / 出)標價差異活躍通道
Claude Fable 5.1$10 / $50$8.50 / $42.50−15%Anthropic
Claude Opus 5$5 / $25$4.25 / $21.25−15%Anthropic, Bedrock, Vertex AI
Claude Sonnet 5$2 / $10$1.70 / $8.50−15%Anthropic
Claude Haiku 4.5$1 / $5$0.85 / $4.25−15%Anthropic

來源:Anthropic 官方費率來自定價文件;ApiFlux 標價來自 apiflux.ai/models/anthropic,核驗日期 2026 年 9 月 7 日。ApiFlux 資料為廠商宣告,非獨立基準測試。

快速決策——從哪個模型開始?

如果你需要……先評估……主要取捨
最低 Token 標價Haiku 4.5可能需要更多驗證
通用生產平衡Sonnet 5用你自己的任務集測試
複雜編碼或長週期 AgentOpus 5Token 費率更高
不計成本的高難度推理Fable 5.1價格更高且有可用性風險
離線批次處理Batch API無實時響應
統一金鑰、統一餘額、多通道路由與日誌ApiFlux 等閘道器需驗證額外依賴

Anthropic 的模型概覽將 Fable 5.1 定位為高難度推理、Opus 5 定位為複雜 Agent 編碼與企業工作、Sonnet 5 定位為速度-智慧平衡、Haiku 4.5 定位為最低延遲與價格。這些是廠商定位宣告,非獨立基準測試結果。生產決策請用你自己的資料測試代表性 Prompt。

以上價格涵蓋標準官方 Token 使用量。實際成本還可能包括:

  • 輸入 Token,含相關工具定義和工具結果。
  • 模型生成的輸出 Token。
  • Prompt 快取寫入與快取讀取。
  • 非同步處理時的 Batch API 定價。
  • 服務端工具費用,如 Web 搜尋。
  • 可選服務修飾符,如僅限美國推理(inference_geo: "us",1.1 倍)或快速模式。
  • Amazon Bedrock、Google Cloud、Microsoft Foundry 等平臺的不同定價、計費單位、可用性和生命週期政策。

Claude API 定價計算器

Anthropic 在其當前定價文件中列出 Sonnet 5 為每百萬輸入 Token $2、每百萬輸出 Token $10。基本 Token 成本公式為:

基礎輸入成本  = 月請求數 × 平均輸入 Token  ÷ 1,000,000 × 輸入費率
基礎輸出成本  = 月請求數 × 平均輸出 Token  ÷ 1,000,000 × 輸出費率
重試調整成本  = 基礎成本 × (1 + 重試率)
單次合格結果成本 = 總成本 ÷ 合格生產結果數

使用下方互動式計算器估算月度帳單。調整模型、請求量、Token 數、快取命中率和 Batch 使用量,查看 Anthropic 直連成本與 ApiFlux 廠商標價的對比。

Claude API Cost Calculator

Direct Anthropic
$8,000
/ month
Via ApiFlux (85%)
$6,800
/ month, vendor-listed
Listed savings
$1,200
/ month, if rates apply

Estimates use published per-MTok rates. Actual costs depend on cache writes, tool fees, retries, taxes, and negotiated terms. ApiFlux figures are vendor-published claims, not guaranteed quotes.

以 Claude Sonnet 5 為例,使用上述費率(單次請求含 20,000 輸入 Token 和 4,000 輸出 Token):

輸入:  20,000 ÷ 1,000,000 × $2  = $0.04
輸出:   4,000 ÷ 1,000,000 × $10 = $0.04
單次請求估算成本                 = $0.08

這是所示模型 Token 的簡單估算,不含快取操作、服務端工具費用、稅費、商務談判條款、失敗請求處理或平臺特定計費差異。如需面向編碼模型的並排比較以輔助選型,請參閱我們的 2026 最佳程式設計 LLM 指南。

Claude API 計費原理

輸入和輸出 Token 定價不同

當前所有模型中,輸出 Token 均比輸入 Token 貴。生成不必要長回答的應用,成本可能遠高於傳送大量但穩定上下文並請求簡潔響應的應用。

在降低模型質量以節省費用之前,先檢查是否可以:

  1. 設定合適的最大輸出長度。
  2. 請求結構化、簡潔的響應。
  3. 從每次請求中移除無關上下文。
  4. 用 Prompt 快取複用穩定指令。
  5. 將簡單、可預測的任務路由到更低成本模型。
  6. 衡量重試和人工稽核,而非僅看原始 Token 使用量。

工具、重試和失敗迴圈也計入成本

帶工具的 Claude API 請求不僅按可見的使用者問題計費。Token 使用量可能包括成為模型上下文一部分的工具定義和工具結果,以及自動工具使用系統 Prompt。Anthropic 定價文件當前列出 Web 搜尋為 每 1,000 次搜尋 $10,外加搜尋生成內容的標準 Token 費用。Web 抓取除進入對話上下文的內容的標準 Token 費用外無額外收費。較新的服務端工具(程式碼執行、文字編輯器、計算機使用、瀏覽器使用)會增加各自的輸入 Token 開銷,某些情況下還會計費執行時間。

估算工具型應用時,至少記錄:使用者和系統輸入 Token、工具定義 Token、工具結果 Token、搜尋或其他服務端工具呼叫、輸出 Token、重試和失敗工具迴圈、快取寫入與讀取,以及人工稽核或下游處理。在純聊天測試中看起來便宜的模型,一旦連線搜尋、程式碼執行、檢索或多步 Agent 迴圈,成本結構可能截然不同。

Claude API 各模型價格與選型

下表彙總了 Anthropic 模型概覽定價文件中列出的主要當前模型。價格為官方 Claude API 基礎費率,核驗日期 2026 年 9 月 4 日。

模型API ID輸入 / 輸出 / 每 MTok上下文視窗最大輸出
Claude Fable 5.1claude-fable-5-1$10 / $501M Token128K Token
Claude Opus 5claude-opus-5$5 / $251M Token128K Token
Claude Opus 4.8claude-opus-4-8$5 / $251M Token128K Token
Claude Opus 4.7claude-opus-4-7$5 / $251M Token128K Token
Claude Sonnet 5claude-sonnet-5$2 / $101M Token128K Token
Claude Sonnet 4.6claude-sonnet-4-6$3 / $151M Token128K Token
Claude Haiku 4.5claude-haiku-4-5-20251001$1 / $5200K Token64K Token

來源:Anthropic 定價模型概覽,核驗日期 2026 年 9 月 4 日。

Opus 4.8 和 Opus 4.7 與 Opus 5 同為 $5 / $25 費率、同為 1M 上下文視窗,因此遷移到 Opus 5 是能力升級而非價格變化。Sonnet 4.6 定價為 $3 / $15——比 Sonnet 5 的標準 $2 / $10 貴 50%——因此從 4.6 遷移到 Sonnet 5 可在相同上下文視窗下降低 Token 成本。Anthropic 定價頁還列出 Opus 4.6、Opus 4.5 和 Sonnet 4.5 與其直接繼任者相同費率;依賴任何舊模型 ID 前請核對實時表格。

模型 ID 和可用性因平臺而異。Anthropic 對 4.6 代及以後使用無日期模型 ID 格式(如 claude-opus-5),每個 ID 是固定快照,非永久指標——參見模型 ID 與版本文件。舊模型版本即使已退役,也可能出現在定價或生命週期文件中供參考。不要在未核對當前模型 API和生命週期文件的情況下,從舊文章複製模型 ID。

對於可復現的應用,記錄確切的模型 ID、Prompt 版本、工具配置、日期和評估結果。模型別名或合作雲部署名稱的行為可能與官方 Claude API 識別符號不同。

如何選擇合適的 Claude 模型

Claude API 決策路由——同步 vs Batch/快取,再按可預測性選擇 Haiku/Sonnet/Opus

在 ApiFlux,我們在生產環境中跨 Anthropic、Bedrock 和 Vertex 通道路由 Claude 工作負載。我們的評估方法是使用具有可執行成功標準的代表性 15–30 個任務集,重複執行,並追蹤單次合格結果成本——與我們 2026 最佳程式設計 LLM 指南中的框架相同。Token 價格是決策的輸入,而非決策本身。

決策樹:

需要立即響應嗎?
├── 是 → 使用同步 Messages API
└── 否
    ├── 大批次 → 評估 Batch API
    └── 重複長上下文 → 評估 Prompt 快取

任務可預測且易於驗證嗎?
├── 是 → 從 Haiku 4.5 開始
└── 否
    ├── 通用生產工作 → 評估 Sonnet 5
    └── 複雜編碼 / 推理 → 基準測試 Opus 5 或 Fable 5.1

場景到模型的決策表:

場景從哪個開始承諾前衡量不適用情況
高吞吐分類、抽取、路由、短轉換Haiku 4.5成功率、輸出長度、重試率、延遲、稽核負擔深度多步推理;廉價響應未透過驗證需反覆重試
通用助手、編碼工作流、結構化生成Sonnet 5首次成功率、工具可靠性、輸出長度、單次合格結果成本嚴格驗證失敗;長週期推理需要更高能力模型
複雜 Agent 編碼、企業工作負載、深度推理Opus 5固定任務集上的成功結果、重試負擔、稽核工作量Haiku 或 Sonnet 首次即透過的簡單高吞吐任務
廉價模型失敗的高難度推理、長週期 AgentFable 5.1廉價模型失敗的工作負載上的任務級成功率;可用性常規工作負載;價格敏感;需要保證可用性

Claude Haiku 4.5

價格: $1 輸入 / $5 輸出 / 每 MTok。

適用: 分類、抽取、路由、短轉換,以及其他輸出可自動檢查的高吞吐工作負載。

不適用: 需要深度多步推理,或廉價響應未透過驗證必須反覆重試的工作負載。

衡量指標: 正確分類或抽取率、平均輸出長度、重試率、所需流量級別的延遲、人工稽核負擔,以及單次合格結果總成本。需要反覆重試或人工糾正的廉價響應,可能比首次即透過驗證的高價響應更貴。

Claude Sonnet 5

價格: $2 輸入 / $10 輸出 / 每 MTok,現為標準定價。

適用: 通用助手功能、編碼工作流、結構化生成,以及中等複雜度 Agent 任務。

不適用: 模型未透過嚴格驗證,或需要更高能力模型的長多步推理的工作負載。

衡量指標: 首次成功率、重試率、延遲、輸出長度和單次合格結果成本,尤其當應用需要工具呼叫、長上下文、嚴格 JSON、多語言輸出或可靠的邊緣情況處理時。如需面向編碼的 LLM 選項的更完整比較,請參閱 ApiFlux 部落格上的 2026 最佳程式設計 LLM 指南。

Claude Opus 5

價格: $5 輸入 / $25 輸出 / 每 MTok。

適用: 複雜程式碼變更、深度推理、Agent 編碼,以及更少失敗嘗試可證明更高 Token 費率合理的企業工作負載。

不適用: Haiku 或 Sonnet 首次即透過的簡單、高吞吐、易驗證任務。

衡量指標: 固定任務集上的成功結果、重試負擔、延遲和稽核工作量。不要將 Anthropic 的定位轉化為"Opus 5 對每個專案都是最具成本效益模型"的籠統宣告。

Claude Fable 5.1

價格: $10 輸入 / $50 輸出 / 每 MTok。

適用: 廉價模型在評估中不足的高難度推理和長週期 Agent 工作。

不適用: 大多數常規工作負載——其價格遠高於 Sonnet 5 或 Haiku 4.5。

衡量指標: 廉價模型失敗的特定工作負載上的任務級成功率,以及可用性和訪問許可權。有限可用性或不斷變化的預覽產品不應被視為普遍可訪問的生產依賴。

降低成本:Prompt 快取與 Batch API

Prompt 快取降低重複傳送相同 Prompt 字首的成本,如大型系統指令、參考文件、工具定義集或對話歷史。當穩定內容較大且在快取生存時間內複用時最有效。Anthropic 的 Prompt 快取文件列出了相對於模型基礎輸入價格的標準快取倍率:

快取操作定價倍率TTL 或含義
5 分鐘快取寫入基礎輸入的 1.25 倍快取有效期 5 分鐘
1 小時快取寫入基礎輸入的 2 倍快取有效期 1 小時
快取讀取(命中)基礎輸入的 0.1 倍適用於快取命中

來源:Anthropic Prompt 快取文件,核驗日期 2026 年 9 月 4 日。

Anthropic 當前定價表列出 Claude Fable 5.1 快取命中和重新整理為 $0.25 / 每 MTok,即其 $10 基礎輸入費率的 0.025 倍。由於快取定價因模型而異且具有時效性,釋出前請重新核對模型特定表格。

按標準倍率,5 分鐘快取在一次成功快取讀取後回本(1.25 倍寫入 vs 第二次完整 1 倍輸入),1 小時快取在兩次成功讀取後回本(2 倍寫入 vs 三次 1 倍輸入)。例如,對於輸入費率為 $2 / 每 MTok 的模型,不使用快取傳送三次相同合格字首需三次基礎輸入費用;1 小時快取首次寫入 2 倍加兩次讀取各 0.1 倍,總計 2.2 倍。

關於疊加的說明: Batch、快取和資料駐留修飾符可能相互作用,但這些修飾符不會使總賬單自動可預測。分別計算每個 Token 類別,並確認所選模型和平臺的計費規則。

Prompt 快取盈虧平衡——無快取 3.0 倍,5 分鐘快取 1.45 倍,1 小時快取 2.2 倍

此盈虧平衡分析假設字首足夠長可快取、斷點前內容未變、後續請求在 TTL 內到達,且確實發生快取命中。輸出 Token 和未快取字尾 Token 不在此狹義比較範圍內。

如何設計快取友好的 Prompt

將穩定內容放在可變內容之前:

穩定系統指令
穩定工具和 Schema
穩定參考文件
快取斷點
可變使用者問題

斷點前內容的變更可能使快取段失效。因此,快取策略應使用與生產相同的請求形狀測試,而非僅用小型演示 Prompt。

Batch API:非同步任務五折

Anthropic 的 Message Batches API專為不需要立即響應的大批次請求設計。官方文件稱其提供標準 API 定價五折,並非同步處理請求。

模型標準輸入 / 輸出 / 每 MTokBatch 輸入 / 輸出
Claude Fable 5.1$10 / $50$5 / $25
Claude Opus 5$5 / $25$2.50 / $12.50
Claude Sonnet 5$2 / $10$1 / $5
Claude Haiku 4.5$1 / $5$0.50 / $2.50

來源:Anthropic Message Batches 文件,核驗日期 2026 年 9 月 4 日。

同步 vs 非同步——你需要哪個?

同步 Messages APIMessage Batches API
延遲實時響應大多數批次在一小時內完成
價格標準費率標準費率五折
適用使用者等待答案評估、離線分析、批次分類、定時任務
限制模型速率限制每批 100,000 請求或 256 MB;須在 24 小時內完成
結果處理內聯響應JSONL 檔案,結果 29 天內可下載

來源:Anthropic Message Batches 文件,核驗日期 2026 年 9 月 4 日。

將 Batch 資料視為基於公佈五折的計算示例,而非每個平臺或計費安排的通用報價。Prompt 快取和其他定價修飾符與 Batch 定價相互作用。

Batch API 還有運營約束。請求獨立處理,結果不保證保持輸入順序,不支援流式、快速模式和 max_tokens: 0。使用唯一的 custom_id 值,並圍繞這些 ID 構建結果匹配策略。如需支援跨多通道的同步和非同步 Claude 工作負載的閘道器,請參閱 ApiFlux 設定指南

速率限制與月度消費上限

Anthropic 於 2026 年 6 月 26 日將數字 Tier 1–4 系統替換為命名層級——Start、Build、Scale,外加 Custom 銷售層級。組織根據使用歷史和賬戶狀態自動升級,無需直接購買層級。每個層級有月度消費上限:

層級月度消費上限典型用途
Start$500原型開發、個人開發者
Build$1,000小團隊、內部工具
Scale$200,000生產應用
Custom無上限企業、談判

達到上限返回 HTTP 429。每模型 RPM/TPM 上限也適用且因層級而異——當前數字請查閱 Anthropic 速率限制文件。ApiFlux 等閘道器可遮蔽不同提供商的速率限制差異,但無法移除上游提供商的消費上限。

Claude API vs 替代方案:訂閱、雲平臺與 OpenAI

vs Claude 訂閱定價

Claude API 是按需付費:按應用使用的 Token 和功能計費。它不是消費者或團隊訂閱的預付費包,訂閱不應被視為預付費 API 額度。

選項計費模式適用物件
Claude API每 MTok Token 使用量 + 功能費用應用、服務、自動化、整合
Claude Pro帶使用限制的月訂閱個人使用者
Claude Max更高限制的高階訂閱高頻個人使用者
Team / Enterprise帶席位的團隊訂閱組織
Claude Code + Console取決於 Console/API 計費路徑開發團隊

單獨的 Claude 消費者或團隊計劃(如聊天/桌面訂閱層級)購買的是產品訪問權,非 API 容量。如果你在構建應用,應將 API Token 成本、消費限制和速率限制與你持有的任何 Claude 訂閱分開規劃。

vs 雲平臺:Bedrock 和 Vertex AI

除非章節另有說明,本文價格指官方 Claude API。不應自動應用於 Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundry、AWS 上的 Claude Platform、經銷商、閘道器或其他 API 提供商。

平臺計費備註
Claude API(官方)每 MTok Token 費率本文價格和倍率
Amazon Bedrock提供商開票;區域/全球端點區域端點比全球端點溢價 10%
Google Cloud Vertex AI提供商開票;區域/全球/多區域端點區域端點比全球端點溢價 10%
AWS 上的 Claude Platform透過 AWS Marketplace 的 Claude 消費單位(CCU)Token 使用量按每 CCU $0.01 轉換為 CCU

合作平臺可能使用不同的計費單位、區域定價、模型 ID、可用性規則和退役時間表。比較提供商時,先標準化比較:

  1. 儘可能使用相同的模型代際和模型行為。
  2. 確認價格是否分別針對輸入、輸出、快取和工具。
  3. 檢查是否適用稅費、雲費用或區域倍率。
  4. 驗證確切的模型 ID 和可用性。
  5. 用相同成功標準比較固定工作負載。ApiFlux 等閘道器可在一個金鑰和一個餘額後遮蔽這些平臺差異——瀏覽完整模型目錄檢視每個模型支援的通道。

vs OpenAI API 定價

如果你在生產工作負載中選擇 Claude 和 OpenAI 模型,按單次合格結果成本標準化比較,而非僅看標價。下表比較代表性官方費率;OpenAI GPT-5.6 價格為促銷費率,至少持續到 2026 年 11 月 21 日(來自 OpenAI 官方定價,核驗日期 2026 年 9 月 7 日);超過 272K 輸入 Token 的 Prompt 按 2 倍輸入 / 1.5 倍輸出計費。採購前請核對 OpenAI 當前定價頁

模型系列輸入 / 輸出 / 每 MTok上下文視窗適用場景
Claude Haiku 4.5$1 / $5200K高吞吐、低延遲任務
GPT-5.6 Luna(OpenAI)$0.20 / $1.201.05M成本敏感、高吞吐
Claude Sonnet 5$2 / $101M通用平衡
GPT-5.6 Terra(OpenAI)$2 / $121.05M平衡型編碼與工具使用
Claude Opus 5$5 / $251M複雜編碼與 Agent
GPT-5.6 Sol(OpenAI)$4 / $201.05M複雜推理、工具密集型編碼

Claude 費率來自 Anthropic 官方定價,核驗日期 2026 年 9 月 4 日。OpenAI GPT-5.6 費率來自 OpenAI 官方定價,核驗日期 2026 年 9 月 7 日;促銷至 2026 年 11 月 21 日。

影響實際賬單的關鍵差異:

  • 上下文視窗: Claude Sonnet 5 和 Opus 5 提供 1M Token 上下文;GPT-5.6 模型提供 1.05M 上下文視窗,與 Claude 的 1M 相當。雙方更大的上下文都可減少檢索和分塊開銷。
  • Prompt 快取: 兩個平臺都提供快取輸入折扣。Anthropic 的 5 分鐘快取寫入為 1.25 倍、讀取為 0.1 倍;OpenAI 的快取輸入折扣因模型和層級而異。假設任一方更便宜前,請計算實際快取命中率。
  • Batch 折扣: Anthropic 透過 Message Batches API 提供五折。OpenAI 在選定模型上提供 Batch 折扣。如果你的工作負載是非同步的,Batch 可能主導價格比較。
  • 工具和搜尋費用: 雙方均單獨收取服務端工具使用費。Anthropic 列出 Web 搜尋為每 1,000 次 $10;OpenAI 的 Web 搜尋定價因模型層級而異。
  • 輸出 Token 行為: 對於相同 Prompt,OpenAI 模型有時產生更短或更長的輸出。20% 的輸出長度差異可能超過 15% 的輸入價格差距。

結論: Claude Haiku 4.5 的原始 Token 價格高於 GPT-5.6 Luna,但雙方均提供 1M+ 上下文。對於通用工作,Sonnet 5($2/$10)和 GPT-5.6 Terra($2/$12)價格接近——決策應取決於你自己評估集上的任務成功率、輸出長度和工具可靠性,而非僅看標價。

ApiFlux 如何降低運維複雜度

商業披露: 提及 ApiFlux 是因為它運營本釋出專案。本節中的定價、功能和折扣宣告為廠商公佈的宣告,非獨立基準測試結果。採購決策前請自行驗證。

問題。 使用多個模型提供商的團隊可能需要管理多個 API 金鑰、餘額、模型 ID、速率限制和使用儀表板。這種運維開銷與 Anthropic 公佈的 Token 費率是分開的。當單個提供商遭遇中斷或速率限制節流時,依賴單一端點的應用可能在提供商恢復前失敗。

ApiFlux 公佈的能力。 ApiFlux 官網將其呈現為 AI 路由器和閘道器,提供一個 API 金鑰即可訪問 100+ 前沿模型,包括 Claude、GPT、Gemini、DeepSeek、Qwen 和 Kimi。它公佈原生 Anthropic、OpenAI 和 Gemini 相容端點、自動故障轉移、透明的按 Token 計費、統一共享餘額和使用監控。對於相容客戶端,連線可能只需更改 base URL 和金鑰——但在假設無需其他更改前,請確認你程式碼使用的端點和模型 ID。

多通道路由。 ApiFlux 公佈 Claude 請求可跨多個上游通道路由——包括 Anthropic 官方 API、Amazon Bedrock 和 Google Cloud Vertex AI——這樣當一個通道被節流或不可用時,閘道器可故障轉移到另一個。公佈的架構為:

你的應用
    │  一個 API 金鑰,一個餘額

ApiFlux 閘道器
    ├── Anthropic 官方 API    (通道 1)
    ├── Amazon Bedrock       (通道 2)
    └── Google Cloud Vertex AI (通道 3)


    Claude 模型響應

這是廠商描述的路由拓撲。依賴它之前,請用你自己的工作負載測試故障轉移行為:確認你使用的模型 ID 實際可用哪些通道、路由決策如何做出、快取和工具計費是否跨通道保留,以及故障轉移是否改變模型行為或區域端點。

視為未驗證的廠商宣告。 ApiFlux 公佈定價為廠商官方標價的 85%(其 Claude 標價,核驗日期 2026 年 9 月 4 日,如下所示),當前公佈註冊時**$1 起始額度**且無需信用卡。這些是廠商公佈的商業宣告,非獨立審計的節省結果。ApiFlux 在其公開資料中描述零資料保留——這指 Prompt 和響應內容,非計費/路由後設資料(請求 ID、時間戳、Token 計數和模型路由會記錄用於開票和除錯)。傳送敏感 Prompt 前請查閱當前隱私和保留條款,並在依賴任一宣告前用你自己的工作負載測試故障轉移行為。

模型Anthropic 官方(入 / 出 / 每 MTok)ApiFlux 標價(入 / 出 / 每 MTok)
Claude Fable 5.1$10 / $50$8.50 / $42.50
Claude Opus 5$5 / $25$4.25 / $21.25
Claude Sonnet 5$2 / $10$1.70 / $8.50
Claude Haiku 4.5$1 / $5$0.85 / $4.25

來源:Anthropic 費率來自官方定價文件;ApiFlux 標價來自 apiflux.ai/models/anthropic,核驗日期 2026 年 9 月 4 日。廠商公佈的宣告。

整合示例。 對於相容的 Anthropic SDK 客戶端,將 base URL 切換到 ApiFlux 可以很簡短:

from anthropic import Anthropic

client = Anthropic(
    api_key="your-apiflux-key",
    base_url="https://apiflux.ai",
)

response = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Hello, ApiFlux!"}],
)

這是面向相容客戶端的說明性示例。部署前請在 ApiFlux 文件中確認確切的 base URL、模型 ID 格式、認證方法和功能支援。

生產使用前需驗證。 確認支援哪些 Claude 模型 ID(ApiFlux 列出 Claude Fable 5.1Claude Sonnet 5)、端點是否相容 Anthropic Messages API 格式、輸入/輸出/快取/工具使用量如何報告、路由是否改變模型或部署區域、餘額、退款、失敗請求和速率限制如何處理、請求日誌儲存和保留在哪裡,以及公佈的折扣是否適用於包括快取讀取和 Batch 使用在內的所有功能。

從哪裡開始:

準備好比較 ApiFlux 上的 Claude API 費率了嗎?

月度成本示例與敏感性分析

這些示例是基於公佈費率的說明性計算。在生產中,ApiFlux 團隊追蹤路由工作負載的單次合格結果成本——包括重試、工具呼叫和稽核負擔——而非僅看 Token 支出。完整評估方法請參閱我們的 2026 最佳程式設計 LLM 指南

以下說明性月度估算使用上述基礎費率,未計快取和 Batch 效果:

工作負載示例模型月請求數平均輸入 / 輸出 Token月度估算
高吞吐分類Haiku 4.55,000,0001,500 / 200≈ $12,500
通用助手Sonnet 5500,0004,000 / 800≈ $8,000
複雜 Agent 編碼Opus 5100,00020,000 / 4,000≈ $20,000

詳細示例——Sonnet 5 上的通用助手。 假設一個應用每月服務 500,000 次請求。每次請求傳送 4,000 輸入 Token(系統 Prompt + 對話歷史 + 使用者問題)並接收 800 輸出 Token。

月輸入 Token:  500,000 × 4,000 = 2,000,000,000  = 2,000 MTok
月輸出 Token:  500,000 ×   800 =   400,000,000  =   400 MTok

輸入成本:  2,000 MTok × $2  = $4,000
輸出成本:    400 MTok × $10 = $4,000
─────────────────────────────────────
Anthropic 直連估算:          $8,000 / 月

ApiFlux 標價(85%):         $6,800 / 月
標價差異:                    $1,200 / 月

如果 30% 的輸入是命中 5 分鐘快取的穩定字首(0.1 倍讀取費率),輸入成本會下降:

快取輸入:    2,000 MTok × 30% × 0.1× × $2 = $120
未快取輸入:  2,000 MTok × 70% ×      $2 = $2,800
快取寫入(每會話一次):                    ≈ $10(估算)
輸出:                                      $4,000
─────────────────────────────────────────────────
快取估算:                                  ≈ $6,930 / 月

這些僅為方法演示的說明性數字;你的實際賬單取決於快取、工具、重試、Batch 使用和談判條款。用它們來構建計算,而非作為你工作負載的報價。

月度成本對比——三種工作負載的官方價 vs ApiFlux 85% 標價

敏感性——什麼對賬單影響最大:

變數變化對月度成本的影響
輸出 Token+50%顯著增加(輸出費率是輸入的 5 倍)
重試率0% → 10%Token 成本增加約 10%
快取命中率0% → 80%大幅降低重複輸入成本
Batch 使用率0% → 100%標準 Token 費用減半
人工稽核增加可能抵消 API 節省

如果你透過 ApiFlux 等閘道器路由請求,其按 Token 標價比官方標價低 15%(例如 Claude Opus 5 為 $4.25 / $21.25 而非 $5 / $25),這會降低 Token 成本部分。在假設節省前,請計入閘道器自身費用、故障轉移行為和快取計費。

Claude API 定價 FAQ

Claude API 定價是月付還是按需付費?

官方 Claude API 按使用量計費。費用取決於 Token 使用量和適用功能,而非單一固定 API 訂閱價格。單獨的 Claude 消費者或團隊訂閱不應被視為預付費 API 額度。

Claude API 定價中的 MTok 是什麼意思?

MTok 表示一百萬 Token。輸入和輸出 Token 分別定價,費率取決於所選模型。

最便宜的 Claude API 模型是哪個?

在當前官方陣容中,Claude Haiku 4.5 的標準標價最低,為每百萬輸入 Token $1、每百萬輸出 Token $5。它是否是最便宜的生產選擇取決於任務成功率、重試、延遲和稽核成本。

Claude Sonnet 5 為什麼定價為 $2 / $10?

Sonnet 5 的 $2 輸入 / $10 輸出費率在釋出時宣佈為至 2026 年 8 月 31 日的入門定價。原定於 2026 年 9 月 1 日上調至 $3 / $15 的計劃已取消,因此根據 Anthropic 的定價文件,$2 / $10 現為標準價格。

Claude API 有免費額度嗎?

在本指南審查的來源中,Anthropic 的 API 文件未設立永久免費 API 層級。請查閱當前 Claude Console 計費文件瞭解賬戶特定的額度或促銷,不要假設消費者 Claude 計劃結構對映到 API 使用。(另外,ApiFlux 當前在其首頁公佈 $1 起始額度;資格和條款可能變更,註冊前請確認。)

Prompt 快取能降低總賬單嗎?

當在選定 TTL 內發生快取命中時,它可以降低重複傳送合格穩定字首的成本。它不會自動減少輸出 Token、可變輸入、工具呼叫或應用中的每個請求。

Claude Message Batches API 便宜多少?

Anthropic 文件說明 Message Batches API 相比標準 API 定價有五折。Batch 請求是非同步的,因此該折扣適用於可等待處理和檢索的工作負載。

Claude Code 相對於 Claude API 如何計費?

Claude Code 可透過訂閱計劃或 Claude Console/API 賬戶使用。當它使用 Claude Console 賬戶或 API 金鑰時,使用量可能按適用的 API 費率計費。訂閱計劃有自己的價格、限制和條款,因此不要自動將此 API 定價表應用於每個 Claude Code 會話。設定詳情請參閱 ApiFlux Claude Code 文件

透過 ApiFlux 這樣的閘道器,Claude 多少錢?

ApiFlux 公佈 Claude 費率為 Anthropic 標價的 85%。例如,Claude Sonnet 5 標價為 $1.70 輸入 / $8.50 輸出 / 每 MTok(對比官方 $2/$10),Opus 5 為 $4.25 / $21.25(對比 $5/$25)。這些是廠商公佈的閘道器費率,非 Anthropic 官方價格——承諾前請在 apiflux.ai/models/anthropic 確認當前費率。閘道器也可能新增自身費用、加價或運營條款;請分別驗證快取、工具和故障轉移計費。

Claude API 閘道器會改變 Anthropic 的官方價格嗎?

不會。Anthropic 的官方費率保持不變。ApiFlux 等閘道器設定自己的按 Token 價格(公佈為標價的 85%),並可能在其上新增路由、故障轉移或統一計費價值。兩者是獨立的計費安排。

Bedrock 和 Vertex AI 上的 Claude API 價格一樣嗎?

不一定。雲市場可能有不同的定價、計費單位、模型 ID、區域規則、可用性和生命週期政策。請使用各平臺自己的當前官方文件進行比較。

Claude API 每個 Token 多少錢?

每 Token 成本為每 MTok 費率除以一百萬。Claude Haiku 4.5 按 $1/$5 每 MTok 計算,每個輸入 Token 約 $0.000001、每個輸出 Token 約 $0.000005。Sonnet 5 按 $2/$10 計算,輸入 $0.000002、輸出 $0.00001。由於 Token 量很大,大多數生產賬單在 MTok 級別更易估算。

Claude API 比 OpenAI 便宜嗎?

取決於模型組合和你的工作負載。GPT-5.6 Luna 的原始 Token 價格低於 Claude Haiku 4.5,但雙方均提供 1M+ 上下文。對於通用工作,Sonnet 5($2/$10)和 GPT-5.6 Terra($2/$12)標價接近——真正的差異取決於你自己評估集上的任務成功率、輸出長度和工具可靠性。完整比較請參閱 Claude API vs OpenAI API 定價部分。

下一步:估算、比較與開始使用

準備好開始路由 Claude API 了嗎?

在 ApiFlux 上建立 API 金鑰 — $1 起始額度,無需信用卡。

  1. 用上方的互動式計算器估算你的月度賬單
  2. 比較 Claude 模型標價,包括廠商公佈的 85% 標價費率。
  3. 遵循快速入門或閱讀設定指南FAQ
  4. 探索相關指南:2026 最佳程式設計 LLMQwen3-8 釋出視窗準備

來源與更新記錄

本文是使用 Anthropic 官方文件撰寫的編輯指南,核驗日期為 2026 年 9 月 4 日

更新觸發條件。 當 Anthropic 改變模型費率、模型 ID、快取倍率、Batch API 條款、工具價格、消費限制或生命週期日期時,以及當 ApiFlux 改變其價格、支援模型、隱私或保留條款或頁面 URL 時,立即複查。每月檢查模型 ID 和生命週期;每季度複查 FAQ 和結構。

變更日誌

  • 2026-09-04 — 確認 Sonnet 5 保持 $2 / $10(標準定價)。將 Fable 5.1 快取命中率更新為 $0.25 / MTok(0.025 倍)。移除未經驗證的"新使用者免費額度"措辭。新增 ApiFlux 商業披露、廠商宣告標籤、模型決策樹、互動式成本計算器、"Claude API vs 訂閱"和"vs Bedrock/Vertex AI"章節、敏感性分析和就地來源引用。在模型價格表中新增 Opus 4.8 / 4.7 和 Sonnet 4.6。在快速回答部分新增官方 vs ApiFlux 價格對比。擴充套件 ApiFlux 多通道路由架構和 Python SDK 整合示例。新增詳細的月度成本計算示例。新增逐表來源引用、場景到模型決策表、醒目的 CTA 塊,以及擴充套件到現有 ApiFlux 文件和部落格的內部連結。建立 SOURCES.md 來源賬本。

作者 Jason ZhuApiFlux AI 構建者。我透過多提供商閘道器路由自己的 Claude Code 和生產工作負載,並撰寫關於 LLM 基礎設施、定價和可靠性的文章。本文包含關於 ApiFlux 的廠商公佈宣告;所有 Anthropic 定價均來自官方文件並在上述日期核驗。

本文不聲稱獨立基準排名、保證節省、保證可用性或保證搜尋排名。模型建議是基於公佈定價和廠商描述定位的有條件編輯指導;請用你自己的工作負載驗證。

企業級 AI 閘道,統一路由、保護並觀測每一次模型呼叫。