RANK.AI DATA / LATEST PUBLICATION

LiveBench model cost efficiency

45 models ranked by LiveBench cost per successful task.
DeepSeek V4 Flash is out in front at $0.016.

45 modelschecked Jun 25, 2026, 11:59 PM UTCdaily88 failed refresheshow we measure this →CSV / JSON

Follow changes
Cheapest today

DeepSeek V4 Flash

$0.016LiveBench cost per successful task

Dearest published row
$1.573
Middle of the board
$0.24
Highest $1.573Middle $0.24
1. DeepSeek V4 Flash — $0.0162. Grok Build 0.1 — $0.0243. DeepSeek V4 Pro — $0.0504. MiniMax M3 — $0.0605. Grok 4.3 — $0.0616. Gemini 3.5 Flash Lite High — $0.0697. GPT 5.4 Nano xHigh — $0.0918. Kimi K2.7 Code — $0.1009. GPT 5.6 Luna xHigh — $0.12310. Grok 4.5 — $0.12811. Muse Spark 1.1 High — $0.13812. Kimi K2.6 Thinking — $0.16913. Qwen3.7 Max — $0.18214. GPT 5.2 Codex — $0.18715. GLM 5.2 — $0.19516. Qwen3.6 27b — $0.20217. GPT 5.6 Luna Max — $0.20218. GPT 5.6 Terra xHigh — $0.20819. GPT 5.5 — $0.21220. Qwen3.6 Plus — $0.22721. GPT 5.2 2025 12 11 High — $0.23422. Muse Spark 1.1 xHigh — $0.23423. Gemini 3.6 Flash High — $0.23524. Gemini 3.5 Flash High — $0.24925. Gemini 3.1 Pro Preview High — $0.26226. Claude Sonnet 4 6 Thinking Auto Medium Effort — $0.30627. GPT 5.4 Mini xHigh — $0.33428. Inkling xHigh — $0.34329. GPT 5.6 Sol xHigh — $0.35530. GPT 5.5 High — $0.36731. Claude Opus 5 High Effort — $0.37332. Kimi K3 — $0.37933. GPT 5.4 xHigh — $0.38734. Claude Opus 4 6 Thinking Auto High Effort — $0.40435. Claude Opus 5 xHigh Effort — $0.48736. Claude Sonnet 5 xHigh Effort — $0.49237. GPT 5.6 Terra Max — $0.49738. Claude Opus 4 7 xHigh Effort — $0.52839. GPT 5.5 xHigh — $0.53040. GPT 5.6 Sol Max — $0.58941. Claude Opus 4 5 20251101 Thinking 64K High Effort — $0.61042. Claude Opus 5 Max Effort — $0.64143. Claude Opus 4 8 xHigh Effort — $0.68844. Claude Fable 5 xHigh Effort — $0.81145. Claude Fable 5 Max Effort — $1.573
Rank 1one bar per published rowRank 45
WHY THIS RANK / VERIFIED SNAPSHOT

Claude Opus 5 Max Effort

Ranks exact model configurations by official cost per successful task for the complete frozen LiveBench workload.

Some explanation inputs are unavailable Missing: publicFrozenEvidence, comparablePriorRanking.

Published rank
#42
Score
0.641
Sample size
7

100% confidence · 64% component coverage · as of Jun 25, 2026, 11:59 PM UTC

SCORE CONSTRUCTION

Component ledger

7/11 evidenced
Components contributing to Claude Opus 5 Max Effort's rank
ComponentValueWeightContributionEvidenceStatus
livebench average input tokens0%01available
livebench average output tokens0%01available
livebench cost per question USD0%01available
livebench cost per successful task USD100%0.6411available
livebench input price per million USD0%01available
livebench output price per million USD0%01available
livebench overall score0%01available
metricsStructuredUnavailable0unavailableno_public_frozen_evidence
rankingDirectionascendingUnavailable0unavailableno_public_frozen_evidence
release2026-06-25Unavailable0unavailableno_public_frozen_evidence
sourceModelIdclaude-opus-5-max-effortUnavailable0unavailableno_public_frozen_evidence
WHY IT MOVED

new since prior snapshot

No rank delta

no_prior_published_snapshot

No component moved since the prior snapshot.

PRIMARY EVIDENCE

Source trail

7 public records
  • LiveBench average input tokenslivebench average input tokens · observed Jun 25, 2026, 11:59 PM UTC1,263 tokens100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench average output tokenslivebench average output tokens · observed Jun 25, 2026, 11:59 PM UTC14,826 tokens100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench cost per questionlivebench cost per question USD · observed Jun 25, 2026, 11:59 PM UTC$0.51100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench cost per successful tasklivebench cost per successful task USD · observed Jun 25, 2026, 11:59 PM UTC$0.64100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench input pricelivebench input price per million USD · observed Jun 25, 2026, 11:59 PM UTC$5.00100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench output pricelivebench output price per million USD · observed Jun 25, 2026, 11:59 PM UTC$25.00100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
  • LiveBench overall scorelivebench overall score · observed Jun 25, 2026, 11:59 PM UTC79.234 percent100% confidence
    Source
    LiveBench official model benchmark
    Grade
    A
    Freshness
    fresh
    Locator
    {"formula":"(sum task cost / sum question count) / (overall score / 100)","costAsset":"https://livebench.ai/cost_2026_06_25.csv","scoreAsset":"https://livebench.ai/table_2026_06_25.csv","categoryAsset":"https://livebench.ai/categories_2026_06_25.json"}
    Open primary evidence ↗
REPRODUCIBILITYLiveBench 2026-06-25 model cost efficiency · vlivebench-2026-06-25-official-v1-livebench-model-efficiency-v1315 observations · 1 sources · passed quality
Snapshot
9f985b73-8095-4473-9445-5dd484a1ae8f
Data hash
299a87f51afdb539381eb1329d49abaca9dc5bf2659659929ce499a0fb6a671c
Method hash
1cafe5c9d864ba7cdfd0858525b79ab5222403edf79a3fbb8f3dee724546c4cb

More in Model efficiency

Capability relative to token price, context, latency, and throughput.

3 live tables