Context
n/a
Max output
n/a
Serving providers
0
Cheapest input
n/a /1M

Benchmarks

independent evaluations · source: Artificial Analysis
Speed & latency
Output speed
252 t/s
tokens / second
Time to first token
0.40s
latency
Headline indices
27.8
of 100
9.2
of 100
Individual benchmarks · click a row for effort variants
BenchmarkBest scoreEffortCost / task
CritPt0%default
EvalComputeProxy704.7default
GDPval716.9default
GPQA Diamond76%default
Humanity's Last Exam12%default
IFBench74%default
Long-Context Reasoning49%default
Mlcr Overall0.0default
MMMU-Pro63%default
Omniscience-4.0default
Omniscience Accuracy0.1default
Omniscience Non Hallucination0.9default
SciCode38%default
TerminalBench Hard25%default
TerminalBench v2.123%default
τ-bench Banking6%default
τ²-bench81%default

Pricing by serving provider

availability
No public price yet. Not offered on-demand at any tracked provider.

Price history

input + output $/1M since we started tracking
Input Output

Price history is accruing. We record a point each day a price changes; the full backfill lands shortly.

Other Cohere models

compare pricing across the Cohere lineup
Pricing verified against LiteLLM + OpenRouter + provider pages · refreshed daily

Every weekday

AI moves fast. Here's your debrief.

News, analysis, tools, and more.

For people who build with AI