Claude Opus 4.6

anthropic/claude-4.6-opus-20260205

Claude Opus 4.6 is an Anthropic model released on 2026‑02‑05. It accepts text, image, and file inputs, produces text output, and supports tools and reasoning with a context length of 1,000,000 tokens. The model is not open‑weight and is priced at $5 per M input tokens and $25 per M output tokens.

  • tool use
  • structured outputs
  • reasoning

At a glance

provideranthropic
releasedAug 26, 2025
context1M
input / M$5

Specifications

What the API gives you

Context window
1M tokens
Max output
128K tokens
Input price
$5 / 1M tokens
Output price
$25 / 1M tokens
Cache read
$0.50 / 1M tokens
Modalities
text, image, file → text
Knowledge cutoff
Released
Aug 26, 2025

Measured evidence

Public benchmark record

Design Arena Coding
1318 Elo2026-07-28
Design Arena Coding
1319 Elo2026-07-27
Design Arena Coding
1319 Elo2026-07-30
Design Arena Coding
1318 Elo2026-07-29
Design Arena Coding
1318 Elo2026-07-31
Design Arena Coding
1318 Elo2026-08-02
Design Arena Coding
1315 Elo2026-08-05
Design Arena Coding
1318 Elo2026-08-01
Design Arena Coding
1315 Elo2026-08-09
Design Arena Coding
1318 Elo2026-08-03
Design Arena Coding
1316 Elo2026-08-04
Design Arena Coding
1312 Elo2026-08-14
Design Arena Coding
1315 Elo2026-08-06
Design Arena Coding
1315 Elo2026-08-10
Design Arena Coding
1316 Elo2026-08-07
Design Arena Coding
1305 Elo2026-08-18
Design Arena Coding
1315 Elo2026-08-08
Design Arena Coding
1311 Elo2026-08-21
Design Arena Coding
1305 Elo2026-08-15
Design Arena Coding
1315 Elo2026-08-11
Design Arena Coding
1314 Elo2026-08-12
Design Arena Coding
1304 Elo2026-08-19
Design Arena Coding
1312 Elo2026-08-13
Design Arena Coding
1310 Elo2026-08-27
Design Arena Coding
1302 Elo2026-09-05
Design Arena Coding
1304 Elo2026-08-20
Design Arena Coding
1305 Elo2026-08-16
Design Arena Coding
1305 Elo2026-08-17
Design Arena Coding
1311 Elo2026-08-22
Design Arena Coding
1311 Elo2026-08-23
Design Arena Coding
1310 Elo2026-08-28
Design Arena Coding
1311 Elo2026-08-24
Design Arena Coding
1311 Elo2026-08-25
Design Arena Coding
1311 Elo2026-08-26
Design Arena Coding
1302 Elo2026-09-06
Design Arena Coding
1310 Elo2026-08-29
Design Arena Coding
1310 Elo2026-08-30
Design Arena Coding
1310 Elo2026-08-31
Design Arena Coding
1310 Elo2026-09-01
Design Arena Coding
1309 Elo2026-09-02
Design Arena Coding
1306 Elo2026-09-03
Design Arena Coding
1305 Elo2026-09-04
Design Arena UI
1316 Elo2026-07-28
Design Arena UI
1317 Elo2026-07-27
Design Arena UI
1317 Elo2026-07-30
Design Arena UI
1317 Elo2026-07-29
Design Arena UI
1317 Elo2026-07-31
Design Arena UI
1317 Elo2026-08-02
Design Arena UI
1317 Elo2026-08-01
Design Arena UI
1317 Elo2026-08-05
Design Arena UI
1314 Elo2026-08-09
Design Arena UI
1316 Elo2026-08-03
Design Arena UI
1318 Elo2026-08-04
Design Arena UI
1312 Elo2026-08-14
Design Arena UI
1317 Elo2026-08-06
Design Arena UI
1316 Elo2026-08-07
Design Arena UI
1314 Elo2026-08-10
Design Arena UI
1315 Elo2026-08-08
Design Arena UI
1307 Elo2026-08-18
Design Arena UI
1314 Elo2026-08-11
Design Arena UI
1309 Elo2026-08-15
Design Arena UI
1314 Elo2026-08-12
Design Arena UI
1314 Elo2026-08-13
Design Arena UI
1307 Elo2026-08-19
Design Arena UI
1307 Elo2026-08-27
Design Arena UI
1308 Elo2026-08-16
Design Arena UI
1307 Elo2026-08-20
Design Arena UI
1307 Elo2026-08-17
Design Arena UI
1303 Elo2026-09-05
Design Arena UI
1307 Elo2026-08-21
Design Arena UI
1308 Elo2026-08-22
Design Arena UI
1308 Elo2026-08-23
Design Arena UI
1307 Elo2026-08-28
Design Arena UI
1308 Elo2026-08-24
Design Arena UI
1308 Elo2026-08-25
Design Arena UI
1308 Elo2026-08-26
Design Arena UI
1303 Elo2026-09-06
Design Arena UI
1307 Elo2026-08-29
Design Arena UI
1307 Elo2026-08-30
Design Arena UI
1307 Elo2026-08-31
Design Arena UI
1307 Elo2026-09-01
Design Arena UI
1306 Elo2026-09-02
Design Arena UI
1304 Elo2026-09-03
Design Arena UI
1303 Elo2026-09-04
Design Arena Web-app Agent
1258 Elo2026-07-28
Design Arena Web-app Agent
1258 Elo2026-07-27
Design Arena Web-app Agent
1256 Elo2026-07-30
Design Arena Web-app Agent
1256 Elo2026-07-29
Design Arena Web-app Agent
1257 Elo2026-07-31
Design Arena Web-app Agent
1258 Elo2026-08-02
Design Arena Web-app Agent
1257 Elo2026-08-01
Design Arena Web-app Agent
1252 Elo2026-08-05
Design Arena Web-app Agent
1247 Elo2026-08-09
Design Arena Web-app Agent
1257 Elo2026-08-03
Design Arena Web-app Agent
1257 Elo2026-08-04
Design Arena Web-app Agent
1240 Elo2026-08-14
Design Arena Web-app Agent
1252 Elo2026-08-06
Design Arena Web-app Agent
1243 Elo2026-08-10
Design Arena Web-app Agent
1252 Elo2026-08-07
Design Arena Web-app Agent
1232 Elo2026-08-18
Design Arena Web-app Agent
1252 Elo2026-08-08
Design Arena Web-app Agent
1243 Elo2026-08-11
Design Arena Web-app Agent
1235 Elo2026-08-15
Design Arena Web-app Agent
1244 Elo2026-08-12
Design Arena Web-app Agent
1244 Elo2026-08-13
Design Arena Web-app Agent
1232 Elo2026-08-19
Design Arena Web-app Agent
1235 Elo2026-08-27
Design Arena Web-app Agent
1232 Elo2026-08-20
Design Arena Web-app Agent
1235 Elo2026-08-16
Design Arena Web-app Agent
1233 Elo2026-09-05
Design Arena Web-app Agent
1235 Elo2026-08-17
Design Arena Web-app Agent
1240 Elo2026-08-21
Design Arena Web-app Agent
1241 Elo2026-08-22
Design Arena Web-app Agent
1241 Elo2026-08-23
Design Arena Web-app Agent
1235 Elo2026-08-28
Design Arena Web-app Agent
1235 Elo2026-08-24
Design Arena Web-app Agent
1236 Elo2026-08-25
Design Arena Web-app Agent
1237 Elo2026-08-26
Design Arena Web-app Agent
1233 Elo2026-09-06
Design Arena Web-app Agent
1235 Elo2026-08-29
Design Arena Web-app Agent
1233 Elo2026-08-30
Design Arena Web-app Agent
1234 Elo2026-08-31
Design Arena Web-app Agent
1234 Elo2026-09-01
Design Arena Web-app Agent
1233 Elo2026-09-02
Design Arena Web-app Agent
1233 Elo2026-09-03
Design Arena Web-app Agent
1233 Elo2026-09-04
Design Arena Website
1313 Elo2026-07-28
Design Arena Website
1313 Elo2026-07-27
Design Arena Website
1313 Elo2026-07-30
Design Arena Website
1313 Elo2026-07-29
Design Arena Website
1312 Elo2026-07-31
Design Arena Website
1312 Elo2026-08-02
Design Arena Website
1312 Elo2026-08-01
Design Arena Website
1311 Elo2026-08-05
Design Arena Website
1312 Elo2026-08-03
Design Arena Website
1310 Elo2026-08-09
Design Arena Website
1311 Elo2026-08-04
Design Arena Website
1307 Elo2026-08-14
Design Arena Website
1310 Elo2026-08-06
Design Arena Website
1310 Elo2026-08-07
Design Arena Website
1310 Elo2026-08-10
Design Arena Website
1310 Elo2026-08-08
Design Arena Website
1299 Elo2026-08-18
Design Arena Website
1310 Elo2026-08-11
Design Arena Website
1299 Elo2026-08-15
Design Arena Website
1309 Elo2026-08-12
Design Arena Website
1307 Elo2026-08-13
Design Arena Website
1299 Elo2026-08-19
Design Arena Website
1298 Elo2026-08-16
Design Arena Website
1299 Elo2026-08-20
Design Arena Website
1306 Elo2026-08-27
Design Arena Website
1299 Elo2026-08-17
Design Arena Website
1302 Elo2026-09-05
Design Arena Website
1307 Elo2026-08-21
Design Arena Website
1307 Elo2026-08-22
Design Arena Website
1307 Elo2026-08-23
Design Arena Website
1307 Elo2026-08-24
Design Arena Website
1306 Elo2026-08-28
Design Arena Website
1307 Elo2026-08-25
Design Arena Website
1307 Elo2026-08-26
Design Arena Website
1300 Elo2026-09-06
Design Arena Website
1306 Elo2026-08-29
Design Arena Website
1306 Elo2026-08-30
Design Arena Website
1306 Elo2026-08-31
Design Arena Website
1306 Elo2026-09-01
Design Arena Website
1305 Elo2026-09-02
Design Arena Website
1303 Elo2026-09-03
Design Arena Website
1302 Elo2026-09-04
LiveBench Coding
78.2%2026-06-25
LiveBench Language
83.3%2026-06-25
LiveBench Math
89.3%2026-06-25
LiveBench Reasoning
88.7%2026-06-25
LMArena Agent
5.92026-07-13
LMArena Agent
6.72026-07-20
LMArena Agent
6.52026-07-27
LMArena Agent
6.42026-07-21
LMArena Agent
6.52026-07-28
LMArena Agent
6.12026-08-03
LMArena Agent
6.92026-08-12
LMArena Agent
6.42026-08-06
LMArena Agent
6.72026-08-11
LMArena Agent
6.92026-08-13
LMArena Agent
5.82026-08-24
LMArena Agent
5.22026-08-31
LMArena Agent
4.62026-09-05
LMArena Agent
5.52026-08-27
LMArena Creative Writing
1504 Elo2026-07-21
LMArena Creative Writing
1505 Elo2026-07-27
LMArena Creative Writing
1505 Elo2026-07-30
LMArena Creative Writing
1505 Elo2026-08-02
LMArena Creative Writing
1505 Elo2026-08-03
LMArena Creative Writing
1505 Elo2026-08-06
LMArena Creative Writing
1506 Elo2026-08-12
LMArena Creative Writing
1504 Elo2026-08-21
LMArena Creative Writing
1505 Elo2026-09-02
LMArena Creative Writing
1505 Elo2026-08-27
LMArena Creative Writing
1505 Elo2026-09-01
LMArena Long Query
1520 Elo2026-07-21
LMArena Long Query
1520 Elo2026-07-27
LMArena Long Query
1520 Elo2026-07-30
LMArena Long Query
1520 Elo2026-08-02
LMArena Long Query
1520 Elo2026-08-03
LMArena Long Query
1519 Elo2026-08-06
LMArena Long Query
1521 Elo2026-08-12
LMArena Long Query
1521 Elo2026-08-21
LMArena Long Query
1520 Elo2026-09-02
LMArena Long Query
1521 Elo2026-08-27
LMArena Long Query
1520 Elo2026-09-01
LMArena Math
1518 Elo2026-07-21
LMArena Math
1518 Elo2026-07-27
LMArena Math
1518 Elo2026-07-30
LMArena Math
1518 Elo2026-08-02
LMArena Math
1518 Elo2026-08-03
LMArena Math
1517 Elo2026-08-06
LMArena Math
1516 Elo2026-08-12
LMArena Math
1516 Elo2026-08-21
LMArena Math
1516 Elo2026-08-27
LMArena Math
1516 Elo2026-09-01
LMArena Text
1501 Elo2026-07-16
LMArena Text
1512 Elo2026-07-20
LMArena Text
1505 Elo2026-07-21
LMArena Text
1505 Elo2026-07-27
LMArena Text
1505 Elo2026-07-30
LMArena Text
1505 Elo2026-08-02
LMArena Text
1505 Elo2026-08-06
LMArena Text
1505 Elo2026-08-03
LMArena Text
1505 Elo2026-08-12
LMArena Text
1505 Elo2026-08-10
LMArena Text
1504 Elo2026-08-21
LMArena Text
1505 Elo2026-09-01
LMArena Text
1505 Elo2026-09-02
LMArena Text
1505 Elo2026-08-27
LMArena Vision
1317 Elo2026-07-12
LMArena Vision
1299 Elo2026-07-21
LMArena Vision
1300 Elo2026-07-26
LMArena Vision
1300 Elo2026-07-30
LMArena Vision
1299 Elo2026-08-02
LMArena Vision
1300 Elo2026-08-06
LMArena Vision
1299 Elo2026-08-21
LMArena Vision
1299 Elo2026-08-27
LMArena WebDev
1542 Elo2026-07-16
LMArena WebDev
1542 Elo2026-07-21
LMArena WebDev
1543 Elo2026-07-20
LMArena WebDev
1546 Elo2026-07-27
LMArena WebDev
1546 Elo2026-07-24
LMArena WebDev
1546 Elo2026-07-28
LMArena WebDev
1546 Elo2026-07-30
LMArena WebDev
1545 Elo2026-08-01
LMArena WebDev
1545 Elo2026-07-31
LMArena WebDev
1545 Elo2026-08-06
LMArena WebDev
1545 Elo2026-08-02
LMArena WebDev
1545 Elo2026-08-12
LMArena WebDev
1545 Elo2026-08-10
LMArena WebDev
1545 Elo2026-08-14
LMArena WebDev
1546 Elo2026-09-01
LMArena WebDev
1546 Elo2026-09-05
LMArena WebDev
1546 Elo2026-08-21
LMArena WebDev
1546 Elo2026-08-30
SWE-rebench
53.3% ± 0.62026-05-15tools

LMArena data licensed CC-BY-4.0. Aider (Apache-2.0) and SWE-bench (MIT) are open. Design Arena uses blind human preference. Submitted scaffold plus model result. Compare the harness and effort settings, not only the model name.

Task evidence

How broad is the support?

Each status is exact to this model version and the selected task. Official release claims remain provisional.

  • Best LLM for Competition MathEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Business WritingEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • 100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Marketing CopyEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Chat & RoleplayEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Creative WritingEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Frontend & UIEstablished evidence

    100% of intended weighted task evidence across 3 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for WritingEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • 100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Math & ReasoningEstablished evidence

    100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • 100% of intended weighted task evidence across 2 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Code CompletionEstablished evidence

    81% of intended weighted task evidence across 2 independent sources. 4 of 4 configured evaluation feeds currently have results.

  • Best LLM for CodingEstablished evidence

    74% of intended weighted task evidence across 4 independent sources. 8 of 8 configured evaluation feeds currently have results.

  • 70% of intended weighted task evidence across 3 independent sources. 6 of 6 configured evaluation feeds currently have results.

  • 67% of intended weighted task evidence across 2 independent sources. 3 of 4 configured evaluation feeds currently have results.

  • 65% of intended weighted task evidence across 2 independent sources. 3 of 4 configured evaluation feeds currently have results.

  • Best Local LLM for CodingEstablished evidence

    64% of intended weighted task evidence across 3 independent sources. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for Fast SummariesEstablished evidence

    64% of intended weighted task evidence across 2 independent sources. 3 of 4 configured evaluation feeds currently have results.

  • Best Value LLMEstablished evidence

    64% of intended weighted task evidence across 2 independent sources. 3 of 4 configured evaluation feeds currently have results.

  • Best LLM for Agentic CodingEstablished evidence

    64% of intended weighted task evidence across 4 independent sources. 8 of 8 configured evaluation feeds currently have results.

  • 60% of intended weighted task evidence across 2 independent sources. 4 of 6 configured evaluation feeds currently have results.

  • Best LLM for SummarizationEstablished evidence

    60% of intended weighted task evidence across 2 independent sources. 4 of 6 configured evaluation feeds currently have results.

  • 55% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from WMT translation. 4 of 5 configured evaluation feeds currently have results.

  • 55% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from WMT translation. 4 of 5 configured evaluation feeds currently have results.

  • Best LLM for TranslationProvisional evidence

    55% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from WMT translation. 4 of 5 configured evaluation feeds currently have results.

  • Best Cheap LLM for High VolumeProvisional evidence

    50% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Route reliability. 3 of 4 configured evaluation feeds currently have results.

  • Cheapest Capable LLMProvisional evidence

    50% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Route reliability. 3 of 4 configured evaluation feeds currently have results.

  • Best LLM for Massive ContextProvisional evidence

    50% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from LongBench v2. 3 of 4 configured evaluation feeds currently have results.

  • Best LLM for Autonomous AgentsProvisional evidence

    49% of intended weighted task evidence across 3 independent sources; broader independent confirmation is still missing from Frontier-Bench or OSWorld Verified. 7 of 7 configured evaluation feeds currently have results.

  • Best LLM for OCR & DocumentsProvisional evidence

    45% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Structured-output eval or VLMEvalKit tasks. 3 of 5 configured evaluation feeds currently have results.

  • 45% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Structured-output eval or VLMEvalKit tasks. 3 of 5 configured evaluation feeds currently have results.

  • Best LLM for Charts & DiagramsProvisional evidence

    45% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Structured-output eval or VLMEvalKit tasks. 3 of 5 configured evaluation feeds currently have results.

  • Best LLM for Document ParsingProvisional evidence

    45% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Structured-output eval or VLMEvalKit tasks. 3 of 5 configured evaluation feeds currently have results.

  • Best LLM for Hermes AgentProvisional evidence

    45% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Terminal-Bench 2.1. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for OpenHandsProvisional evidence

    45% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Terminal-Bench 2.1. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for GooseProvisional evidence

    45% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Terminal-Bench 2.1. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for OpenClawProvisional evidence

    45% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Terminal-Bench 2.1. 5 of 5 configured evaluation feeds currently have results.

  • Best LLM for AI AgentsProvisional evidence

    42% of intended weighted task evidence across 3 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or OSWorld Verified. 7 of 7 configured evaluation feeds currently have results.

  • 39% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Structured-output eval. 4 of 5 configured evaluation feeds currently have results.

  • 39% of intended weighted task evidence across 2 independent sources; broader independent confirmation is still missing from Berkeley Function Calling or Structured-output eval. 4 of 5 configured evaluation feeds currently have results.

  • 35% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from FACTS Grounding or LMArena Search. 4 of 6 configured evaluation feeds currently have results.

  • 31% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Route reliability or Structured-output eval. 2 of 4 configured evaluation feeds currently have results.

  • 25% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Berkeley Function Calling or LMArena Search. 4 of 5 configured evaluation feeds currently have results.

  • 25% of intended weighted task evidence across 1 independent source; broader independent confirmation is still missing from Berkeley Function Calling or OSWorld Verified. 4 of 4 configured evaluation feeds currently have results.

  • Best LLM for Grounded RAGProvisional evidence

    10% of intended weighted task evidence across 0 independent sources; broader independent confirmation is still missing from CRAG or FACTS Grounding. 2 of 5 configured evaluation feeds currently have results.

Catalog data via OpenRouter and models.dev. Last checked within the past 6 hours.