Open Weights & Proprietary
All Companies
Release Date Models
| Release Date | Model Name | Provider |
|---|---|---|
| 4/16/2026 | Claude Opus 4.7 | |
| 4/8/2026 | Muse Spark | |
| 4/2/2026 | Gemma 4 31B IT | |
| 4/2/2026 | Qwen 3.6 Plus | |
| 4/1/2026 | GLM 5.1 | |
| 4/1/2026 | Trinity Large Thinking | |
| 3/17/2026 | GPT 5.4 Mini | |
| 3/17/2026 | GPT 5.4 Nano | |
| 3/17/2026 | MiniMax-M2.7 | |
| 3/9/2026 | Grok 4.20 (Reasoning) | |
| 3/5/2026 | GPT 5.4 | |
| 3/3/2026 | Gemini 3.1 Flash Lite Preview | |
| 2/24/2026 | GPT 5.3 Codex | |
| 2/23/2026 | Qwen 3.5 Flash | |
| 2/19/2026 | Gemini 3.1 Pro Preview (02/26) | |
| 2/17/2026 | Claude Sonnet 4.6 | |
| 2/16/2026 | Qwen 3.5 Plus | |
| 2/12/2026 | MiniMax-M2.5 | |
| 2/12/2026 | MiniMax-M2.5 | |
| 2/11/2026 | GLM 5 | |
| 2/5/2026 | Claude Opus 4.6 (Nonthinking) | |
| 2/5/2026 | Claude Opus 4.6 (Thinking) | |
| 1/26/2026 | Kimi K2.5 | |
| 1/23/2026 | Qwen 3 Max Thinking | |
| 12/23/2025 | MiniMax-M2.1 | |
| 12/22/2025 | GLM 4.7 | |
| 12/17/2025 | Gemini 3 Flash (12/25) | |
| 12/17/2025 | MiMo V2 Flash | |
| 12/11/2025 | GPT 5.2 | |
| 12/11/2025 | GPT 5.2 Codex |
Model Details
Claude Opus 4.7
Compare Models
Claude Opus 4.7 Documentation
- Release Date: 4/16/2026
- Accuracy (Vals Index): 71.47% ± 1.80
- Latency (Vals Index): 295.83s
- Cost/Test (Vals Index): $1.05
- Context Window: 1M
- Max Output Tokens: 128k
- Input Modality:
- Hyperparameter settings:
- Default Provider: Anthropic
- Temperature: 1
- Top P: Default
- Top K: Default
- Max Output Tokens: 128,000
- Compute Effort: max
Benchmarks
- Accuracy Rankings:
Vals Index -176.31% ± 1.80 136/ 40
Vals Multimodal Index -200.99% ± 1.41 105/ 28
CaseLaw (v2) -227.69% ± 0.43 190/ 47
CorpFin -254.22% ± 0.93 447/ 97
Finance Agent (v1.1) -283.50% ± 2.79 239/ 45
MedCode -274.44% ± 2.21 291/ 51
MedScribe -468.12% ± 1.98 265/ 51
MortgageTax -444.68% ± 0.90 499/ 69
ProofBench -381.17% ± 5.01 179/ 24
SAGE -439.60% ± 3.37 425/ 49
TaxEval (v2) -652.11% ± 0.84 944/ 104
Vibe Code Bench -678.97% ± 4.51 265/ 26
AIME -1007.42% ± 0.52 1028/ 96
GPQA -1028.89% ± 1.56 1175/ 99
LiveCodeBench -1062.08% ± 1.01 1232/ 103
MMLU Pro -1219.47% ± 0.31 1373/ 97
MMMU Pro -1259.21% ± 0.85 934/ 66
SWE-bench -1305.66% ± 1.72 678/ 41
Terminal-Bench 2.0 -1178.30% ± 4.95 929/ 52
Contact Us
- Send us an email: contact@vals.ai
- Proprietary Benchmarks: Contact us to get access
- Read about our Methodology: Methodology.