46.8%
AA-Omniscience Accuracy
Modelle / OpenAI
GPT-5.6 · Release 2026-07-09
OpenAIs allgemein verfügbares, ausgewogenes GPT-5.6-Modell, unter Sol für effiziente Alltagsarbeit positioniert, zum Preis von $2,50 / $15 pro 1 Mio. Token.
Ausgewogene GPT-5.6-Stufe für tägliche Coding-, Research- und Agent-Workflows, wenn Sols höherer Preis unnötig ist.
Familienprofil
Bester veröffentlichter Score je abgedeckter Benchmark-Familie.
6 getestete Benchmark-Familien
Wo GPT-5.6 Terra auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo GPT-5.6 Terra auftaucht, ist es hervorgehoben.
Benchmark-Zeilen im öffentlichen Ledger für GPT-5.6 Terra in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.
| Benchmark | Family | Score | Quelle | Tage her |
|---|---|---|---|---|
| CritPt | Reasoning | 30% | Artificial Analysis — CritPt | 5 |
| AA-Omniscience | Knowledge | 46.8% | Artificial Analysis — AA-Omniscience | 5 |
| MMMU-Pro | Multimodal | 80.7% | Artificial Analysis — MMMU-Pro | 5 |
| AA-LCR | Long context | 79.67% | Artificial Analysis | 5 |
| AA output speed | Performance | 108 t/s | Artificial Analysis | 5 |
| AA time to first token | Performance | 94.25s | Artificial Analysis | 5 |
| Artificial Analysis Intelligence Index | Reasoning | 56.6% | Artificial Analysis | 5 |
| GPQA Diamond | Reasoning | 92.5% | Artificial Analysis | 5 |
| Humanity's Last Exam | Reasoning | 42.9% | Artificial Analysis | 5 |
| IFBench | Reasoning | 71.22% | Artificial Analysis | 5 |
| SciCode | Coding | 53.9% | Artificial Analysis | 5 |
| τ³-Bench Banking | Agentic | 40.21% | Artificial Analysis | 5 |
| Terminal-Bench | Agentic | 88.01% | Artificial Analysis | 5 |
| Terminal-Bench-Science | Agentic | 8.6% | Terminal-Bench-Science 0.1 announcement | 10 |
| Vending-Bench 2 | Agentic | 7343.21 | Andon Labs Vending-Bench 2 | 33 |
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.
Jeder Katalog-Benchmark für GPT-5.6 Terra. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
15 von 37 Katalog-Benchmarks haben eine belegte Zeile für GPT-5.6 Terra.
46.8%
AA-Omniscience Accuracy
56.6%
AA Intelligence Index v4.1
30%
CritPt composite (AA run)
92.5%
GPQA Diamond (AA run)
42.9%
HLE (AA run)
71.22%
IFBench (AA run)
53.9%
SciCode (AA run)
88.01%
Terminal-Bench v2.1 (AA run)
8.6%
TB-Science 0.1 resolution (Codex)
7343.21
Final bank balance (USD)
40.21%
τ³-Bench Banking (AA run)
80.7%
MMMU-Pro (AA run)
79.67%
AA-LCR (AA run)
108 t/s
Median output tokens/s (1k prompt, default provider)
94.25s
Median time to first token (1k prompt, default provider)