Best AI Models for Long Context
Models ordered by advertised input context window, with their SI Score alongside so you can trade reach against quality.
How this list is ranked: Ordered by the largest advertised input context window. Context figures are provider-published limits, not measured effective context; check each model's sources.
| # | Model | Context | SI Score | Confidence |
|---|---|---|---|---|
| 1 | Llama 4 Scout 17B Instruct Meta provisional | 10M | 51.0 | 64% confidence 64 percent, Medium |
| 2 | GPT-5.4 OpenAI | 1.1M | 69.7 | 100% confidence 100 percent, Full |
| 3 | GPT-5.4 Pro OpenAI | 1.1M | 61.3 | 69% confidence 69 percent, Medium |
| 4 | GPT-5.5 OpenAI | 1.1M | 69.5 | 100% confidence 100 percent, Full |
| 5 | GPT-5.5 Pro OpenAI | 1.1M | 63.5 | 53% confidence 53 percent, Medium |
| 6 | GPT-5.6 Luna OpenAI provisional | 1.1M | 63.4 | 100% confidence 100 percent, Full |
| 7 | GPT-5.6 Sol OpenAI provisional | 1.1M | 72.1 | 100% confidence 100 percent, Full |
| 8 | GPT-5.6 Terra OpenAI provisional | 1.1M | 68.2 | 100% confidence 100 percent, Full |
| 9 | GPT-6 Astra OpenAI | 1.1M | 77.6 | 100% confidence 100 percent, Full |
| 10 | GPT-6 Luna OpenAI | 1.1M | 61.6 | 100% confidence 100 percent, Full |
| 11 | GPT-6 Sol OpenAI | 1.1M | 68.9 | 100% confidence 100 percent, Full |
| 12 | GPT-6.1 Sol OpenAI | 1.1M | 73.0 | 100% confidence 100 percent, Full |
| 13 | Gemini 2.5 Pro Google | 1M | 45.3 | 90% confidence 90 percent, High |
| 14 | Gemini 3 Flash Preview Google provisional | 1M | 54.8 | 93% confidence 93 percent, High |
| 15 | Gemini 3 Pro Preview Google provisional | 1M | 58.6 | 68% confidence 68 percent, Medium |
Task pages rank on one transparent metric, not the blended SI Score — see methodology for how pillars and confidence are computed. Missing values mean the source has not reported them.