Catalog data · Updated July 24, 2026

Largest Context Window LLMs

Compare active text-generation model identities with recorded context windows of at least 128,000 tokens. Large outlier values are excluded from the ranking.

Objective catalog fields No overall quality score
595
Long-context identities
26
Providers shown
1
Data sections
6,154
Catalog records

Largest context windows

Active text-generation identities from 128,000 through 10 million tokens.

Showing 45 of 595

Model Provider offers Why listed Context Input / output price Updated
NVIDIA Nemotron 3 Nano 30B
nvidia-nemotron-3-nano-30b-a3b
Venice
1 offer
128000 token context 128,000
$0.08 / $0.30
per 1M tokens, when known
June 11, 2026
NVIDIA: Nemotron 3.5 Content Safety (free)
nemotron-3.5-content-safety:free
Openrouter
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
June 4, 2026
NVIDIA: Nemotron Nano 12B 2 VL (free)
nvidia/nemotron-nano-12b-v2-vl:free
Openrouter
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
October 28, 2025
NVIDIA: Nemotron Nano 9B V2 (free)
nemotron-nano-9b-v2:free
Openrouter
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
August 18, 2025
Open Mistral Nemo
open-mistral-nemo
Mistral
1 offer
128000 token context 128,000
$0.15 / $0.15
per 1M tokens, when known
July 1, 2024
OpenAI GPT OSS 120B
openai-gpt-oss-120b
Venice
1 offer
128000 token context 128,000
$0.07 / $0.30
per 1M tokens, when known
June 11, 2026
OpenAI o1-mini
o1-mini
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
December 17, 2024
OpenAI o1-preview
o1-preview
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
September 12, 2024
OpenAI: GPT Audio
gpt-audio
Openrouter
1 offer
128000 token context 128,000
$2.50 / $10.00
per 1M tokens, when known
January 19, 2026
OpenAI: GPT Audio Mini
gpt-audio-mini
Openrouter
1 offer
128000 token context 128,000
$0.60 / $2.40
per 1M tokens, when known
January 19, 2026
OpenAI: GPT-4 Turbo
gpt-4-turbo
Openrouter
1 offer
128000 token context 128,000
$10.00 / $30.00
per 1M tokens, when known
April 9, 2024
OpenAI: GPT-4 Turbo Preview
gpt-4-turbo-preview
Openrouter
1 offer
128000 token context 128,000
$10.00 / $30.00
per 1M tokens, when known
January 25, 2024
OpenAI: GPT-4o (2024-05-13)
gpt-4o-2024-05-13
Openrouter
1 offer
128000 token context 128,000
$5.00 / $15.00
per 1M tokens, when known
May 13, 2024
OpenAI: GPT-4o (2024-08-06)
gpt-4o-2024-08-06
Openai, Openrouter
2 offers
128000 token context 128,000
$2.50 / $10.00
per 1M tokens, when known
August 6, 2024
OpenAI: GPT-4o (2024-11-20)
gpt-4o-2024-11-20
Openai, Openrouter
2 offers
128000 token context 128,000
$2.50 / $10.00
per 1M tokens, when known
November 20, 2024
OpenAI: GPT-4o Search Preview
gpt-4o-search-preview
Openrouter
1 offer
128000 token context 128,000
$2.50 / $10.00
per 1M tokens, when known
March 12, 2025
OpenAI: GPT-4o-mini (2024-07-18)
gpt-4o-mini-2024-07-18
Openrouter
1 offer
128000 token context 128,000
$0.15 / $0.60
per 1M tokens, when known
July 18, 2024
OpenAI: GPT-4o-mini Search Preview
gpt-4o-mini-search-preview
Openrouter
1 offer
128000 token context 128,000
$0.15 / $0.60
per 1M tokens, when known
March 12, 2025
OpenAI: GPT-5 Chat
gpt-5-chat
Openrouter
1 offer
128000 token context 128,000
$1.25 / $10.00
per 1M tokens, when known
August 7, 2025
OpenAI: GPT-5.1 Chat
gpt-5.1-chat
Openrouter, Zenmux
2 offers
128000 token context 128,000
$1.25 / $10.00
per 1M tokens, when known
November 13, 2025
OpenAI: GPT-5.2 Chat
gpt-5.2-chat
Openrouter
1 offer
128000 token context 128,000
$1.75 / $14.00
per 1M tokens, when known
December 10, 2025
OpenAI: GPT-5.3 Chat
gpt-5.3-chat
Openrouter, Zenmux
2 offers
128000 token context 128,000
$1.75 / $14.00
per 1M tokens, when known
March 20, 2026
Perplexity: Sonar Deep Research
sonar-deep-research
Openrouter, Perplexity
2 offers
128000 token context 128,000
$2.00 / $8.00
per 1M tokens, when known
September 1, 2025
Perplexity: Sonar Reasoning Pro
sonar-reasoning-pro
Openrouter, Perplexity
2 offers
128000 token context 128,000
$2.00 / $8.00
per 1M tokens, when known
September 1, 2025
Phi-3-medium instruct (128k)
microsoft/phi-3-medium-128k-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
April 23, 2024
Phi-3-mini instruct (128k)
microsoft/phi-3-mini-128k-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
April 23, 2024
Phi-3-small instruct (128k)
microsoft/phi-3-small-128k-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
April 23, 2024
Phi-3.5-mini instruct (128k)
microsoft/phi-3.5-mini-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
August 20, 2024
Phi-3.5-MoE instruct (128k)
microsoft/phi-3.5-moe-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
August 20, 2024
Phi-3.5-vision instruct (128k)
microsoft/phi-3.5-vision-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
August 20, 2024
Phi-4-mini-instruct
phi-4-mini-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
December 11, 2024
Phi-4-mini-reasoning
phi-4-mini-reasoning
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
December 11, 2024
Phi-4-multimodal-instruct
phi-4-multimodal-instruct
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
December 11, 2024
Phi-4-Reasoning
phi-4-reasoning
Github models
1 offer
128000 token context 128,000
$0.00 / $0.00
per 1M tokens, when known
December 11, 2024
Pixtral 12B
pixtral-12b
Mistral
1 offer
128000 token context 128,000
$0.15 / $0.15
per 1M tokens, when known
September 1, 2024
Pixtral Large (latest)
pixtral-large-latest
Mistral
1 offer
128000 token context 128,000
$2.00 / $6.00
per 1M tokens, when known
November 4, 2024
Qwen 3 235B A22B Instruct 2507
qwen3-235b-a22b-instruct-2507
Venice
1 offer
128000 token context 128,000
$0.15 / $0.75
per 1M tokens, when known
June 11, 2026
Qwen 3.5 397B
qwen3-5-397b-a17b
Venice
1 offer
128000 token context 128,000
$0.75 / $4.50
per 1M tokens, when known
June 11, 2026
Qwen: Qwen2.5 VL 72B Instruct
qwen2.5-vl-72b-instruct
Openrouter
1 offer
128000 token context 128,000
$0.80 / $1.00
per 1M tokens, when known
February 1, 2025
Ring-1T
ring-1t
Zenmux
1 offer
128000 token context 128,000
$0.56 / $2.24
per 1M tokens, when known
October 12, 2025
Sonar
sonar
Perplexity
1 offer
128000 token context 128,000
$1.00 / $1.00
per 1M tokens, when known
September 1, 2025
Upstage: Solar Pro 3
solar-pro-3
Openrouter
1 offer
128000 token context 128,000
$0.15 / $0.60
per 1M tokens, when known
January 27, 2026
Venice Role Play Uncensored
venice-uncensored-role-play
Venice
1 offer
128000 token context 128,000
$0.50 / $2.00
per 1M tokens, when known
June 11, 2026
Venice Uncensored 1.2
venice-uncensored-1-2
Venice
1 offer
128000 token context 128,000
$0.20 / $0.90
per 1M tokens, when known
June 11, 2026
Venice: Uncensored
cognitivecomputations/dolphin-mistral-24b-venice-edition
Openrouter
1 offer
128000 token context 128,000
$0.20 / $0.90
per 1M tokens, when known
July 9, 2025

How the context ranking works

The page orders active text-generation identities by their largest recorded provider context limit.

Inclusion criteria

  • The model identity has at least one offer that passes the active text-generation rules.
  • The largest recorded context window is from 128,000 through 10 million tokens.

Exclusions

  • The list excludes missing and nonnumeric context values.
  • The list excludes values above 10 million tokens as unverified outliers.

Data rules

  • Context value: A grouped identity uses the largest recorded context limit among its eligible provider offers.
  • Ordering: Model identities are ordered by context size, then name and model ID for stable output.

Limits of the data

  • A large context window does not prove strong recall, reasoning, speed, or low cost across the full window.
  • Providers can apply different context limits to the same model identity.

Read context limits with care

The advertised limit is only one part of long-context performance. Test retrieval quality, latency, and total prompt cost with data that matches your application.

Sources

  • llm_db — Source for active offers and recorded model context limits. Checked 2026-07-30.