Updated July 24, 2026

LLM Models List

Browse active large language models with known text-generation support. Compare provider offers, context windows, capabilities, and token prices.

695
Active LLM model IDs
1,034
Executable offers
26
API providers
6,154
Catalog records

Current active LLMs

Page 3 of 14. Models are ordered by the latest recorded metadata update.

Search the complete provider catalog
Model Provider offers Known capabilities Context Lowest-input offer Updated
Google Gemma 4 26B A4B Instruct
google-gemma-4-26b-a4b-it
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.13 / $0.40
per 1M tokens · Venice
June 11, 2026
Google Gemma 4 31B Instruct
google-gemma-4-31b-it
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.12 / $0.36
per 1M tokens · Venice
June 11, 2026
GPT-4o
openai-gpt-4o-2024-11-20
Venice
1 offer
Tools Chat Streaming
128,000
$3.13 / $12.50
per 1M tokens · Venice
June 11, 2026
GPT-4o Mini
openai-gpt-4o-mini-2024-07-18
Venice
1 offer
Tools Chat Streaming
128,000
$0.19 / $0.75
per 1M tokens · Venice
June 11, 2026
GPT-5.2
openai-gpt-52
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$2.19 / $17.50
per 1M tokens · Venice
June 11, 2026
GPT-5.2 Codex
openai-gpt-52-codex
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$2.19 / $17.50
per 1M tokens · Venice
June 11, 2026
GPT-5.3 Codex
openai-gpt-53-codex
Venice
1 offer
Reasoning Tools Chat Streaming
400,000
$2.19 / $17.50
per 1M tokens · Venice
June 11, 2026
GPT-5.4
openai-gpt-54
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$3.13 / $18.80
per 1M tokens · Venice
June 11, 2026
GPT-5.4 Mini
openai-gpt-54-mini
Venice
1 offer
Reasoning Tools Chat Streaming
400,000
$0.94 / $5.63
per 1M tokens · Venice
June 11, 2026
GPT-5.4 Pro
openai-gpt-54-pro
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$37.50 / $225.00
per 1M tokens · Venice
June 11, 2026
GPT-5.5
openai-gpt-55
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$6.25 / $37.50
per 1M tokens · Venice
June 11, 2026
GPT-5.5 Pro
openai-gpt-55-pro
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$37.50 / $225.00
per 1M tokens · Venice
June 11, 2026
Grok 4.20
grok-4-20
Venice
1 offer
Reasoning Tools Chat Streaming
2,000,000
$1.42 / $2.83
per 1M tokens · Venice
June 11, 2026
Grok 4.20 Multi-Agent
grok-4-20-multi-agent
Venice
1 offer
Reasoning Chat Streaming
2,000,000
$1.42 / $2.83
per 1M tokens · Venice
June 11, 2026
Grok 4.3
grok-4-3
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$1.42 / $2.83
per 1M tokens · Venice
June 11, 2026
Grok Build 0.1
grok-build-0-1
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$1.00 / $2.00
per 1M tokens · Venice
June 11, 2026
Hermes 3 Llama 3.1 405b
hermes-3-llama-3.1-405b
Venice
1 offer
Text generation
128,000
$1.10 / $3.00
per 1M tokens · Venice
June 11, 2026
Inception: Mercury 2
mercury-2
Openrouter, Venice
2 offers
Reasoning Tools Chat Streaming
128,000
$0.25 / $0.75
per 1M tokens · Openrouter
June 11, 2026
Kimi K2.5
kimi-k2-5
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.56 / $3.50
per 1M tokens · Venice
June 11, 2026
Kimi K2.6
kimi-k2-6
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.75 / $3.50
per 1M tokens · Venice
June 11, 2026
Llama 3.2 3B
llama-3.2-3b
Venice
1 offer
Tools Chat Streaming
128,000
$0.15 / $0.60
per 1M tokens · Venice
June 11, 2026
Llama 3.3 70B
llama-3.3-70b
Venice
1 offer
Tools Chat Streaming
128,000
$0.70 / $2.80
per 1M tokens · Venice
June 11, 2026
MiMo-V2.5
xiaomi-mimo-v2-5
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$0.14 / $0.28
per 1M tokens · Venice
June 11, 2026
MiniMax M2.5
minimax-m25
Venice
1 offer
Reasoning Tools Chat Streaming
198,000
$0.27 / $0.95
per 1M tokens · Venice
June 11, 2026
MiniMax M2.7
minimax-m27
Venice
1 offer
Reasoning Tools Chat Streaming
198,000
$0.38 / $1.50
per 1M tokens · Venice
June 11, 2026
Mistral Small 3.2 24B Instruct
mistral-small-3-2-24b-instruct
Venice
1 offer
Tools Chat Streaming
256,000
$0.09 / $0.25
per 1M tokens · Venice
June 11, 2026
Mistral Small 4
mistral-small-2603
Mistral, Venice
2 offers
Reasoning Tools Chat Streaming
256,000
$0.15 / $0.60
per 1M tokens · Mistral
June 11, 2026
Nemotron Cascade 2 30B A3B
nvidia-nemotron-cascade-2-30b-a3b
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.14 / $0.80
per 1M tokens · Venice
June 11, 2026
NVIDIA Nemotron 3 Nano 30B
nvidia-nemotron-3-nano-30b-a3b
Venice
1 offer
Tools Chat Streaming
128,000
$0.08 / $0.30
per 1M tokens · Venice
June 11, 2026
NVIDIA Nemotron 3 Ultra
nvidia-nemotron-3-ultra-550b-a55b
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.63 / $3.13
per 1M tokens · Venice
June 11, 2026
OpenAI GPT OSS 120B
openai-gpt-oss-120b
Venice
1 offer
Reasoning Tools Chat Streaming
128,000
$0.07 / $0.30
per 1M tokens · Venice
June 11, 2026
Qwen 3 235B A22B Instruct 2507
qwen3-235b-a22b-instruct-2507
Venice
1 offer
Tools Chat Streaming
128,000
$0.15 / $0.75
per 1M tokens · Venice
June 11, 2026
Qwen 3 Coder 480B Turbo
qwen3-coder-480b-a35b-instruct-turbo
Venice
1 offer
Tools Chat Streaming
256,000
$0.35 / $1.50
per 1M tokens · Venice
June 11, 2026
Qwen 3 Next 80b
qwen3-next-80b
Venice
1 offer
Tools Chat Streaming
256,000
$0.35 / $1.90
per 1M tokens · Venice
June 11, 2026
Qwen 3.5 35B A3B
qwen3-5-35b-a3b
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.31 / $1.25
per 1M tokens · Venice
June 11, 2026
Qwen 3.5 397B
qwen3-5-397b-a17b
Venice
1 offer
Reasoning Tools Chat Streaming
128,000
$0.75 / $4.50
per 1M tokens · Venice
June 11, 2026
Qwen 3.5 9B
qwen3-5-9b
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.10 / $0.15
per 1M tokens · Venice
June 11, 2026
Qwen 3.6 27B
qwen3-6-27b
Venice
1 offer
Reasoning Tools Chat Streaming
256,000
$0.33 / $3.25
per 1M tokens · Venice
June 11, 2026
Qwen 3.6 Plus Uncensored
qwen-3-6-plus
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$0.63 / $3.75
per 1M tokens · Venice
June 11, 2026
Qwen 3.7 Max
qwen-3-7-max
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$2.70 / $8.05
per 1M tokens · Venice
June 11, 2026
Qwen 3.7 Plus
qwen-3-7-plus
Venice
1 offer
Reasoning Tools Chat Streaming
1,000,000
$0.50 / $2.00
per 1M tokens · Venice
June 11, 2026
Qwen3-VL 235B-A22B
qwen3-vl-235b-a22b
Alibaba, Venice
2 offers
Reasoning Tools Chat Streaming
131,072
$0.21 / $1.90
per 1M tokens · Venice
June 11, 2026
Qwen: Qwen3 235B A22B Thinking 2507
qwen3-235b-a22b-thinking-2507
Openrouter, Venice, Zenmux
3 offers
Reasoning Tools Chat Streaming
262,144
$0.30 / $3.00
per 1M tokens · Openrouter
June 11, 2026
Venice Role Play Uncensored
venice-uncensored-role-play
Venice
1 offer
Tools Chat Streaming
128,000
$0.50 / $2.00
per 1M tokens · Venice
June 11, 2026
Venice Uncensored 1.2
venice-uncensored-1-2
Venice
1 offer
Tools Chat Streaming
128,000
$0.20 / $0.90
per 1M tokens · Venice
June 11, 2026
Z.AI GLM-4.7
zai-glm-4.7
Cerebras
1 offer
Reasoning Tools Chat Streaming
131,072
$2.25 / $2.75
per 1M tokens · Cerebras
June 10, 2026
Anthropic: Claude Fable Latest
claude-fable-latest
Openrouter
1 offer
Reasoning Tools Chat Streaming
1,000,000
$10.00 / $50.00
per 1M tokens · Openrouter
June 9, 2026
Command A Plus
command-a-plus-05-2026
Cohere
1 offer
Reasoning Tools Chat Streaming
128,000
$2.50 / $10.00
per 1M tokens · Cohere
June 9, 2026
North Mini Code
north-mini-code-1-0
Cohere
1 offer
Reasoning Tools Chat Streaming
256,000
$0.00 / $0.00
per 1M tokens · Cohere
June 9, 2026
North Mini Code Free
north-mini-code-free
Opencode
1 offer
Reasoning Tools Chat Streaming
256,000
$0.00 / $0.00
per 1M tokens · Opencode
June 9, 2026

How this LLM list works

The page builds a conservative directory from active provider offers with explicit typed text-generation support.

Inclusion criteria

  • The provider offer is allowed and is not catalog-only, deprecated, or retired.
  • The execution metadata explicitly marks text generation as supported.
  • The input and output modality sets both include text.

Exclusions

  • The list excludes catalog-only, deprecated, and retired provider offers.
  • The list excludes offers without explicit typed text execution support.
  • The list excludes records that do not support both text input and text output.

Data rules

  • Grouping: Provider offers are grouped conservatively by normalized model ID. A vendor prefix is removed only when the remaining ID is specific and agrees with the model name.
  • Context limits: The context value is the largest recorded provider limit for the grouped model identity.
  • Token price: The displayed price pair comes from the offer with the lowest known input-token price.
  • Ordering: Models are ordered by the latest valid metadata date, then by name and model ID for stable output.

Limits of the data

  • This page is a directory. It does not rank model quality or benchmark performance.
  • A missing price or capability means that the catalog does not have a confirmed value. It does not prove that the model lacks that feature.
  • Provider metadata changes often and can become stale between catalog releases.

What this page can answer

Use this page to find active LLM model IDs, see which providers offer each model, and compare known context windows, capabilities, and token prices. Follow a model link for the complete provider record.

Sources

  • llm_db — Primary source for model records, typed execution data, prices, and capabilities. Checked 2026-07-30.
  • models.dev — One upstream source used by the llm_db catalog. Checked 2026-07-30.

See About llmdb.xyz for more information about the data.