Model provider

Venice AI

Explore models served by Venice AI.

86models

Pricing & endpoints

94 offers · USD per million tokens
ModelProviderModel IDContextOutputInput / output · 1MReasoningToolsStructuredRoute
GLM-4.7-FlashVenice AI
zai-org-glm-4.7-flash
128,00016,384$0.06 / $0.40YesYesYes
View route
GPT OSS 120BVenice AI
openai-gpt-oss-120b
128,00016,384$0.07 / $0.30YesYesYes
View route
Nemotron 3 Nano 30B A3BVenice AI
nvidia-nemotron-3-nano-30b-a3b
128,00016,384$0.075 / $0.30NoYesYes
View route
Qwen3.6 35B-A3BVenice AI
qwen3-6-35b-a3b
256,00065,536$0.10 / $1.00YesYesYes
View route
Qwen3.5 9BVenice AI
qwen3-5-9b
256,00032,768$0.10 / $0.15YesYesYes
View route
Gemma 3 27B ITVenice AI
google-gemma-3-27b-it
198,00016,384$0.12 / $0.20NoYesYes
View route
Gemma 4 31B ITVenice AI
google-gemma-4-31b-it
256,0008,192$0.12 / $0.36YesYesYes
View route
GPT-6 LunaVenice AI
openai-gpt-6-luna
1,050,000128,000$0.125 / $0.625YesYesYes
View route
Gemma 4 26B A4B ITVenice AI
google-gemma-4-26b-a4b-it
256,0008,192$0.13 / $0.40YesYesYes
View route
DeepSeek V4 FlashVenice AI
deepseek-v4-flash
1,000,00032,768$0.138 / $0.275YesYesYes
View route
Qwen3.8 FlashVenice AI
qwen-3-8-flash
1,000,000131,072$0.14 / $0.49YesYesYes
View route
GLM-5.3-FlashVenice AI
z-ai-glm-5-3-flash
1,048,576131,072$0.15 / $0.50YesYesYes
View route
Qwen3 235B-A22B Instruct 2507Venice AI
qwen3-235b-a22b-instruct-2507
128,00016,384$0.15 / $0.75NoYesYes
View route
Llama-3.2-3BVenice AI
llama-3.2-3b
128,0004,096$0.15 / $0.60NoYes—
View route
MiMo-V2.6-FlashVenice AI
xiaomi-mimo-v2-6-flash
1,000,000131,072$0.175 / $0.35YesYesYes
View route
DeepSeek V4 Flash 0731Venice AI
deepseek-v4-flash-0731
1,000,00032,768$0.175 / $0.35YesYesYes
View route
GPT-4o miniVenice AI
openai-gpt-4o-mini-2024-07-18
128,00016,384$0.1875 / $0.75NoYesYes
View route
GPT-5.6 LunaVenice AI
openai-gpt-56-luna
1,000,000128,000$0.25 / $1.50YesYesYes
View route
GPT-5.6 LunaVenice AI
openai-gpt-56-luna-pro
1,000,000128,000$0.25 / $1.50YesYesYes
View route
MiniMax-M2.5Venice AI
minimax-m25
198,00032,768$0.27 / $0.95YesYes—
View route
DeepSeek V4.1 FlashVenice AI
deepseek-v4-1-flash
1,000,000131,072$0.30 / $1.20YesYesYes
View route
Qwen3.5 35B-A3BVenice AI
qwen3-5-35b-a3b
256,00016,384$0.3125 / $1.25YesYesYes
View route
Qwen3.6 27BVenice AI
qwen3-6-27b
256,00065,536$0.325 / $3.25YesYesYes
View route
DeepSeek V3.2Venice AI
deepseek-v3.2
160,00032,768$0.33 / $0.48YesYesYes
View route
DeepSeek V4 Flash 0731Venice AI
deepseek-v4-flash-0731-fast
1,000,00032,768$0.35 / $0.70YesYesYes
View route
Gemini 3.5 Flash LiteVenice AI
gemini-3-5-flash-lite
1,000,00065,536$0.375 / $3.125YesYesYes
View route
MiniMax-M2.7Venice AI
minimax-m27
198,00032,768$0.375 / $1.50YesYes—
View route
MiMo-V2.5Venice AI
xiaomi-mimo-v2-5
1,000,00065,536$0.40 / $2.00YesYesYes
View route
GLM-4.6Venice AI
zai-org-glm-4.6
198,00016,384$0.43 / $1.75YesYesYes
View route
Qwen3.8 27BVenice AI
qwen-3-8-27b
262,14465,536$0.45 / $3.20YesYesYes
View route
Qwen3.7 PlusVenice AI
qwen-3-7-plus
1,000,00065,536$0.50 / $2.00YesYesYes
View route
GLM-4.7Venice AI
zai-org-glm-4.7
198,00016,384$0.55 / $2.65YesYesYes
View route
Kimi K2.5Venice AI
kimi-k2-5
256,00065,536$0.56 / $3.50YesYesYes
View route
Seed 2.1 TurboVenice AI
seed-2-1-turbo
256,00065,536$0.625 / $3.125YesYesYes
View route
Nemotron 3 Ultra 550B A55BVenice AI
nvidia-nemotron-3-ultra-550b-a55b
256,00032,768$0.625 / $3.125YesYesYes
View route
Qwen3.6 PlusVenice AI
qwen-3-6-plus
1,000,00065,536$0.625 / $3.75YesYesYes
View route
Gemini 3 Flash PreviewVenice AI
gemini-3-flash-preview
256,00065,536$0.70 / $3.75YesYesYes
View route
Qwen3.5 397B-A17BVenice AI
qwen3-5-397b-a17b
128,00032,768$0.75 / $4.50YesYesYes
View route
Kimi K2.7 CodeVenice AI
kimi-k2-7-code
256,00065,536$0.75 / $3.50YesYesYes
View route
Kimi K2.6Venice AI
kimi-k2-6
256,00065,536$0.75 / $3.50YesYesYes
View route
1–40 of 94

Prices, limits and configurations apply to each serving offer. Open a model for its complete specifications and provider comparison.