Skip to main content
Docs
Supported Models

Supported Models

Complete list of AI models available through Elyxir.

Elyxir provides access to hundreds of AI models from major providers. This reference lists the currently active models with Elyxir pricing.

OpenAI Models

GPT-5 Series

ModelContextInput/1MOutput/1MBest For
gpt-5.5128K$6.00$36.00Current flagship
gpt-5.5-pro128K$36.00$216.00Maximum reasoning depth
gpt-5.5-instant128K$6.00$36.00Speed-optimized flagship
gpt-5.4128K$3.00$18.00Mid-tier flagship
gpt-5.2128K$2.10$16.80Previous flagship
gpt-5.1128K$0.75$6.00Budget tier
gpt-5-mini128K$0.30$2.40Balanced, cost-effective
gpt-5-nano128K$0.06$0.48Fast, budget-friendly

GPT-4.1 Series

ModelContextInput/1MOutput/1MBest For
gpt-4.11M$2.40$9.60Long context, vision
gpt-4.1-mini1M$0.48$1.92Efficient, vision
gpt-4.1-nano1M$0.12$0.48Ultra-fast, cheap

GPT-4 Series

ModelContextInput/1MOutput/1MBest For
gpt-4o128K$3.00$12.00General, Vision
gpt-4o-mini128K$0.18$0.72Cost-effective

Embeddings

ModelDimensionsMax InputPrice/1M
text-embedding-3-large30728191$0.16
text-embedding-3-small15368191$0.02

Anthropic Models

Claude 4.8 Series (Latest)

ModelContextInput/1MOutput/1MBest For
claude-opus-4.8200K$6.00$30.00Current flagship, agentic coding

Claude 4.7 Series

ModelContextInput/1MOutput/1MBest For
claude-opus-4.7200K$6.00$30.00Complex agentic tasks

Claude 4.6 Series

ModelContextInput/1MOutput/1MBest For
claude-sonnet-4.6200K$3.60$18.00Coding, Agents
claude-opus-4.6200K$6.00$30.00Most capable

Claude 4.5 Series

ModelContextInput/1MOutput/1MBest For
claude-sonnet-4.5200K$3.60$18.00Coding, Agents
claude-opus-4.5200K$6.00$30.00Most capable
claude-haiku-4.5200K$1.20$6.00Fast, affordable

Google Models

Gemini 3.5 Series (Latest)

ModelContextInput/1MOutput/1MBest For
gemini-3.5-flash1M$1.80$10.80Fast, beats 3.1 Pro on coding

Gemini 3.1 Series

ModelContextInput/1MOutput/1MBest For
gemini-3.1-pro-preview1M$2.40$14.40Most capable, reasoning

Gemini 3 Series

ModelContextInput/1MOutput/1MBest For
gemini-3-pro-preview1M$2.40$14.40Advanced reasoning
gemini-3-flash1M$0.60$3.60Fast, efficient

Gemini 2.5 Series

ModelContextInput/1MOutput/1MBest For
gemini-2.5-pro1M$1.50$12.00Balanced, long context
gemini-2.5-flash1M$0.36$3.00Fast
gemini-2.5-flash-lite1M$0.12$0.48Ultra-fast, low-cost

xAI Models

Grok 4.3 Series (Latest)

ModelContextInput/1MOutput/1MBest For
grok-4.31M$1.50$3.00Current flagship, cost-efficient

Grok 4 Series

ModelContextInput/1MOutput/1MBest For
grok-4100K$3.60$18.00High-capability reasoning

Mistral AI Models

ModelContextBest For
mistral-large-3256KMost capable
mistral-medium-3.1128KBalanced
mistral-small-4256KMultimodal, agentic coding
mistral-small-3.2128KFast, efficient
codestral-22b256KCode generation

DeepSeek Models

ModelContextBest For
deepseek-v4-pro128KFlagship reasoning and coding
deepseek-v4-flash128KFast, cost-effective V4
deepseek-v3.2128KGeneral purpose
deepseek-v3.1128KFast, versatile

Cohere Models

ModelContextBest For
command-a-plus256KLatest flagship, vision
command-a256KEnterprise RAG

Perplexity Models

ModelContextBest For
sonar-deep-research128KDeep research with citations
sonar-reasoning-pro128KReasoning with web search
perplexity-sonar-large128KGeneral search
perplexity-sonar128KFast search

Meta Models

Llama 4 Series

ModelContextBest For
llama4-scout320KEfficient, vision
llama4-maverick1MComplex tasks, vision

Llama 3.3 Series

ModelContextBest For
llama-3.3-70b128KHigh quality

Open-Weight Models (GLM, Kimi, MiniMax, Qwen)

GLM Series (Zhipu AI)

ModelContextBest For
glm-5.1202KCoding, agentic workflows
glm-5202KGeneral purpose
glm-5v-turbo203KNative multimodal (text + image)
glm-4.7128KBalanced
glm-4.6202KCost-efficient

Kimi Series (Moonshot AI)

ModelContextBest For
kimi-k2.6256KMultimodal, long-horizon coding
kimi-k2.5256KAgentic, top-ranked coding
kimi-k2128KAgentic workflows
kimi-k2-thinking128KExtended reasoning

MiniMax Series

ModelContextBest For
minimax-m31MMultimodal flagship
minimax-m2.7200KBalanced MoE
minimax-m2.5196KCost-effective

Qwen Series (Alibaba)

ModelContextBest For
qwen3.7-max1MLong-horizon agent tasks
qwen3.5256KLarge-scale multilingual
qwen3-coder-next256KCode generation
qwen3-235b-thinking128KExtended reasoning
qwen3-32b40KMid-size, versatile

NVIDIA Nemotron Series

ModelContextBest For
nemotron-3-super-120b1MFlagship agentic reasoning
nemotron-3-nano-30b256KFast, low-cost reasoning

Capability-Specific Models

Agentic Coding

ModelContextBest For
grok-build-0.1256KxAI coding model (public beta)
gpt-5.3-codex128KOpenAI Responses API coding

Image Generation

ModelBest For
gpt-image-2Next-gen OpenAI image generation
gpt-image-1.5Fast OpenAI image generation
nano-bananaGemini 2.5 Flash Image, precise text
nano-banana-proGemini 3 Pro Image, studio quality
nano-banana-2Gemini 3.1 Flash Image, local edits
imagen-4Google Imagen 4 Standard
flux-2-proFLUX.2 [pro], SOTA open image
flux-devFLUX.1 dev, high quality
flux-schnellFLUX.1 schnell, ultra-fast

Video Generation

ModelBest For
veo-3.1Google Veo 3.1 GA, with audio
veo-3.1-fastVeo 3.1 fast tier, 720p
veo-3Google Veo 3, with audio
veo-3-fastGoogle Veo 3 fast
veo-2Google Veo 2
sora-2OpenAI Sora 2
sora-2-proOpenAI Sora 2 Pro

Audio

ModelBest For
eleven-v3ElevenLabs v3 TTS, natural voice
tts-1-hdOpenAI HD text-to-speech
tts-1OpenAI standard text-to-speech
scribe-v2ElevenLabs speech-to-text (primary)
scribe-v1ElevenLabs speech-to-text (legacy)
whisper-1OpenAI Whisper transcription
gpt-4o-transcribeGPT-4o powered transcription
ModelBest For
sonar-deep-researchDeep multi-step research
sonar-reasoning-proReasoning with real-time sources
perplexity-sonar-largeWeb-grounded answers
perplexity-sonarFast web search

Model Selection Guide

By Task

TaskRecommended
General chatgpt-5-mini, claude-haiku-4.5
Complex reasoninggpt-5.5, claude-opus-4.8, deepseek-v4-pro
Code generationclaude-sonnet-4.6, grok-build-0.1
Long documentsgpt-4.1, gemini-2.5-pro
Web searchsonar-deep-research, perplexity-sonar-large
Embeddingstext-embedding-3-small
Fast inferencegpt-5-nano, gemini-2.5-flash-lite
Image generationgpt-image-2, nano-banana-pro
Video generationveo-3.1, sora-2
Text-to-speecheleven-v3, tts-1-hd

By Budget

BudgetRecommended
Minimalgpt-5-nano, gemini-2.5-flash-lite
Moderategpt-5-mini, claude-haiku-4.5
Premiumgpt-5.5, claude-opus-4.8

Using Model IDs

Use the full model ID in API requests:

response = client.chat.completions.create(
    model="gpt-4o-mini",  # Model ID
    messages=[...]
)

Or with provider prefix:

response = client.chat.completions.create(
    model="anthropic/claude-sonnet-4.5",
    messages=[...]
)

Model Availability

Model availability may vary. Check the Model Hub for current availability and pricing.

Supported Models | elyxir