Inference
inference
Updated 2 hours ago
Inference.net is a high-performance AI inference platform that provides access to leading large language models including Meta's Llama family, DeepSeek, Mistral, Google's Gemma, Qwen, and OpenAI models. The platform focuses on delivering fast, efficient inference with various precision options (fp-16, fp-8, bf-16) to optimize performance and cost. Inference.net offers an OpenAI-compatible API interface, making it easy to integrate with existing applications while providing access to state-of-the-art models through their unified endpoint.
Browse 67 LLM models available from Inference. Compare prices and features.
Models (67)
| Organization | Model Name | Original Model | Input | Output | Free | |||
|---|---|---|---|---|---|---|---|---|
|
|
Anthropic | Claude Opus 5.5 |
claude-opus-5-5
|
$4.00 | $20.00 |
|
||
|
|
OpenAI | GPT-6 Luna |
gpt-6-luna
|
$0.10 | $0.50 |
|
||
|
|
Z.ai | GLM-5.3-Flash |
glm-5.3-flash
|
$0.10 | $0.45 |
|
||
|
|
SpaceXAI | Grok 4.6 |
grok-4.6
|
$2.00 | $6.00 | |||
|
|
OpenAI | GPT-6 Astra |
gpt-6-astra
|
$10.00 | $50.00 |
|
||
|
|
Z.ai | GLM-5.3 |
glm-5.3
|
$0.90 | $3.00 |
|
||
|
|
OpenAI | GPT-6 Sol |
gpt-6-sol
|
$2.00 | $10.00 |
|
||
|
|
DeepSeek | DeepSeek-V4.1-Flash |
deepseek-v4.1-flash
|
$0.30 | $1.00 |
|
||
|
|
Anthropic | Claude Opus 5 |
claude-opus-5
|
$5.00 | $25.00 |
|
||
|
|
Moonshot AI | Kimi K3 |
moonshotai/kimi-k3
|
$3.00 | $15.00 | |||
|
|
SpaceXAI | Grok 4.5 |
grok-4.5
|
$2.00 | $6.00 | |||
|
|
Gemini 3.6 Flash |
gemini-3.6-flash
|
$1.50 | $7.50 | ||||
|
|
OpenAI | GPT-5.6 Sol |
gpt-5.6-sol
|
$5.00 | $30.00 |
|
||
|
|
OpenAI | GPT-5.6 Luna |
gpt-5.6-luna
|
$0.20 | $1.20 |
|
||
|
|
OpenAI | GPT-5.6 Terra |
gpt-5.6-terra
|
$2.00 | $12.00 |
|
||
|
|
Anthropic | Claude Fable 5 |
claude-fable-5
|
$10.00 | $50.00 | |||
|
|
Gemini 3.5 Flash-Lite |
gemini-3.5-flash-lite
|
$0.30 | $2.50 |
|
|||
|
|
Z.ai | GLM-5.2 |
glm-5.2
|
$0.65 | $2.20 |
|
||
|
|
Anthropic | Claude Opus 4.8 |
claude-opus-4-8
|
$5.00 | $25.00 |
|
||
|
|
OpenAI | GPT-5.5 |
gpt-5.5
|
$5.00 | $30.00 | |||
|
|
Gemini 3.5 Flash |
gemini-3.5-flash
|
$1.50 | $9.00 | ||||
|
|
Alibaba | Qwen3.7-Plus |
qwen3.7-plus
|
$0.40 | $1.60 | |||
|
|
DeepSeek | DeepSeek-V4-Pro-Max |
deepseek-v4-pro
|
$2.10 | $4.20 |
|
||
|
|
DeepSeek | DeepSeek-V4-Pro-Max |
deepseek-v4-pro-0813
|
$1.32 | $3.96 |
|
||
|
|
Anthropic | Claude Opus 4.7 |
claude-opus-4-7
|
$5.00 | $25.00 | |||
|
|
DeepSeek | DeepSeek-V4-Flash-Max |
deepseek-v4-flash
|
$0.23 | $0.62 |
|
||
|
|
DeepSeek | DeepSeek-V4-Flash-Max |
deepseek-v4-flash-0731
|
$0.53 | $1.58 |
|
||
|
|
Moonshot AI | Kimi K2.6 |
kimi-k2.6
|
$1.25 | $5.30 | |||
|
|
Gemini 3.1 Pro |
gemini-3.1-pro-preview
|
$2.00 | $12.00 | ||||
|
|
OpenAI | GPT-5.4 |
gpt-5.4
|
$2.50 | $15.00 | |||
|
|
Anthropic | Claude Opus 4.6 |
claude-opus-4-6
|
$5.00 | $25.00 | |||
|
|
Anthropic | Claude Sonnet 4.6 |
claude-sonnet-4-6
|
$3.00 | $15.00 |
|
||
|
|
qwen | Qwen3 Max Thinking |
qwen3-max-thinking
|
$0.78 | $3.90 | |||
|
|
Z.ai | GLM-5 |
glm-5
|
$0.95 | $2.55 |
|
||
|
|
Gemini 3.1 Flash-Lite |
gemini-3.1-flash-lite
|
$0.25 | $1.50 |
|
|||
|
|
Gemini 3 Flash |
gemini-3-flash-preview
|
$0.50 | $3.00 |
|
|||
|
|
Moonshot AI | Kimi K2.5 |
kimi-k2.5
|
$0.80 | $3.95 | |||
|
|
Anthropic | Claude Haiku 4.5 |
claude-haiku-4-5
|
$1.00 | $5.00 | |||
|
|
DeepSeek | DeepSeek-V3.2 |
deepseek-v3.2
|
$0.70 | $2.00 | |||
|
|
OpenAI | GPT-5 nano |
gpt-5-nano
|
$0.05 | $0.40 |
|
||
|
|
OpenAI | GPT-5 mini |
gpt-5-mini
|
$0.25 | $2.00 | |||
|
|
Alibaba | Qwen3 14B |
qwen3-14b
|
$0.23 | $0.91 | |||
|
|
Gemini 2.5 Pro Preview 06-05 |
gemini-2.5-pro
|
$1.25 | $10.00 | ||||
|
|
Gemini 2.5 Flash-Lite |
gemini-2.5-flash-lite
|
$0.10 | $0.40 |
|
|||
|
|
Gemini 2.5 Flash |
gemini-2.5-flash
|
$0.30 | $2.50 |
|
|||
|
|
qwen | Qwen3 30B A3B |
qwen3-30b-a3b
|
$0.12 | $0.50 | |||
|
|
OpenAI | GPT-4.1 |
gpt-4.1
|
$2.00 | $8.00 | |||
|
|
OpenAI | GPT-4.1 nano |
gpt-4.1-nano
|
$0.10 | $0.40 | |||
|
|
OpenAI | GPT-4.1 mini |
gpt-4.1-mini
|
$0.40 | $1.60 | |||
|
|
OpenAI | GPT-4o |
gpt-4o
|
$2.50 | $10.00 | |||
|
|
Gemma 3 27B |
gemma-3-27b-it
|
$0.09 | $0.25 | ||||
|
|
Meta | Llama 3.3 70B Instruct |
llama-3.3-70b-instruct
|
$0.13 | $0.40 | |||
|
|
OpenAI | GPT-4o mini |
gpt-4o-mini
|
$0.15 | $0.60 |
|
||
|
|
Gemma 3 4B |
gemma-3-4b-it
|
$0.05 | $0.10 | ||||
|
|
Meta | Llama 3.2 3B Instruct |
meta/llama-3.2-3b-instruct
|
$0.02 | $0.02 | |||
|
|
Meta | Llama 3.2 3B Instruct |
llama-3.2-3b-instruct
|
$0.05 | $0.33 | |||
|
|
Meta | Llama 3.1 8B Instruct |
meta/llama-3.1-8b-instruct
|
$0.03 | $0.03 | |||
|
|
InferenceNet | Inference.net: Schematron V2 Small |
inference-net/schematron-v2-small
|
$0.05 | $0.23 | |||
|
|
InferenceNet | Inference.net: Schematron V2 Turbo |
inference-net/schematron-v2-turbo
|
$0.03 | $0.15 | |||
|
|
Gemini 3.7 Flash |
gemini-3.7-flash
|
$1.50 | $7.50 | ||||
|
|
BaseTen | GLM 5.2 Fast |
glm-5.2-fast
|
$2.60 | $8.80 | |||
|
|
qwen | Qwen3 Embedding 4B |
qwen/qwen3-embedding-4b
|
$0.01 | $0.00 | |||
|
|
Alibaba | Qwen3 8B |
qwen3-8b
|
$0.12 | $0.46 | |||
|
|
Nvidia | Llama 3.2 11b Vision Instruct |
meta/llama-3.2-11b-vision-instruct
|
$0.06 | $0.06 | |||
|
|
Meta | llama-3.2-1b-instruct |
meta/llama-3.2-1b-instruct
|
$0.01 | $0.01 | |||
|
|
Meta | llama-3.2-1b-instruct |
llama-3.2-1b-instruct
|
$0.03 | $0.20 | |||
|
|
BaseTen | Nemotron 3 Super |
nemotron-3-super
|
$0.10 | $0.48 |