Clervo model catalog

One OpenAI-compatible API. Callable and preview models are labeled separately.

Quickstart · JSON model list

Clervo Fast
clervo/fast

Low-latency general text and JSON alias. Provider routing may change without changing the public model ID.

Callable Free: $0/request
Clervo Smart
clervo/smart

Balanced reasoning and instruction-following alias for general agent workloads.

Callable Free: $0/request
Clervo Code
clervo/code

Code generation and software-engineering alias with replaceable provider routing.

Callable $0.015 USD/request
Clervo Deep
clervo/deep

Deeper reasoning alias for tasks where quality matters more than latency.

Callable Free: $0/request
GPT 5.4 Mini (QuickAI label)
quickai/gpt-5.4-mini

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.005 USD/request
GPT 5.4 (QuickAI label)
quickai/gpt-5.4

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.018 USD/request
GPT 5.5 (QuickAI label)
quickai/gpt-5.5

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.035 USD/request
GPT 5.6 Luna (QuickAI label)
quickai/gpt-5.6-luna

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.007 USD/request
GPT 5.6 Terra (QuickAI label)
quickai/gpt-5.6-terra

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.018 USD/request
GPT 5.6 Sol (QuickAI label)
quickai/gpt-5.6-sol

Provider-reported model label observed in a bounded authenticated QuickAI test.

Callable $0.035 USD/request
Llama 3.1 8B Instant (Groq)
groq/llama-3.1-8b-instant

Ultra-fast open model via Groq. 170ms latency. Free during launch.

Callable Free: $0/request
Claude Haiku 4.5
tongkhokr/claude-haiku-4.5

Fast affordable Claude model. 10% below BlockRun pricing.

Callable $0.002 USD/request
Claude Sonnet 5
tongkhokr/claude-sonnet-5

Balanced Claude model. 10% below BlockRun pricing.

Callable $0.015 USD/request
Claude Opus 5
tongkhokr/claude-opus-5

Most powerful Claude model. 10% below BlockRun pricing.

Callable $0.084 USD/request
Llama 3.3 70B (Groq)
groq/llama-3.3-70b

Large open model via Groq. Fast inference, strong reasoning.

Callable Free: $0/request
Llama 3.3 70B (SambaNova)
sambanova/llama-3.3-70b

Large open model via SambaNova. Free tier.

Callable Free: $0/request
Claude Sonnet 4.6
tongkhokr/claude-sonnet-4.6

Balanced Claude model. Great for coding and reasoning.

Callable $0.015 USD/request
Claude Opus 4.7
tongkhokr/claude-opus-4.7

Powerful Claude for complex reasoning. 1M context.

Callable $0.084 USD/request
Qwen 3.6 27B (Groq)
groq/qwen3.6-27b

Qwen 3.6 27B (Groq) — fast inference via Groq. Free during beta.

Callable Free: $0/request
GPT-OSS 120B (Groq)
groq/gpt-oss-120b

GPT-OSS 120B (Groq) — fast inference via Groq. Free during beta.

Callable Free: $0/request
GPT-OSS 20B (Groq)
groq/gpt-oss-20b

GPT-OSS 20B (Groq) — fast inference via Groq. Free during beta.

Callable Free: $0/request
Nemotron 3 Ultra 550B (Nvidia)
nvidia/nemotron-ultra-550b

Nemotron 3 Ultra 550B (Nvidia) — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Nemotron 3 Super 120B (Nvidia)
nvidia/nemotron-super-120b

Nemotron 3 Super 120B (Nvidia) — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Nemotron 3 Nano 30B (Nvidia)
nvidia/nemotron-nano-30b

Nemotron 3 Nano 30B (Nvidia) — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
DeepSeek V4 Flash (Nvidia)
nvidia/deepseek-v4-flash

DeepSeek V4 Flash (Nvidia) — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Llama 4 Maverick 17B (Nvidia)
nvidia/llama-4-maverick-17b

Meta Llama 4 Maverick 17B 128-expert MoE — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Gemma 4 31B (Nvidia)
nvidia/gemma-4-31b

Google Gemma 4 31B instruction-tuned — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Mistral Small 4 119B (Nvidia)
nvidia/mistral-small-4-119b

Mistral Small 4 119B — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
MiniMax M3 (Nvidia)
nvidia/minimax-m3

MiniMax M3 reasoning model — hosted on Nvidia NIM. Free during beta.

Callable Free: $0/request
Claude Opus 4.8
tongkhokr/claude-opus-4.8

Anthropic Claude Opus 4.8 via TongKhokr gateway. 10% below BlockRun pricing.

Callable $0.084 USD/request
Clervo Opus 5
clervo/opus-5

Flagship reasoning and code model. Highest capability tier for hard problems and long-horizon agent work.

Callable $0.084 USD/request
Clervo Sonnet 5
clervo/sonnet-5

Balanced high-capability model for production reasoning, code and general agent workloads.

Callable $0.015 USD/request
Clervo Haiku 4.5
clervo/haiku-4.5

Cheapest paid tier. Fast, capable model for high-volume agent tasks.

Callable $0.002 USD/request
Clervo GPT Mini
clervo/gpt-mini

Budget GPT-class model for everyday completions and tool calls.

Callable $0.005 USD/request
Clervo GPT
clervo/gpt

Full GPT-class model for general reasoning and generation.

Callable $0.018 USD/request
Clervo GPT Max
clervo/gpt-max

Highest GPT-class tier for demanding generation and analysis.

Callable $0.035 USD/request