clervo/fast
Low-latency general text and JSON alias. Provider routing may change without changing the public model ID.
Callable Free: $0/request Clervo Smartclervo/smart
Balanced reasoning and instruction-following alias for general agent workloads.
Callable Free: $0/request Clervo Codeclervo/code
Code generation and software-engineering alias with replaceable provider routing.
Callable $0.015 USD/request Clervo Deepclervo/deep
Deeper reasoning alias for tasks where quality matters more than latency.
Callable Free: $0/request GPT 5.4 Mini (QuickAI label)quickai/gpt-5.4-mini
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.005 USD/request GPT 5.4 (QuickAI label)quickai/gpt-5.4
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.018 USD/request GPT 5.5 (QuickAI label)quickai/gpt-5.5
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.035 USD/request GPT 5.6 Luna (QuickAI label)quickai/gpt-5.6-luna
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.007 USD/request GPT 5.6 Terra (QuickAI label)quickai/gpt-5.6-terra
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.018 USD/request GPT 5.6 Sol (QuickAI label)quickai/gpt-5.6-sol
Provider-reported model label observed in a bounded authenticated QuickAI test.
Callable $0.035 USD/request Llama 3.1 8B Instant (Groq)groq/llama-3.1-8b-instant
Ultra-fast open model via Groq. 170ms latency. Free during launch.
Callable Free: $0/request Claude Haiku 4.5tongkhokr/claude-haiku-4.5
Fast affordable Claude model. 10% below BlockRun pricing.
Callable $0.002 USD/request Claude Sonnet 5tongkhokr/claude-sonnet-5
Balanced Claude model. 10% below BlockRun pricing.
Callable $0.015 USD/request Claude Opus 5tongkhokr/claude-opus-5
Most powerful Claude model. 10% below BlockRun pricing.
Callable $0.084 USD/request Llama 3.3 70B (Groq)groq/llama-3.3-70b
Large open model via Groq. Fast inference, strong reasoning.
Callable Free: $0/request Llama 3.3 70B (SambaNova)sambanova/llama-3.3-70b
Large open model via SambaNova. Free tier.
Callable Free: $0/request Claude Sonnet 4.6tongkhokr/claude-sonnet-4.6
Balanced Claude model. Great for coding and reasoning.
Callable $0.015 USD/request Claude Opus 4.7tongkhokr/claude-opus-4.7
Powerful Claude for complex reasoning. 1M context.
Callable $0.084 USD/request Qwen 3.6 27B (Groq)groq/qwen3.6-27b
Qwen 3.6 27B (Groq) — fast inference via Groq. Free during beta.
Callable Free: $0/request GPT-OSS 120B (Groq)groq/gpt-oss-120b
GPT-OSS 120B (Groq) — fast inference via Groq. Free during beta.
Callable Free: $0/request GPT-OSS 20B (Groq)groq/gpt-oss-20b
GPT-OSS 20B (Groq) — fast inference via Groq. Free during beta.
Callable Free: $0/request Nemotron 3 Ultra 550B (Nvidia)nvidia/nemotron-ultra-550b
Nemotron 3 Ultra 550B (Nvidia) — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Nemotron 3 Super 120B (Nvidia)nvidia/nemotron-super-120b
Nemotron 3 Super 120B (Nvidia) — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Nemotron 3 Nano 30B (Nvidia)nvidia/nemotron-nano-30b
Nemotron 3 Nano 30B (Nvidia) — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request DeepSeek V4 Flash (Nvidia)nvidia/deepseek-v4-flash
DeepSeek V4 Flash (Nvidia) — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Llama 4 Maverick 17B (Nvidia)nvidia/llama-4-maverick-17b
Meta Llama 4 Maverick 17B 128-expert MoE — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Gemma 4 31B (Nvidia)nvidia/gemma-4-31b
Google Gemma 4 31B instruction-tuned — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Mistral Small 4 119B (Nvidia)nvidia/mistral-small-4-119b
Mistral Small 4 119B — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request MiniMax M3 (Nvidia)nvidia/minimax-m3
MiniMax M3 reasoning model — hosted on Nvidia NIM. Free during beta.
Callable Free: $0/request Claude Opus 4.8tongkhokr/claude-opus-4.8
Anthropic Claude Opus 4.8 via TongKhokr gateway. 10% below BlockRun pricing.
Callable $0.084 USD/request Clervo Opus 5clervo/opus-5
Flagship reasoning and code model. Highest capability tier for hard problems and long-horizon agent work.
Callable $0.084 USD/request Clervo Sonnet 5clervo/sonnet-5
Balanced high-capability model for production reasoning, code and general agent workloads.
Callable $0.015 USD/request Clervo Haiku 4.5clervo/haiku-4.5
Cheapest paid tier. Fast, capable model for high-volume agent tasks.
Callable $0.002 USD/request Clervo GPT Miniclervo/gpt-mini
Budget GPT-class model for everyday completions and tool calls.
Callable $0.005 USD/request Clervo GPTclervo/gpt
Full GPT-class model for general reasoning and generation.
Callable $0.018 USD/request Clervo GPT Maxclervo/gpt-max
Highest GPT-class tier for demanding generation and analysis.
Callable $0.035 USD/request