{"apiVersion":"2026-07-25.3","description":"Low-price, agent-native x402 gateway. One wallet, one OpenAI-compatible API, many AI models. Pay per call in USDC — cheaper than BlockRun. No API keys, no accounts.","documentation":{"openapi":"https://api.clervo.dev/openapi.json","llms":"https://api.clervo.dev/llms.txt","quickstart":"https://api.clervo.dev/quickstart.md","models":"https://api.clervo.dev/v1/models","catalog":"https://api.clervo.dev/v1/catalog"},"name":"Clervo x402 Gateway","network":"mainnet","payment":{"chain":"solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp","facilitator":"coinbase-cdp","network":"solana","scheme":"exact","token":"USDC","tokenAddress":"EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v"},"resource":{"description":"Clervo x402 Gateway API","mimeType":"application/json","url":"https://api.clervo.dev"},"resources":["POST /v1/chat/completions","POST /v1/chat/completions/x402","GET /v1/models","GET /v1/catalog","GET /openapi.json","GET /llms.txt","GET /quickstart.md"],"services":[{"description":"OpenAI-compatible chat completions. 13 free models (no payment needed) + 13 paid models via x402 USDC.","endpoint":"/v1/chat/completions","freeModels":[{"capabilities":["text","json"],"description":"Low-latency general text and JSON alias. Provider routing may change without changing the public model ID.","id":"clervo/fast","latencyMs":170,"name":"Clervo Fast"},{"capabilities":["text","json","reasoning"],"description":"Balanced reasoning and instruction-following alias for general agent workloads.","id":"clervo/smart","latencyMs":475,"name":"Clervo Smart"},{"capabilities":["text","json","reasoning"],"description":"Deeper reasoning alias for tasks where quality matters more than latency.","id":"clervo/deep","latencyMs":988,"name":"Clervo Deep"},{"capabilities":["text","json"],"description":"Ultra-fast open model via Groq. 170ms latency. Free during launch.","id":"groq/llama-3.1-8b-instant","latencyMs":170,"name":"Llama 3.1 8B Instant (Groq)"},{"capabilities":["text","json","reasoning"],"description":"Large open model via Groq. Fast inference, strong reasoning.","id":"groq/llama-3.3-70b","latencyMs":800,"name":"Llama 3.3 70B (Groq)"},{"capabilities":["text","json","reasoning"],"description":"Large open model via SambaNova. Free tier.","id":"sambanova/llama-3.3-70b","latencyMs":1500,"name":"Llama 3.3 70B (SambaNova)"},{"capabilities":["text","json","reasoning"],"description":"Qwen 3.6 27B (Groq) — fast inference via Groq. Free during beta.","id":"groq/qwen3.6-27b","latencyMs":213,"name":"Qwen 3.6 27B (Groq)"},{"capabilities":["text","json","reasoning","code"],"description":"GPT-OSS 120B (Groq) — fast inference via Groq. Free during beta.","id":"groq/gpt-oss-120b","latencyMs":419,"name":"GPT-OSS 120B (Groq)"},{"capabilities":["text","json"],"description":"GPT-OSS 20B (Groq) — fast inference via Groq. Free during beta.","id":"groq/gpt-oss-20b","latencyMs":181,"name":"GPT-OSS 20B (Groq)"},{"capabilities":["text","json","reasoning","code"],"description":"Nemotron 3 Ultra 550B (Nvidia) — hosted on Nvidia NIM. Free during beta.","id":"nvidia/nemotron-ultra-550b","latencyMs":674,"name":"Nemotron 3 Ultra 550B (Nvidia)"},{"capabilities":["text","json","reasoning"],"description":"Nemotron 3 Super 120B (Nvidia) — hosted on Nvidia NIM. Free during beta.","id":"nvidia/nemotron-super-120b","latencyMs":766,"name":"Nemotron 3 Super 120B (Nvidia)"},{"capabilities":["text","json","reasoning"],"description":"Nemotron 3 Nano 30B (Nvidia) — hosted on Nvidia NIM. Free during beta.","id":"nvidia/nemotron-nano-30b","latencyMs":1082,"name":"Nemotron 3 Nano 30B (Nvidia)"},{"capabilities":["text","json","reasoning","code"],"description":"DeepSeek V4 Flash (Nvidia) — hosted on Nvidia NIM. Free during beta.","id":"nvidia/deepseek-v4-flash","latencyMs":13000,"name":"DeepSeek V4 Flash (Nvidia)"}],"method":"POST","name":"Multi-Model Chat Completions","paidModels":[{"capabilities":["text","json","code"],"description":"Code generation and software-engineering alias with replaceable provider routing.","id":"clervo/code","latencyMs":2600,"name":"Clervo Code","price":{"amount":0.015,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.4-mini","latencyMs":3000,"name":"GPT 5.4 Mini (QuickAI label)","price":{"amount":0.005,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.4","latencyMs":3000,"name":"GPT 5.4 (QuickAI label)","price":{"amount":0.018,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.5","latencyMs":3000,"name":"GPT 5.5 (QuickAI label)","price":{"amount":0.035,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.6-luna","latencyMs":3000,"name":"GPT 5.6 Luna (QuickAI label)","price":{"amount":0.007,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.6-terra","latencyMs":3000,"name":"GPT 5.6 Terra (QuickAI label)","price":{"amount":0.018,"currency":"USD","unit":"request"}},{"capabilities":["text","json"],"description":"Provider-reported model label observed in a bounded authenticated QuickAI test.","id":"quickai/gpt-5.6-sol","latencyMs":3000,"name":"GPT 5.6 Sol (QuickAI label)","price":{"amount":0.035,"currency":"USD","unit":"request"}},{"capabilities":["text","json","fast"],"description":"Fast affordable Claude model. 10% below BlockRun pricing.","id":"tongkhokr/claude-haiku-4.5","latencyMs":1017,"name":"Claude Haiku 4.5","price":{"amount":0.002,"currency":"USD","unit":"request"}},{"capabilities":["text","json","reasoning","code"],"description":"Balanced Claude model. 10% below BlockRun pricing.","id":"tongkhokr/claude-sonnet-5","latencyMs":2600,"name":"Claude Sonnet 5","price":{"amount":0.015,"currency":"USD","unit":"request"}},{"capabilities":["text","json","reasoning","code"],"description":"Most powerful Claude model. 10% below BlockRun pricing.","id":"tongkhokr/claude-opus-5","latencyMs":2700,"name":"Claude Opus 5","price":{"amount":0.084,"currency":"USD","unit":"request"}},{"capabilities":["text","json","reasoning","code"],"description":"Balanced Claude model. Great for coding and reasoning.","id":"tongkhokr/claude-sonnet-4.6","latencyMs":2500,"name":"Claude Sonnet 4.6","price":{"amount":0.015,"currency":"USD","unit":"request"}},{"capabilities":["text","json","reasoning","code"],"description":"Powerful Claude for complex reasoning. 1M context.","id":"tongkhokr/claude-opus-4.7","latencyMs":2800,"name":"Claude Opus 4.7","price":{"amount":0.084,"currency":"USD","unit":"request"}},{"capabilities":["text","json","reasoning","code"],"description":"Anthropic Claude Opus 4.8 via TongKhokr gateway. 10% below BlockRun pricing.","id":"tongkhokr/claude-opus-4.8","latencyMs":2000,"name":"Claude Opus 4.8","price":{"amount":0.084,"currency":"USD","unit":"request"}}]}],"version":1,"x402Features":["exact-payment","per-request-pricing","idempotency","receipts","operation-tracking"],"x402Version":2}