OpenAI compatible API · Attested · Public status
Novita AI performance
Measured TTFT, TTFB, effective throughput, uptime, and sampled model routes for Novita AI.
Onebase URL to migrate
100sof models and routes
0prompt or output logs. Always.
novita
57 samples
Continuously sampled provider performance. TrustedRouter reports unsupported route and probe-configuration rows separately from provider downtime. Prompt and output content is not stored.
| p50 TTFT | 2141 ms |
|---|---|
| p95 TTFT | 15311 ms |
| p50 TTFB | 2581 ms |
| Effective throughput | 34 tok/s n=18 |
| Uptime | 92.98% |
Measured model routes
| Model | p50 TTFT | p50 TTFB | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|---|
| zai-org/autoglm-phone-9b-multilingual | 673 ms | 673 ms | — | 100.00% | — | 2 |
| meta-llama/llama-3.1-8b-instruct | 807 ms | 806 ms | — | 100.00% | — | 2 |
| qwen/qwen3-vl-30b-a3b-instruct | 892 ms | 892 ms | — | 100.00% | — | 2 |
| deepseek/deepseek-r1-distill-llama-70b | 1093 ms | 1093 ms | — | 100.00% | — | 1 |
| google/gemma-3-27b-it | 1120 ms | 1120 ms | — | 100.00% | — | 1 |
| moonshotai/kimi-k2.5 | 1243 ms | 1243 ms | — | 100.00% | — | 1 |
| google/gemma-4-26b-a4b-it | 1347 ms | 1347 ms | — | 100.00% | — | 2 |
| qwen/qwen3-235b-a22b-thinking-2507 | 1466 ms | 1466 ms | — | 100.00% | — | 1 |
| meta-llama/llama-4-maverick-17b-128e-instruct-fp8 | 1571 ms | 1571 ms | — | 100.00% | — | 1 |
| qwen/qwen3-235b-a22b-fp8 | 1658 ms | 1658 ms | — | 100.00% | — | 2 |
| zai-org/glm-4.7 | 1713 ms | 1713 ms | — | 100.00% | — | 1 |
| qwen/qwen3-coder-30b-a3b-instruct | 1733 ms | 1733 ms | — | 100.00% | — | 1 |
| qwen/qwen3-235b-a22b-instruct-2507 | 1786 ms | 1786 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-27b | 1882 ms | 1881 ms | — | 100.00% | — | 1 |
| openai/gpt-oss-20b | 1913 ms | 1912 ms | — | 100.00% | — | 2 |
| qwen/qwen3.5-122b-a10b | 2018 ms | 2017 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v3-turbo | 2024 ms | 2024 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-ocr | 2029 ms | 2029 ms | — | 100.00% | — | 1 |
| nvidia/nemotron-3-nano-30b-a3b | 2124 ms | 2124 ms | — | 100.00% | — | 1 |
| qwen/qwen3-omni-30b-a3b-thinking | 2129 ms | 2129 ms | — | 100.00% | — | 1 |
| inclusionai/ling-2.6-1t | 2141 ms | 2140 ms | — | 100.00% | — | 1 |
| qwen/qwen3.7-max | 2379 ms | 2379 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-35b-a3b | 2581 ms | 2581 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v3-0324 | 2606 ms | — | — | 100.00% | — | 4 |
| deepseek/deepseek-v3.1-terminus | 2783 ms | 2782 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v3.2 | 2836 ms | 2836 ms | — | 100.00% | — | 1 |
| zai-org/glm-4.5-air | 2990 ms | 2989 ms | — | 100.00% | — | 1 |
| openai/gpt-oss-120b | 3146 ms | 3146 ms | 28 tok/s n=2 | 100.00% | — | 1 |
| moonshotai/kimi-k2-instruct | 3453 ms | 3453 ms | — | 100.00% | — | 1 |
| zai-org/glm-4.6 | 3467 ms | 3467 ms | — | 100.00% | — | 1 |
| minimaxai/minimax-m1-80k | 3494 ms | 3494 ms | — | 100.00% | — | 1 |
| xiaomimimo/mimo-v2.5-pro | 3510 ms | 3510 ms | — | 100.00% | — | 1 |
| zai-org/glm-5 | 3563 ms | 3562 ms | — | 100.00% | — | 1 |
| zai-org/glm-4.6v | 3740 ms | 3740 ms | — | 100.00% | — | 1 |
| moonshotai/kimi-k2.7-code | 3940 ms | 3940 ms | 25 tok/s n=2 | 100.00% | — | 1 |
| deepseek/deepseek-r1-0528 | 3972 ms | 3972 ms | — | 100.00% | — | 1 |
| moonshotai/kimi-k3 | 4000 ms | 4000 ms | 24 tok/s n=2 | 100.00% | — | 2 |
| qwen/qwen3.5-397b-a17b | 4010 ms | 4010 ms | — | 100.00% | — | 2 |
| qwen/qwen-2.5-72b-instruct | 7456 ms | 7456 ms | — | 100.00% | — | 1 |
| qwen/qwen-mt-plus | 10959 ms | 820 ms | — | 100.00% | — | 3 |
| baidu/cobuddy | — | — | — | 0.00% | — | 1 |
| deepseek/deepseek-v4-flash | — | — | 39 tok/s n=2 | — | — | 0 |
| deepseek/deepseek-v4-flash-0731 | — | — | 34 tok/s n=1 | — | — | 0 |
| deepseek/deepseek-v4-pro | — | — | 58 tok/s n=1 | — | — | 0 |
| google/gemma-3-12b-it | — | — | — | 0.00% | — | 1 |
| google/gemma-4-31b-it | — | — | 59 tok/s n=1 | — | — | 0 |
| inclusionai/ling-2.6-flash | — | — | — | 0.00% | — | 1 |
| inclusionai/ling-3.0-flash | — | — | 69 tok/s n=2 | — | — | 0 |
| mindai/macaron-v1-tall | — | — | — | 0.00% | — | 1 |
| mindai/macaron-v1-venti | — | — | 12 tok/s n=1 | — | — | 0 |
| minimax/minimax-m3 | — | — | 83 tok/s n=1 | — | — | 0 |
| moonshotai/kimi-k2.6 | — | — | 23 tok/s n=1 | — | — | 0 |
| tencent/hy3 | — | — | 76 tok/s n=1 | — | — | 0 |
| z-ai/glm-5.2 | — | — | 35 tok/s n=1 | — | — | 0 |