OpenAI compatible API · Attested · Public status
Alibaba Cloud Model Studio performance
Measured TTFT, TTFB, effective throughput, uptime, and sampled model routes for Alibaba Cloud Model Studio.
Onebase URL to migrate
100sof models and routes
0prompt or output logs. Always.
alibaba
41 samples
Continuously sampled provider performance. TrustedRouter reports unsupported route and probe-configuration rows separately from provider downtime. Prompt and output content is not stored.
| p50 TTFT | 2197 ms |
|---|---|
| p95 TTFT | 4123 ms |
| p50 TTFB | 2484 ms |
| Effective throughput | 52 tok/s n=8 |
| Uptime | 95.12% |
Measured model routes
| Model | p50 TTFT | p50 TTFB | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|---|
| qwen/qwen3-vl-30b-a3b-instruct | 1139 ms | 1139 ms | — | 100.00% | — | 1 |
| qwen/qwen-flash-2025-07-28 | 1326 ms | 1326 ms | — | 100.00% | — | 2 |
| qwen/qwen3.7-flash-2026-07-15 | 1387 ms | 1386 ms | 123 tok/s n=1 | 100.00% | — | 1 |
| qwen/qwen3-30b-a3b-instruct-2507 | 1446 ms | 1446 ms | — | 100.00% | — | 2 |
| qwen/qwen3-vl-flash | 1452 ms | 1452 ms | — | 100.00% | — | 1 |
| qwen/qwen3-max | 1519 ms | 1519 ms | — | 100.00% | — | 2 |
| qwen/qwen-mt-turbo | 1803 ms | 1803 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-35b-a3b | 1815 ms | 1815 ms | — | 100.00% | — | 1 |
| qwen/qwen3.6-flash | 1959 ms | 1959 ms | — | 100.00% | — | 2 |
| qwen/qwen-vl-ocr | 2022 ms | 2021 ms | — | 100.00% | — | 1 |
| qwen/qwen-mt-flash | 2087 ms | 2087 ms | — | 100.00% | — | 1 |
| qwen/qwen3-vl-8b-thinking | 2159 ms | 2159 ms | — | 100.00% | — | 2 |
| qwen/qwen3.7-max-2026-06-08 | 2162 ms | 2162 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-27b | 2190 ms | 2190 ms | — | 100.00% | — | 1 |
| qwen/qwen3-max-preview | 2197 ms | 2197 ms | — | 100.00% | — | 1 |
| qwen/qwen3-vl-32b-thinking | 2430 ms | 2429 ms | — | 100.00% | — | 2 |
| qwen/qwen3-vl-235b-a22b-thinking | 2454 ms | 2454 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-plus | 2484 ms | 2484 ms | — | 100.00% | — | 1 |
| qwen/qwen3-vl-plus-2025-09-23 | 2595 ms | 2595 ms | — | 100.00% | — | 1 |
| qwen/qwen-plus-2025-12-01 | 2600 ms | 2600 ms | — | 100.00% | — | 1 |
| qwen/qwen3-next-80b-a3b-thinking | 2640 ms | 2640 ms | — | 100.00% | — | 1 |
| moonshotai/kimi-k2.5 | 2959 ms | 2959 ms | — | 100.00% | — | 1 |
| qwen/qwen3-coder-plus-2025-07-22 | 3041 ms | 3041 ms | — | 100.00% | — | 1 |
| qwen/qwen3-235b-a22b-instruct-2507 | 3213 ms | 3212 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v4-flash | 3404 ms | 3404 ms | 52 tok/s n=2 | 100.00% | — | 1 |
| moonshotai/kimi-k2.7-code | 3421 ms | 3421 ms | — | 100.00% | — | 1 |
| qwen/qwen3.7-max | 3445 ms | 3444 ms | — | 100.00% | — | 1 |
| qwen/qwen3-vl-flash-2025-10-15 | 3494 ms | 3494 ms | — | 100.00% | — | 1 |
| qwen/qwen-plus-2025-09-11 | 3520 ms | 3520 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-plus-2026-02-15 | 3561 ms | 3560 ms | — | 100.00% | — | 2 |
| qwen/qwen3.7-plus | 3597 ms | 3596 ms | — | 100.00% | — | 1 |
| qwen/qwen3-coder-flash | 3776 ms | 3775 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v4-pro | — | — | 32 tok/s n=1 | — | — | 0 |
| qwen/qwen-plus-character | — | — | 33 tok/s n=1 | — | — | 0 |
| qwen/qwen3.5-397b-a17b | — | — | — | 0.00% | — | 2 |
| qwen/qwen3.7-flash | — | — | 121 tok/s n=2 | — | — | 0 |
| z-ai/glm-5.2 | — | — | 31 tok/s n=1 | — | — | 0 |