OpenAI compatible API · Attested · Public status
Lightning AI performance
Measured TTFT, TTFB, effective throughput, uptime, and sampled model routes for Lightning AI.
Onebase URL to migrate
100sof models and routes
0prompt or output logs. Always.
lightning
47 samples
Continuously sampled provider performance. TrustedRouter reports unsupported route and probe-configuration rows separately from provider downtime. Prompt and output content is not stored.
| p50 TTFT | 2587 ms |
|---|---|
| p95 TTFT | 6080 ms |
| p50 TTFB | 2587 ms |
| Effective throughput | 46 tok/s n=5 |
| Uptime | 100.00% |
Measured model routes
| Model | p50 TTFT | p50 TTFB | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|---|
| google/gemma-4-31b-it | 1047 ms | 1047 ms | 72 tok/s n=1 | 100.00% | — | 1 |
| openai/gpt-3.5-turbo | 1301 ms | 1301 ms | — | 100.00% | — | 3 |
| openai/gpt-4o | 1556 ms | 1556 ms | — | 100.00% | — | 7 |
| openai/gpt-4.1 | 1870 ms | 1870 ms | — | 100.00% | — | 5 |
| google/gemini-2.5-pro | 2438 ms | 2438 ms | — | 100.00% | — | 2 |
| google/gemini-3.5-flash | 2530 ms | 2529 ms | 45 tok/s n=2 | 100.00% | — | 5 |
| google/gemini-3.1-flash-lite-preview | 2587 ms | 2587 ms | — | 100.00% | — | 3 |
| google/gemini-3-flash-preview | 2602 ms | 2602 ms | — | 100.00% | — | 4 |
| openai/gpt-4-turbo | 2733 ms | 2732 ms | — | 100.00% | — | 4 |
| google/gemini-2.5-flash | 3144 ms | 3143 ms | — | 100.00% | — | 7 |
| openai/gpt-4 | 3814 ms | 3814 ms | — | 100.00% | — | 3 |
| google/gemini-3.1-pro-preview | 4341 ms | 4341 ms | 46 tok/s n=2 | 100.00% | — | 3 |