# Fastest AI API from Europe (Germany)
Updated July 23, 2026. Independent, provider-neutral edge latency (TTFB) and uptime by provider, measured from Europe (Germany), updated automatically.

As of July 23, 2026, measured from Europe (Germany), the fastest AI inference API by edge latency (time-to-first-byte) is **nscale** at 97 ms p50 (n=50).

## Edge latency (time-to-first-byte)
| # | Provider | p50 | p95 | Uptime | Samples |
| --- | --- | --- | --- | --- | --- |
| 1 | nscale | 97 ms | 196 ms | 100% | 50 |
| 2 | fireworks | 98 ms | 199 ms | 100% | 85 |
| 3 | google | 98 ms | 197 ms | 100% | 85 |
| 4 | openrouter | 98 ms | 109 ms | 100% | 85 |
| 5 | nebius | 99 ms | 298 ms | 100% | 50 |
| 6 | mistral | 100 ms | 202 ms | 100% | 85 |
| 7 | reka | 100 ms | 298 ms | 100% | 50 |
| 8 | aleph-alpha | 102 ms | 301 ms | 100% | 50 |
| 9 | meta-llama | 102 ms | 307 ms | 100% | 50 |
| 10 | baichuan | 181 ms | 633 ms | 100% | 50 |
| 11 | baseten | 196 ms | 289 ms | 100% | 50 |
| 12 | cerebras | 197 ms | 392 ms | 100% | 85 |
| 13 | inference-net | 198 ms | 900 ms | 100% | 50 |
| 14 | cohere | 198 ms | 304 ms | 100% | 85 |
| 15 | anthropic | 199 ms | 402 ms | 100% | 85 |
| 16 | friendli | 200 ms | 325 ms | 100% | 50 |
| 17 | replicate | 201 ms | 498 ms | 100% | 50 |
| 18 | writer | 226 ms | 402 ms | 100% | 50 |
| 19 | openai | 241 ms | 464 ms | 100% | 85 |
| 20 | ernie | 280 ms | 284 ms | 100% | 50 |
| 21 | sarvam | 292 ms | 308 ms | 100% | 50 |
| 22 | perplexity | 295 ms | 405 ms | 100% | 50 |
| 23 | siliconflow | 295 ms | 303 ms | 100% | 50 |
| 24 | groq | 296 ms | 401 ms | 100% | 85 |
| 25 | together | 296 ms | 565 ms | 100% | 85 |
| 26 | xai | 298 ms | 804 ms | 100% | 85 |
| 27 | kimi | 298 ms | 401 ms | 100% | 55 |
| 28 | novita | 298 ms | 501 ms | 100% | 50 |
| 29 | deepseek | 298 ms | 406 ms | 99% | 85 |
| 30 | iflytek | 300 ms | 761 ms | 100% | 50 |
| 31 | minimax | 302 ms | 496 ms | 100% | 55 |
| 32 | hyperbolic | 303 ms | 798 ms | 100% | 50 |
| 33 | targon | 303 ms | 362 ms | 100% | 50 |
| 34 | yi-01ai | 319 ms | 769 ms | 100% | 50 |
| 35 | doubao | 362 ms | 868 ms | 100% | 50 |
| 36 | ai21 | 394 ms | 502 ms | 100% | 50 |
| 37 | sambanova | 396 ms | 503 ms | 100% | 50 |
| 38 | qwen | 397 ms | 500 ms | 100% | 55 |
| 39 | sensenova | 400 ms | 1511 ms | 100% | 50 |
| 40 | stepfun | 438 ms | 1525 ms | 100% | 50 |
| 41 | deepinfra | 561 ms | 795 ms | 100% | 50 |
| 42 | upstage | 584 ms | 855 ms | 100% | 50 |
| 43 | featherless | 727 ms | 1724 ms | 100% | 50 |
| 44 | glm | 801 ms | 1305 ms | 100% | 55 |
| 45 | hunyuan | 1547 ms | 2865 ms | 100% | 50 |


Source: https://llmlatency.dev/region/eu-hetzner