LLMgateway
Kimi AI Gateway Benchmark

Request Latency

100% success
Cold E2E
1867ms
Median
Warm TTFT
1823ms
Median
Tokens/sec
34
Median
DNS
2.0ms
Median
TCP
1.6ms
Median
TLS
5.7ms
Median

Cold Connection Breakdown

Where a fresh request's time goes: DNS lookup, TCP connect, TLS handshake, then time to first response byte, then first byte to first streamed token.

DNS2.0ms
TCP1.6ms
TLS5.7ms
To First Byte159.4ms
First Byte → Token1685.1ms

Performance Over Time

Iteration Distribution

Cold E2E

Warm TTFT

Tokens/sec

DNS

TCP

TLS

Become a partner

Want your logo featured across our benchmarks? Become a ComputeSDK benchmark partner.

LatitudeGoogle Cloud Run
PartnersLatitude