Skip to content

Serverless GPU Benchmarks

Measured runs of a pinned workload per provider — time to result, serverless overhead, sample counts, and observed hardware. No synthetic scores.

Results

9 published results · filtered

Runpod
parler-tts-mini v1.1.0
Serverless · eu
scale from zero
primary · startup restored
flashboot (stable)
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
9.1 s
Serverless overhead (median)
3.3 s
Published
19 Jul 2026
Modal
parler-tts-mini v1.1.0
Serverless · eu
scale from zero
primary · startup unknown
cpu memory snapshot (stable)
l4
Observed l4 · confirmed
Samples
3/3
Time to result (median)
26.8 s
Serverless overhead (median)
9.9 s
Published
20 Jul 2026
Runpod
parler-tts-mini v1.1.0
Serverless · eu
scale from zero
primary · startup fresh
flashboot (stable)
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
31.0 s
Serverless overhead (median)
24.1 s
Published
20 Jul 2026
Modal
parler-tts-mini v1.0.0
Serverless · eu
cold observed
unclassified · startup unknown
l4
Observed l4 · confirmed
Samples
7/7
Time to result (median)
48.5 s
Serverless overhead (median)
32.1 s
Published
18 Jul 2026
Google Cloud
parler-tts-mini v1.1.0
Cloud Run GPU Services · europe-west4
scale from zero
primary · startup unknown
startup cpu boost (stable)
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
52.3 s
Serverless overhead (median)
32.7 s
Published
20 Jul 2026
Google Cloud
parler-tts-mini v1.0.0
Cloud Run GPU Services · europe-west4
cold observed
unclassified · startup unknown
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
55.7 s
Serverless overhead (median)
37.3 s
Published
18 Jul 2026
Runpod
parler-tts-mini v1.1.0
Serverless · eu
scale from zero
primary · startup fresh
flashboot (stable)
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
113.1 s
Serverless overhead (median)
106.4 s
Published
19 Jul 2026
Runpod
parler-tts-mini v1.0.0
Serverless · eu
cold observed
unclassified · startup unknown
l4
Observed l4 · confirmed
Samples
2/2
Time to result (median)
301.5 s
Serverless overhead (median)
294.7 s
Published
18 Jul 2026
Runpod
parler-tts-mini v1.1.0
Serverless · eu
scale from zero
primary · startup unknown
flashboot (stable)
l4
Observed l4 · confirmed
Samples
1/1
Time to result (median)
392.1 s
Serverless overhead (median)
385.4 s
Published
19 Jul 2026

How to read these numbers

Each row summarizes accepted runs for one immutable provider target, scenario, measurement origin, and observed startup mode. Matching samples accumulate across campaigns through the current publication pointer: with multiple runs we show the median, while a one-sample row is that single observation. The current workload is a pinned Parler-TTS Mini text-to-speech request.

  • A cold observed scenario is configured to observe scale-from-zero behavior and retains container-session evidence. It is not a provider guarantee that every invocation was cold.
  • Time to result is measured by the Cloudflare runner from the beginning of an invocation, before provider submission, until the complete result has been retrieved and validated. Current async profiles poll once per second, so nominal observation lag is up to roughly one second. Older campaigns retain their runner version and may use an earlier profile.
  • Serverless overhead is time to result minus the workload's own compute phases (preprocessing, inference, postprocessing), computed per run: the time cost of the platform itself — startup or snapshot restore, queueing, and result retrieval. With a restored startup mode, application initialization happened before the request, so it is not part of the overhead.
  • Requests originate from a Cloudflare Durable Object constrained to the EU with a best-effort Western Europe placement hint, not a fixed physical host.
  • Compare rows only when the workload version, scenario, measurement origin, and startup mode match.

Full methodology, filters, and API access →