Skip to content

Same-model provider benchmark

CoreWeave vs DeepInfra: LLM provider comparison

Compare CoreWeave and DeepInfra on 16 exact shared text models. ProviderBench keeps speed, price, and catalog coverage separate so naturally faster model catalogs cannot distort the result.

CoreWeave

20 indexed models

Headquarters
United States
Server regions
United States
Model types
20 text

DeepInfra

85 indexed models

Headquarters
United States
Server regions
N/a
Model types
65 text, 15 embeddings, 5 speech

At a glance

Metric winners

There is no overall score. Each winner answers one specific question using only directly comparable data.

Fastest on shared models

1.58× typical advantage

16 exact models with complete recent speed data

Lowest token cost

$0.7713 / 1M

16 exact models using a 1K-input/500-output mix

Most models available

85 models

Complete catalog coverage across all indexed modalities

Shared-model benchmark summary

MetricCoreWeave(0)DeepInfra(0)
SpeedCoreWeave9.51 sDeepInfra13.84 s
TTFTCoreWeave0.35 sDeepInfra0.70 s
TPSCoreWeave54.5 tok/sDeepInfra37.5 tok/s
UptimeCoreWeave100.00%DeepInfra99.63%
BlendedCoreWeave$1.0973 / 1MDeepInfra$0.7713 / 1M
Green value Better comparable resultRed value Worse comparable result

Visual comparison

Price and performance charts

CoreWeaveDeepInfra
500-token response by shared model

Estimated seconds using recent median response-start and output-speed data. Lower is better.

CoreWeave has the lower typical same-model response ratio across 16 measured models.

Blended token price by shared model

USD per 1 million tokens using a 1,000-input/500-output mix. Lower is better.

DeepInfra has the lower typical price ratio across 16 priced shared models.

Shared text models

16 exact models · newest first

ModelCoreWeave(0)DeepInfra(0)
GLM 5.2Winner · DeepInfra
CoreWeave
Speed— Worst comparable value
20.46 s
TTFT— Worst comparable value
1.94 s
TPS— Worst comparable value
27.0 tok/s
Uptime— Best comparable value
99.96%
Context
262.1K
Route
coreweave/fp4
Blended— Worst comparable value
$2.3933 / 1M
DeepInfra
Speed— Best comparable value
17.86 s
TTFT— Best comparable value
1.73 s
TPS— Best comparable value
31.0 tok/s
Uptime— Worst comparable value
98.33%
Context
1M
Route
deepinfra/fp4
Blended— Best comparable value
$1.62 / 1M
Kimi K2.7 CodeWinner · CoreWeave
CoreWeave
Speed— Best comparable value
7.35 s
TTFT— Best comparable value
0.68 s
TPS— Best comparable value
75.0 tok/s
Uptime— Best comparable value
100.00%
Context
262.1K
Route
coreweave/int4
Blended— Worst comparable value
$1.96 / 1M
DeepInfra
Speed— Worst comparable value
11.21 s
TTFT— Worst comparable value
0.79 s
TPS— Worst comparable value
48.0 tok/s
Uptime— Worst comparable value
98.85%
Context
262.1K
Route
deepinfra/fp4
Blended— Best comparable value
$1.66 / 1M
Qwen3.6 27BWinner · DeepInfra
CoreWeave
Speed— Worst comparable value
18.18 s
TTFT— Worst comparable value
0.33 s
TPS— Worst comparable value
28.0 tok/s
Uptime— Best comparable value
100.00%
Context
262.1K
Route
coreweave/fp8
Blended— Worst comparable value
$1.6 / 1M
DeepInfra
Speed— Best comparable value
13.44 s
TTFT— Best comparable value
0.29 s
TPS— Best comparable value
38.0 tok/s
Uptime— Worst comparable value
98.75%
Context
262.1K
Route
deepinfra/fp8
Blended— Best comparable value
$1.28 / 1M
DeepSeek V4 ProWinner · DeepInfra
CoreWeave
Speed— Worst comparable value
64.00 s
TTFT— Worst comparable value
1.50 s
TPS— Worst comparable value
8.0 tok/s
Uptime— Worst comparable value
98.59%
Context
1M
Route
coreweave/fp8
Blended— Worst comparable value
$2.32 / 1M
DeepInfra
Speed— Best comparable value
10.90 s
TTFT— Best comparable value
0.69 s
TPS— Best comparable value
49.0 tok/s
Uptime— Best comparable value
99.63%
Context
1M
Route
deepinfra/fp4
Blended— Best comparable value
$1.7333 / 1M
DeepSeek V4 FlashWinner · DeepInfra
CoreWeave
Speed— Best comparable value
17.27 s
TTFT— Best comparable value
0.60 s
TPS— Best comparable value
30.0 tok/s
Uptime— Best comparable value
99.85%
Context
1M
Route
coreweave/fp8
Blended— Worst comparable value
$0.1867 / 1M
DeepInfra
Speed— Worst comparable value
21.14 s
TTFT— Worst comparable value
1.14 s
TPS— Worst comparable value
25.0 tok/s
Uptime— Worst comparable value
98.83%
Context
1M
Route
deepinfra/fp4
Blended— Best comparable value
$0.12 / 1M
Kimi K2.6Winner · CoreWeave
CoreWeave
Speed— Best comparable value
3.30 s
TTFT— Best comparable value
0.34 s
TPS— Best comparable value
169.0 tok/s
Uptime— Worst comparable value
99.89%
Context
262.1K
Route
coreweave/fp4
Blended— Worst comparable value
$1.9667 / 1M
DeepInfra
Speed— Worst comparable value
14.24 s
TTFT— Worst comparable value
0.73 s
TPS— Worst comparable value
37.0 tok/s
Uptime— Best comparable value
100.00%
Context
262.1K
Route
deepinfra/fp4
Blended— Best comparable value
$1.6667 / 1M
GLM 5.1Winner · CoreWeave
CoreWeave
Speed— Best comparable value
4.38 s
TTFT— Best comparable value
0.50 s
TPS— Best comparable value
129.0 tok/s
Uptime— Best comparable value
100.00%
Context
202.8K
Route
coreweave/fp8
Blended— Worst comparable value
$2.4 / 1M
DeepInfra
Speed— Worst comparable value
12.79 s
TTFT— Worst comparable value
0.89 s
TPS— Worst comparable value
42.0 tok/s
Uptime— Worst comparable value
99.68%
Context
202.8K
Route
deepinfra/fp4
Blended— Best comparable value
$1.8667 / 1M
Gemma 4 31BWinner · CoreWeave
CoreWeave
Speed— Best comparable value
30.82 s
TTFT— Worst comparable value
1.41 s
TPS— Best comparable value
17.0 tok/s
Uptime— Worst comparable value
77.67%
Context
262.1K
Route
coreweave/bf16
Blended— Best comparable value
$0.1967 / 1M
DeepInfra
Speed— Worst comparable value
42.50 s
TTFT— Best comparable value
0.83 s
TPS— Worst comparable value
12.0 tok/s
Uptime— Best comparable value
97.49%
Context
262.1K
Route
deepinfra/turbo
Blended— Worst comparable value
$0.2033 / 1M
Qwen3.5-35B-A3BWinner · CoreWeave
CoreWeave
Speed— Best comparable value
4.86 s
TTFT— Worst comparable value
0.35 s
TPS— Best comparable value
111.0 tok/s
Uptime
100.00%
Context
262.1K
Route
coreweave/fp8
Blended— Worst comparable value
$0.5833 / 1M
DeepInfra
Speed— Worst comparable value
7.98 s
TTFT— Best comparable value
0.29 s
TPS— Worst comparable value
65.0 tok/s
Uptime
100.00%
Context
262.1K
Route
deepinfra/fp8
Blended— Best comparable value
$0.4267 / 1M
DeepSeek V3.1Winner · CoreWeave
CoreWeave
Speed— Best comparable value
9.97 s
TTFT— Best comparable value
0.35 s
TPS— Best comparable value
52.0 tok/s
Uptime— Best comparable value
100.00%
Context
161K
Route
coreweave/fp8
Blended— Worst comparable value
$0.9167 / 1M
DeepInfra
Speed— Worst comparable value
30.16 s
TTFT— Worst comparable value
0.75 s
TPS— Worst comparable value
17.0 tok/s
Uptime— Worst comparable value
99.96%
Context
163.8K
Route
deepinfra/fp4
Blended— Best comparable value
$0.4833 / 1M
gpt-oss-120bWinner · CoreWeave
CoreWeave
Speed— Best comparable value
5.92 s
TTFT— Best comparable value
0.36 s
TPS— Best comparable value
90.0 tok/s
Uptime— Worst comparable value
99.68%
Context
131.1K
Route
coreweave/fp4
Blended— Best comparable value
$0.0733 / 1M
DeepInfra
Speed— Worst comparable value
10.39 s
TTFT— Worst comparable value
0.39 s
TPS— Worst comparable value
50.0 tok/s
Uptime— Best comparable value
99.97%
Context
131.1K
Route
deepinfra/bf16
Blended— Worst comparable value
$0.0813 / 1M
gpt-oss-20bWinner · CoreWeave
CoreWeave
Speed— Best comparable value
4.18 s
TTFT— Best comparable value
0.28 s
TPS— Best comparable value
128.0 tok/s
Uptime— Worst comparable value
87.61%
Context
131.1K
Route
coreweave/fp4
Blended— Best comparable value
$0.0633 / 1M
DeepInfra
Speed— Worst comparable value
4.86 s
TTFT— Worst comparable value
0.36 s
TPS— Worst comparable value
111.0 tok/s
Uptime— Best comparable value
99.98%
Context
131.1K
Route
deepinfra/bf16
Blended— Worst comparable value
$0.0667 / 1M
Qwen3 Coder 480B A35BWinner · DeepInfra
CoreWeave
Speed— Best comparable value
9.06 s
TTFT— Best comparable value
0.29 s
TPS— Best comparable value
57.0 tok/s
Uptime
N/a
Context
262.1K
Route
coreweave/bf16
Blended— Worst comparable value
$1.1667 / 1M
DeepInfra
Speed— Worst comparable value
12.74 s
TTFT— Worst comparable value
0.54 s
TPS— Worst comparable value
41.0 tok/s
Uptime
100.00%
Context
262.1K
Route
deepinfra/turbo
Blended— Best comparable value
$0.5333 / 1M
Llama 3.3 70B InstructWinner · DeepInfra
CoreWeave
Speed— Best comparable value
18.01 s
TTFT— Best comparable value
0.15 s
TPS— Best comparable value
28.0 tok/s
Uptime— Best comparable value
100.00%
Context
128K
Route
coreweave/fp16
Blended— Worst comparable value
$0.71 / 1M
DeepInfra
Speed— Worst comparable value
63.18 s
TTFT— Worst comparable value
0.68 s
TPS— Worst comparable value
8.0 tok/s
Uptime— Worst comparable value
97.29%
Context
131.1K
Route
deepinfra/turbo
Blended— Best comparable value
$0.1733 / 1M
Llama 3.1 70B InstructWinner · CoreWeave
CoreWeave
Speed— Best comparable value
12.50 s
TTFT— Worst comparable value
0.31 s
TPS— Best comparable value
41.0 tok/s
Uptime— Best comparable value
100.00%
Context
128K
Route
coreweave/bf16
Blended— Worst comparable value
$0.8 / 1M
DeepInfra
Speed— Worst comparable value
25.29 s
TTFT— Best comparable value
0.29 s
TPS— Worst comparable value
20.0 tok/s
Uptime— Worst comparable value
99.73%
Context
131.1K
Route
deepinfra/turbo
Blended— Best comparable value
$0.4 / 1M
Llama 3.1 8B InstructWinner · CoreWeave
CoreWeave
Speed— Best comparable value
4.63 s
TTFT— Best comparable value
0.17 s
TPS— Best comparable value
112.0 tok/s
Uptime— Best comparable value
100.00%
Context
128K
Route
coreweave/bf16
Blended— Worst comparable value
$0.22 / 1M
DeepInfra
Speed— Worst comparable value
39.18 s
TTFT— Worst comparable value
0.71 s
TPS— Worst comparable value
13.0 tok/s
Uptime— Worst comparable value
99.44%
Context
131.1K
Route
deepinfra/fp8
Blended— Best comparable value
$0.0267 / 1M

A per-model winner combines blended price and estimated 500-token response time with equal proportional weight. Ties and rows missing either measurement receive no badge. Comparison data calculated . Values use one deterministic route per provider and model; missing measurements remain visible as N/a.

CoreWeave vs DeepInfra analysis

How CoreWeave and DeepInfra compare for AI inference

CoreWeave and DeepInfra share 16 indexed text models, including GLM 5.2, Kimi K2.7 Code, Qwen3.6 27B, DeepSeek V4 Pro, DeepSeek V4 Flash. CoreWeave has the stronger typical response-time result on the directly measured set.

Same-model speed evidence

16 shared models currently have complete response-start and output-speed measurements on both providers. The speed comparison uses per-model ratios before taking the median, so naturally faster model catalogs do not improve the result.

Token pricing on one workload

16 shared models have complete input and output prices on both providers. Prices use the same 1,000-input/500-output-token mix and are normalized to one million tokens for readability.

Catalog and deployment differences

CoreWeave has 20 indexed models and lists 1 published server region; DeepInfra has 85 models and lists no regions. Verify data residency, privacy terms, limits, and production latency directly before choosing.