Qwen 2.5 72B Instruct
Alibaba · text · Open-source · GPU Tier A
liveContext 128K
Requests 30d+14.2%
897K
Tokens 30d+18.4%
2.2B
Revenue 30d+20.2%
$786.6
Gross margin+1.2%
48%
Revenue − node payouts
Active users+9.4%
209
Active nodes+3.4%
1,133
Input $/1M
$0.3
Output $/1M
$0.5
p50 latency
420ms
p95 latency
1.3s
Error rate
2.9%
Usage over time (30d)
Pricing simulator
Elasticity-based what-if · Qwen 2.5 72B Instruct
Projected revenue 30d
$786.6
0.0%
Projected requests
897k
0.0%
Projected margin
58%
Model assumes elasticity of -1.2 on total price. Replace with regression-derived elasticity per model when telemetry is wired.
p95 latency over time (30d)
Price comparison
$/1M tokens
FAR AI
Input
$0.3
Output
$0.5
Together AI
In: $1.2 · Out: $1.2
FAR saves
−67%
Fireworks AI
In: $0.9 · Out: $0.9
FAR saves
−56%
Revenue economics
How this model generates revenue
Developer pays
$0.3 in + $0.5 out per 1M tokens
Node operator earns
44% of revenue distributed as payout · Tier A
FAR AI gross margin
48%