Developer Tool ยท Analytics

Token & Savings Analytics

Understand exactly which models, routing paths, and endpoints drive your cost-avoided savings โ€” broken down over the last 30 days.

Total Tokens (30d)
39.7M
across all models
Total Saved (30d)
$5,788
vs. cloud-only
Avg. Cost Reduction
73%
vs. hyperscaler baseline
Top Model by Savings
Phi-3.5-mini
$1,826 saved
Token Consumption by Model โ€” 30-day
Daily tokens generated, stacked by model
Mar 22Mar 27Apr 1Apr 6Apr 11Apr 160k500k1.0M1.5M2.0M
  • Llama-3.2-1B
  • Phi-3.5-mini
  • Qwen-2.5-7B
  • Llama-3.3-70B
Token Volume by Routing Path โ€” 30-day
Daily tokens split across local, mesh, and cloud routes
Mar 22Mar 27Apr 1Apr 6Apr 11Apr 160k700k1.4M2.1M2.8M
  • Local
  • Mesh
  • Cloud
Top Performing Models
ModelRequestsLatency (ms)Cost/RequestThroughput
Phi-3.5-mini4,029,595178$0.000963.9 tok/s
Qwen-2.5-7B2,408,209343$0.001375.2 tok/s
Llama-3.2-1B911,91269$0.001082.1 tok/s
Llama-3.3-70B790,961189$0.000742.7 tok/s
Cost-Avoided Savings by Model
Cloud equivalent cost vs. actual MeshInfer cost
1Phi-3.5-mini
Tokens
8.12M
Cloud equiv.
$2,436.39
Actual
$617.88
Saved
$1,818.51
75% off
2Llama-3.3-70B
Tokens
7.66M
Cloud equiv.
$2,299.47
Actual
$640.44
Saved
$1,659.03
72% off
3Llama-3.2-1B
Tokens
5.45M
Cloud equiv.
$1,633.95
Actual
$485.48
Saved
$1,148.47
70% off
4Qwen-2.5-7B
Tokens
3.81M
Cloud equiv.
$1,143.59
Actual
$344.71
Saved
$798.88
70% off
Cost-Avoided Savings by Endpoint
Top endpoints ranked by absolute dollars saved
EndpointTokensSavings% Off CloudImpact
/v1/ai/embed3.12M$1,027.0536%
#1
/v1/ai/summarize2.49M$740.1872%
#2
/v1/ai/chat1.71M$515.9032%
#3
/v1/ai/translate1.70M$496.0249%
#4
/v1/ai/classify1.37M$472.5061%
#5