Cost & Usage Observability

All Providers Operational
Total Spend (30d)
+12.4%
$3,842.18

Across 4 providers, 12 models

Aggregated Token Volume
+8.1%
412.8M

308.2M prompt / 104.6M completion

P95 Latency & TTFT
-32ms
740ms

195ms TTFT | 0.14% error rate

Cache & Fallback Efficiency
Saved
$614.30

28.4% prompt cache hit rate

Model Usage & Cost Trends
Daily token consumption and cost breakdown by model
Provider Spend Allocation
Cost distribution and token rates across providers
OpenAI$2,074.78
54% · $0.032/1K tokens
Anthropic$1,191.08
31% · $0.028/1K tokens
Google Cloud$422.64
11% · $0.018/1K tokens
Groq$153.68
4% · $0.004/1K tokens
Input vs Output Ratio
75%/25%
308.2M prompt
104.6M completion
1,240Avg Prompt Length
413Avg Completion Length
Prompt cache: 28.4%
Ratio: 3.0:1
Latency Timeline
1065ms
P99
P90
P50
Request Status
1,584Total requests (24h)
200OK
1,341occurrences
429Rate Limit
214occurrences
500Server Error
29occurrences
API Traces
Monitor and analyze your recent API requests.
Trace IDStatusTimeModelTokensLatencyCost
Action
200Just now
GPT-4oOpenAI
1,937 / 168
447ms343ms TTFT
$0.00652
2004m ago
Claude 3.5 SonnetAnthropic
965 / 237
624ms110ms TTFT
$0.00574
2008m ago
Gemini 1.5 ProGoogle Cloud
967 / 295
356ms121ms TTFT
$0.00268
20012m ago
Llama 3.3Groq
499 / 417
894ms105ms TTFT
$0.00059
20016m ago
GPT-4oOpenAI
1,505 / 179
364ms182ms TTFT
$0.00555
20020m ago
Claude 3.5 SonnetAnthropic
1,904 / 409
903ms253ms TTFT
$0.01062
20024m ago
Gemini 1.5 ProGoogle Cloud
244 / 385
418ms239ms TTFT
$0.00223
42928m ago
Llama 3.3Groq
832 / 645
761ms289ms TTFT
$0.00092
42932m ago
GPT-4oOpenAI
1,748 / 282
618ms261ms TTFT
$0.00719
50036m ago
Claude 3.5 SonnetAnthropic
350 / 192
0ms0ms TTFT
$0.00335
Showing 1 to 10 of 15 traces