Cost & Usage Observability

All Providers Operational
Total Spend (30d)
+12.4%
$3,842.18

Across 4 providers, 12 models

Aggregated Token Volume
+8.1%
412.8M

308.2M prompt / 104.6M completion

P95 Latency & TTFT
-32ms
740ms

195ms TTFT | 0.14% error rate

Cache & Fallback Efficiency
Saved
$614.30

28.4% prompt cache hit rate

Model Usage & Cost Trends
Daily token consumption and cost breakdown by model
Provider Spend Allocation
Cost distribution and token rates across providers
OpenAI$2,074.78
54% · $0.032/1K tokens
Anthropic$1,191.08
31% · $0.028/1K tokens
Google Cloud$422.64
11% · $0.018/1K tokens
Groq$153.68
4% · $0.004/1K tokens
Input vs Output Ratio
75%/25%
308.2M prompt
104.6M completion
1,240Avg Prompt Length
413Avg Completion Length
Prompt cache: 28.4%
Ratio: 3.0:1
Latency Timeline
921ms
P99
P90
P50
Request Status
1,497Total requests (24h)
200OK
1,273occurrences
429Rate Limit
195occurrences
500Server Error
29occurrences
API Traces
Monitor and analyze your recent API requests.
Trace IDStatusTimeModelTokensLatencyCost
Action
20013m ago
GPT-4oOpenAI
508 / 284
662ms260ms TTFT
$0.00411
20017m ago
Claude 3.5 SonnetAnthropic
1,477 / 643
248ms171ms TTFT
$0.01215
20021m ago
Gemini 1.5 ProGoogle Cloud
1,960 / 406
743ms182ms TTFT
$0.00448
20025m ago
Llama 3.3Groq
1,463 / 611
670ms196ms TTFT
$0.00105
20029m ago
GPT-4oOpenAI
953 / 253
639ms71ms TTFT
$0.00491
20033m ago
Claude 3.5 SonnetAnthropic
322 / 336
254ms291ms TTFT
$0.00500
20037m ago
Gemini 1.5 ProGoogle Cloud
1,693 / 125
588ms286ms TTFT
$0.00274
42941m ago
Llama 3.3Groq
1,391 / 267
521ms199ms TTFT
$0.00066
42945m ago
GPT-4oOpenAI
902 / 537
255ms78ms TTFT
$0.00763
50049m ago
Claude 3.5 SonnetAnthropic
1,745 / 357
0ms0ms TTFT
$0.00952
Showing 1 to 10 of 15 traces