Cost & Usage Observability
All Providers Operational
Total Spend (30d)
$3,842.18
Across 4 providers, 12 models
Aggregated Token Volume
412.8M
308.2M prompt / 104.6M completion
P95 Latency & TTFT
740ms
195ms TTFT | 0.14% error rate
Cache & Fallback Efficiency
$614.30
28.4% prompt cache hit rate
Model Usage & Cost Trends
Daily token consumption and cost breakdown by model
Provider Spend Allocation
Cost distribution and token rates across providers
OpenAI$2,074.78
54% · $0.032/1K tokens
Anthropic$1,191.08
31% · $0.028/1K tokens
Google Cloud$422.64
11% · $0.018/1K tokens
Groq$153.68
4% · $0.004/1K tokens
Input vs Output Ratio
75%/25%
308.2M prompt
104.6M completion
1,240Avg Prompt Length
413Avg Completion Length
Prompt cache: 28.4%
Ratio: 3.0:1Latency Timeline
921ms
P99
P90
P50
Request Status
1,497Total requests (24h)
200OK
1,273occurrences
429Rate Limit
195occurrences
500Server Error
29occurrences
API Traces
Monitor and analyze your recent API requests.
| Trace ID | Status | Time | Model | Tokens | Latency | Cost | Action |
|---|---|---|---|---|---|---|---|
| 200 | 13m ago | GPT-4oOpenAI | 508 / 284 | 662ms260ms TTFT | $0.00411 | ||
| 200 | 17m ago | Claude 3.5 SonnetAnthropic | 1,477 / 643 | 248ms171ms TTFT | $0.01215 | ||
| 200 | 21m ago | Gemini 1.5 ProGoogle Cloud | 1,960 / 406 | 743ms182ms TTFT | $0.00448 | ||
| 200 | 25m ago | Llama 3.3Groq | 1,463 / 611 | 670ms196ms TTFT | $0.00105 | ||
| 200 | 29m ago | GPT-4oOpenAI | 953 / 253 | 639ms71ms TTFT | $0.00491 | ||
| 200 | 33m ago | Claude 3.5 SonnetAnthropic | 322 / 336 | 254ms291ms TTFT | $0.00500 | ||
| 200 | 37m ago | Gemini 1.5 ProGoogle Cloud | 1,693 / 125 | 588ms286ms TTFT | $0.00274 | ||
| 429 | 41m ago | Llama 3.3Groq | 1,391 / 267 | 521ms199ms TTFT | $0.00066 | ||
| 429 | 45m ago | GPT-4oOpenAI | 902 / 537 | 255ms78ms TTFT | $0.00763 | ||
| 500 | 49m ago | Claude 3.5 SonnetAnthropic | 1,745 / 357 | 0ms0ms TTFT | $0.00952 |
Showing 1 to 10 of 15 traces