Cost & Usage Observability
All Providers Operational
Total Spend (30d)
$3,842.18
Across 4 providers, 12 models
Aggregated Token Volume
412.8M
308.2M prompt / 104.6M completion
P95 Latency & TTFT
740ms
195ms TTFT | 0.14% error rate
Cache & Fallback Efficiency
$614.30
28.4% prompt cache hit rate
Model Usage & Cost Trends
Daily token consumption and cost breakdown by model
Provider Spend Allocation
Cost distribution and token rates across providers
OpenAI$2,074.78
54% · $0.032/1K tokens
Anthropic$1,191.08
31% · $0.028/1K tokens
Google Cloud$422.64
11% · $0.018/1K tokens
Groq$153.68
4% · $0.004/1K tokens
Input vs Output Ratio
75%/25%
308.2M prompt
104.6M completion
1,240Avg Prompt Length
413Avg Completion Length
Prompt cache: 28.4%
Ratio: 3.0:1Latency Timeline
1065ms
P99
P90
P50
Request Status
1,584Total requests (24h)
200OK
1,341occurrences
429Rate Limit
214occurrences
500Server Error
29occurrences
API Traces
Monitor and analyze your recent API requests.
| Trace ID | Status | Time | Model | Tokens | Latency | Cost | Action |
|---|---|---|---|---|---|---|---|
| 200 | Just now | GPT-4oOpenAI | 1,937 / 168 | 447ms343ms TTFT | $0.00652 | ||
| 200 | 4m ago | Claude 3.5 SonnetAnthropic | 965 / 237 | 624ms110ms TTFT | $0.00574 | ||
| 200 | 8m ago | Gemini 1.5 ProGoogle Cloud | 967 / 295 | 356ms121ms TTFT | $0.00268 | ||
| 200 | 12m ago | Llama 3.3Groq | 499 / 417 | 894ms105ms TTFT | $0.00059 | ||
| 200 | 16m ago | GPT-4oOpenAI | 1,505 / 179 | 364ms182ms TTFT | $0.00555 | ||
| 200 | 20m ago | Claude 3.5 SonnetAnthropic | 1,904 / 409 | 903ms253ms TTFT | $0.01062 | ||
| 200 | 24m ago | Gemini 1.5 ProGoogle Cloud | 244 / 385 | 418ms239ms TTFT | $0.00223 | ||
| 429 | 28m ago | Llama 3.3Groq | 832 / 645 | 761ms289ms TTFT | $0.00092 | ||
| 429 | 32m ago | GPT-4oOpenAI | 1,748 / 282 | 618ms261ms TTFT | $0.00719 | ||
| 500 | 36m ago | Claude 3.5 SonnetAnthropic | 350 / 192 | 0ms0ms TTFT | $0.00335 |
Showing 1 to 10 of 15 traces