GPT-OSS-120B
Deployment dpl-a1b2c3
GPT-OSS-120B
Activehttps://nexus.trinidy.cloud/v1/gpt-oss-120b/inferenceRequests 24h
284.3K
Avg Latency
42ms
Uptime
99.98%
Region
us-east-1
Instance
nexus.gpu.a100
Cost/hr
$4.20
Total Requests
207.1K
Total Tokens
58.0M
Total Errors
111
0.054% error rate
Cost (24h)
$100.80
Requests per Hour
Average Latency (ms)
Errors per Hour
Tokens Generated