GPT-OSS-120B
Deployment dpl-g7h8i9
GPT-OSS-120B
Scalinghttps://nexus.trinidy.cloud/v1/gpt-oss-120b-staging/inferenceRequests 24h
12.4K
Avg Latency
55ms
Uptime
99.8%
Region
us-west-2
Instance
nexus.gpu.a10g
Cost/hr
$2.10
Total Requests
209.7K
Total Tokens
58.7M
Total Errors
95
0.045% error rate
Cost (24h)
$50.40
Requests per Hour
Average Latency (ms)
Errors per Hour
Tokens Generated