GPT-OSS-120B

Deployment dpl-a1b2c3

GPT-OSS-120B

Active
https://nexus.trinidy.cloud/v1/gpt-oss-120b/inference
Requests 24h

284.3K

Avg Latency

42ms

Uptime

99.98%

Region

us-east-1

Instance

nexus.gpu.a100

Cost/hr

$4.20

Total Requests

207.1K

Total Tokens

58.0M

Total Errors

111

0.054% error rate

Cost (24h)

$100.80

Requests per Hour

Average Latency (ms)

Errors per Hour

Tokens Generated