gpu-broker connecting…

GPU

–

Resident

–

Running

idle

Last 24 h

–

Models — click to use

–
kindmodelVRAMstatus

Live

VRAM by owner · 15 min

–

GPU utilization

–

Power

–

Temperature

–

Tok/s per job · 1 h

–

Latency per job · 1 h

● time to first token ● total

Last hour · p50 / p95

gen tok/s–prompt tok/s– first token–total– queue wait–model switch–

Connect apps

Point AI apps at this broker. Every change is backed up; Disconnect restores it exactly.
app (on this machine)statuswhere


    

Client keys

namekeycreatedlast used

Queue

#jobrequested usingfromwaiting

Per model (24 h)

modeldone failedavg smax s

Recent jobs

whenjobrequested usedstateserror

Events

whenkindjob detail

Downloads

slugrefstate updated