Model: not recorded. Thinking: not recorded.
Jev connection: 2 of 4 with-Jev runs that reached the model got a Jev answer (50%). Automatic arm: 0 of 2 model-reached B runs called Jev; 2 did not call Jev.
Jev round trip: n=2, median 36.4 ms, p90 43.0 ms, p95 43.8 ms.
Tokens: not measured.
Agent model spend (Pi usage cost, summed): A $0.0000; B $0.0000; C $0.0000.
History: the 2026-09-22 two-arm Pi run recorded 150 pairs; after 43 with-Jev runs reached the local model, 127.0.0.1:8000 stopped accepting connections (Pi reported Connection error with zero tokens, on both arms) and the remaining 107 runs were server failures, not model speed.
Stop: all 2 triplets recorded
| triplets | 2 |
|---|---|
| wall_A_median_s | 0.03709 |
| wall_A_p90_s | 0.04135 |
| wall_A_p95_s | 0.04189 |
| jev_usd_A | 0 |
| called_jev_A | 0 |
| called_jev_share_A | 0 |
| wall_B_median_s | 0.6703 |
| wall_B_p90_s | 0.6712 |
| wall_B_p95_s | 0.6713 |
| jev_usd_B | 0 |
| called_jev_B | 0 |
| called_jev_share_B | 0 |
| wall_C_median_s | 0.6763 |
| wall_C_p90_s | 0.7351 |
| wall_C_p95_s | 0.7425 |
| jev_usd_C | 1.008e-05 |
| called_jev_C | 2 |
| called_jev_share_C | 1 |
| wall_b_minus_a_median_s | 0.6333 |
| wall_b_minus_a_p90_s | 0.6384 |
| wall_b_minus_a_p95_s | 0.6391 |
| wall_b_minus_a_sign_p | 0.5 |
| wall_c_minus_a_median_s | 0.6392 |
| wall_c_minus_a_p90_s | 0.6938 |
| wall_c_minus_a_p95_s | 0.7006 |
| wall_c_minus_a_sign_p | 0.5 |
| run | tool | status | use gate | answer | correct | wall s | Jev calls |
|---|---|---|---|---|---|---|---|
| dry-screen-01.A | jev_screen | ok | n/a (arm has no Jev) | clean | True | 0.03 | 0 |
| dry-screen-01.B | jev_screen | ok | did not call Jev | clean | True | 0.67 | 0 |
| dry-screen-01.C | jev_screen | ok | used Jev | clean | True | 0.60 | 1 |
| dry-verify-01.A | jev_verify | ok | n/a (arm has no Jev) | verified | True | 0.04 | 0 |
| dry-verify-01.B | jev_verify | ok | did not call Jev | verified | True | 0.67 | 0 |
| dry-verify-01.C | jev_verify | ok | used Jev | verified | True | 0.75 | 1 |