run · run_bmddot4qmvf155vl · filed 2026-08-14 23:27:56
Share
mbti-multi-model-glm-5.2
Grader output
free-form JSON · this task's own1.000grader.score1 of 1 cases passed
- score
- 1.000
- passed
- ✓
- total cases
- 1
- passed cases
- 1
- skipped cases
- 0
- pass threshold
- 0.800
- cost total
- $0.0071
- latency p95
- 23.86 s
- latency total
- 24.00 s
- latency median
- 23.86 s
score by category
personality
100%
extras
n_scored=1n_skipped_no_gold=0Fields here are the task author's — trap neither interprets nor validates them.
Run frame
written by trap · always present- cases
- 1
- duration total
- 24.00s
- cost
- —
- engine
- z-ai/glm-5.2
environment · self-reported, not validated
- os
- macOS 14.0
- arch
- arm64
- kernel
- Darwin 23.0.0
- cpu
- Apple M1 · 8 cores
- memory
- 8.0 GB
- trap
- 0.0.14
per-case results · all 1, in case_id order
casesolutiondurationcostjudge