← LIFE Labs Hub
Golden Prompt Report
Benchmark Run
2026-08-12 — Diagnostic: wisdom-reviewer-fionn v0.1.9 × v0.3 judges (final-eval 82, routed, Opus 5 gen / Sol xhigh judge)
2026-03-29 — Latest (356 scenarios, 11 judges, Opus 4.6, with synthesis)
2026-03-17 — Previous (114 scenarios, 11 judges)
2026-03-08 — Earlier (101 scenarios, 9 judges)
?