calibrationframing sensitivitypublished Oct 9, 2026 · arXiv:2610.11392
TypedBench: A Benchmark for Calibration, Framing Sensitivity, and Cost in System One Decision Models
typed decision modelsoption-label biaspublished Oct 5, 2026 · arXiv:2610.02586
Labels Override Definitions in Jev-Style Typed Decision Models
agent harnessesSystem-1 decision modelspublished Oct 5, 2026 · arXiv:2610.02267
Fast Models, Slow Evidence: A Paired and Self-Audited Evaluation of System-1 Decision Models for LLM Agent Harnesses
calibrationuncertainty estimationpublished Oct 2, 2026 · arXiv:2610.01006
Beyond Answer Confidence: A Controlled Audit of Self-Knowledge in a Black-Box Decision Model
sensor-based human activity recognitionaccelerometer signalspublished Sep 30, 2026 · arXiv:2609.36154
More Features Are Not More Evidence: Limits of Training-Free Human Activity Recognition with Jev
decision modelsvalue of informationpublished Sep 28, 2026 · arXiv:2609.30706
LAVOIR: Teaching a Single-Pass Decision Encoder When and What to Ask with Amortized Value of Information