
A released Tamil end-of-turn dataset and sub-25MB detectors push semantic turn detection accuracy from 70% zero-shot to 86%, under 150ms on CPU, with a warning that rule-derived training labels mislabel the negative class.
articletrajectory-judge: What Outcome-Only LLM Judges Miss on Agent TrajectoriesHadi Mohammadi
articleEvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language ModelsXinning Li, Kemunto Ochwang'i, Aryasomayajula Ram Bharadwaj, Alexandra Souly, Robert Kirk
articleCan a Model Catch Its Own Hallucinations for Free?: Label-Free Doubt Signals Hold Their Own Against a Labelled Dataset for AbstentionAli Asaria, Tony Salomone, Deep GandhiChecking sign-in…
Loading comments…