TSR · The desk
Science · 28 September 2026
Articles in this category in 28 September 2026.
TSR Desk · science · 28 September 2026, 07:00 UTC
DepthEvidence: Unifying Metric Depth Prediction and Geometric Reasoning in Multimodal LanguageTSR Desk · science · 28 September 2026, 07:00 UTC
ScopeBench: Do Agents Preserve Engagement Boundaries Under Goal Pressure?TSR Desk · science · 28 September 2026, 07:00 UTC
Models Got Talent: Identifying High Performing Wearable Human Activity Recognition ModelsTSR Desk · science · 28 September 2026, 07:00 UTC
FlyAOC: Evaluating Agentic Ontology Curation of Drosophila Scientific Knowledge BasesTSR Desk · science · 28 September 2026, 07:00 UTC
Geometric Inconsistency Localization in Multi-View Image SetsTSR Desk · science · 28 September 2026, 07:00 UTC
Inquesto Score: A reliability Protocol For Voice AgentsTSR Desk · science · 28 September 2026, 07:00 UTC
SPO: Discovering Adaptive Large Neighborhood Search Operators via Stackelberg ProgramTSR Desk · science · 28 September 2026, 07:00 UTC
SkillFlow: Scalable and Efficient Agent Skill Retrieval SystemTSR Desk · science · 28 September 2026, 07:00 UTC
ReasonAudio: A Benchmark for Evaluating Reasoning Beyond Matching in Text-Audio RetrievalTSR Desk · science · 28 September 2026, 07:00 UTC
LLM Parkinsonism: Executive-Control Failure, Token-Inefficient Persistence, and anTSR Desk · science · 28 September 2026, 07:00 UTC
Stealth Apart, Harm Together: Skill Cascading Attacks on Skill-Based Agent SystemsTSR Desk · science · 28 September 2026, 07:00 UTC
SignTrace: Describe a Sign, Find the WordTSR Desk · science · 28 September 2026, 07:00 UTC
Highlight-Then-Summarize: Learning to Compress Evidence for Long-Context UnderstandingTSR Desk · science · 28 September 2026, 07:00 UTC
JevAdvBench: A Benchmark and Black-Box Attacks for Reinforcement Learning for CalibratedTSR Desk · science · 28 September 2026, 07:00 UTC
ORCA: Evaluating LLMs on Data Science Code Translation