TSR · The desk
Science · 2026
Articles in this category in 2026.
TSR Desk · science · 11 September 2026, 01:00 UTC
SloMoDeblur: A Large-Scale Smartphone Image Deblurring DatasetTSR Desk · science · 11 September 2026, 01:00 UTC
RESCUE-BENCH: Towards Relation-Aware Multi-Party Emotional Support Conversation SystemsTSR Desk · science · 11 September 2026, 01:00 UTC
RevalExo: A Functional Daily-Activity Benchmark for Inertial and Visual Locomotion ModeTSR Desk · science · 11 September 2026, 01:00 UTC
Improving 5G AI-RAN MCS Selection by Predicting RetransmissionsTSR Desk · science · 11 September 2026, 01:00 UTC
Scaling Post-Training Ternarisation to Qwen3-8B Capability Retention, Reproduction, LosslessTSR Desk · science · 11 September 2026, 01:00 UTC
CityPlanner: A Sandbox Agent for Executable Urban PlanningTSR Desk · science · 11 September 2026, 01:00 UTC
From Symbolic Perception to Logical Deduction: A Framework for Guiding Language Models inTSR Desk · science · 11 September 2026, 01:00 UTC
JarvisGUI: Towards Cross-Device GUI Agents with Dynamic Task CompositionTSR Desk · science · 11 September 2026, 01:00 UTC
GANDR: Claim Auditing for Verifiable Legal Answer GenerationTSR Desk · science · 11 September 2026, 01:00 UTC
Albedo Estimation via Latent Bridge MatchingTSR Desk · science · 11 September 2026, 01:00 UTC
An Experimental Evaluation of Multimodal Prompt Injection Attacks on Agentic AI FrameworksTSR Desk · science · 11 September 2026, 01:00 UTC
Multi-Agent Agentic Graph Learning via Structural SignaturesTSR Desk · science · 11 September 2026, 01:00 UTC
Fine-Tuning a KV Cache Concatenation-Aware Model or Recomputing KV Caches? Why Not Both?TSR Desk · science · 11 September 2026, 01:00 UTC
SpecBench: Measuring Reward Hacking in Long-Horizon Coding AgentsTSR Desk · science · 11 September 2026, 01:00 UTC
Fortunate Recall: Ontology-Driven Memory Lifecycle Management for Persistent Coherence in LLMsTSR Desk · science · 11 September 2026, 01:00 UTC
Safe to Stop? Risk-Constrained Stopping for Sequential Clinical Diagnosis AgentsTSR Desk · science · 11 September 2026, 01:00 UTC
Can Artificial Intelligence Support Healthcare and Mental Health Through Early CyberbullyingTSR Desk · science · 10 September 2026, 01:00 UTC
NormViz: A Benchmark and Framework for Grounding Multimodal Reasoning in Global CulturesTSR Desk · science · 10 September 2026, 01:00 UTC
A visual large language foundational model for medical image recognition usingTSR Desk · science · 10 September 2026, 01:00 UTC
OdysSim: Building Foundation Models for Human Behavior SimulationTSR Desk · science · 10 September 2026, 01:00 UTC
Do Web Agents Investigate Before They Decide?TSR Desk · science · 10 September 2026, 01:00 UTC
Aes3D: Aesthetic Assessment in 3D Gaussian SplattingTSR Desk · science · 10 September 2026, 01:00 UTC
XYBench: Can LLMs Respond Pragmatically to Queries with Misconceptions?TSR Desk · science · 10 September 2026, 01:00 UTC
PAC-CF: Calibrating Irreversible Frontier Pruning in LLM-Guided SearchTSR Desk · science · 10 September 2026, 01:00 UTC
TimeBlind: A Spatio-Temporal Compositionality Benchmark for Video LLMsTSR Desk · science · 10 September 2026, 01:00 UTC
EvoGenUI-Bench: Evaluating LLMs as Multi-Turn Generative UI AssistantsTSR Desk · science · 10 September 2026, 01:00 UTC
Who Maintains Agent Skills? A Longitudinal Study of Human-Governed, AI-Assisted SkillTSR Desk · science · 10 September 2026, 01:00 UTC
ARNAI: Artifact Removal Network based on Autoencoding and Inpainting for Robust Spinal ImageTSR Desk · science · 10 September 2026, 01:00 UTC
Unfolding Scientific Papers into Multi-Turn Generation Trajectories for Continued Pre-TrainingTSR Desk · science · 10 September 2026, 01:00 UTC
Neural Symbollic Regression Using Deep Learning and Sparse ModellingTSR Desk · science · 10 September 2026, 01:00 UTC
CIPHER: Benchmarking Cross-record Inference over Privacy-Hardened Evidence RecordsTSR Desk · science · 10 September 2026, 01:00 UTC
DI-Bench: Systematically Generating In-Domain Data Intelligence Benchmarks for Enterprise AgentsTSR Desk · science · 10 September 2026, 01:00 UTC
SymTRELLIS: Symmetry-Enforced Voxel Latents for 3D GenerationTSR Desk · science · 10 September 2026, 01:00 UTC
In-Place Instruction Following in Diffusion Language ModelsTSR Desk · science · 9 September 2026, 07:00 UTC
When Can LLM Digital Twins Reduce Human Measurement? From Behavioral Fidelity to StatisticalTSR Desk · science · 9 September 2026, 07:00 UTC
GeoContext: One Context Ladder, Two Failure Modes in Vision-Language Geolocation: Flat RelianceTSR Desk · science · 9 September 2026, 07:00 UTC
Benchmark Scores Are Pipeline-Dependent: A Reliability Audit of Cybersecurity LLM BenchmarksTSR Desk · science · 9 September 2026, 07:00 UTC
SWE-Test: Benchmarking LLM Vulnerability Discovery via Input PredictionTSR Desk · science · 9 September 2026, 07:00 UTC
AgentIdeaBench: Benchmarking Scientific Ideation in the Agent EraTSR Desk · science · 9 September 2026, 07:00 UTC
ProcArena: A Multi-Scenario Benchmark for LLMs on Direct and Interactive PL/SQL DevelopmentTSR Desk · science · 9 September 2026, 07:00 UTC
Explainable Deep Learning for Price-Trade Dynamics: From Black-Box Forecasts to EffectiveTSR Desk · science · 9 September 2026, 07:00 UTC
When Intelligence Becomes Agency: A Theory of Governed, Proactive Agency for Symbiotic AITSR Desk · science · 9 September 2026, 07:00 UTC
LogicSkills: A Structured Benchmark for Formal Reasoning in Large Language ModelsTSR Desk · science · 9 September 2026, 07:00 UTC
How AI Models Manage Epistemic Authority: A Taxonomy and Comparative Analysis of Responses toTSR Desk · science · 9 September 2026, 07:00 UTC
Models That Know How Evaluations Are Designed Score SaferTSR Desk · science · 9 September 2026, 07:00 UTC
PiMRef: Deducing Ever-evolving Spear-phishing Emails with Knowledge Base InvariantsTSR Desk · science · 9 September 2026, 07:00 UTC
Robust Metaheuristics under Uncertainty for Berth Allocation and Quay Crane Assignment: A ReviewTSR Desk · science · 9 September 2026, 07:00 UTC
Beyond Top-$k$ Skill Retrieval: Diversity-Aware Skill Routing for LLM AgentsTSR Desk · science · 8 September 2026, 01:00 UTC
EXAONE Forecast for FinanceTSR Desk · science · 8 September 2026, 01:00 UTC
Molecular D\'ej\`a Vu: Digit-Level Retrieval of Published Values in Frontier Language ModelsTSR Desk · science · 8 September 2026, 01:00 UTC
A Deep Generative Model for Synthesizing Labeled Wireless SignalsTSR Desk · science · 8 September 2026, 01:00 UTC
PRISM-Bench: An Audio-Centric Diagnostic Benchmark for Text-to-Audio-Video GenerationTSR Desk · science · 8 September 2026, 01:00 UTC
LLM-Guided Program Evolution for Circle Packing: Breaking 10 Packomania Records for $28TSR Desk · science · 8 September 2026, 01:00 UTC
MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following inTSR Desk · science · 8 September 2026, 01:00 UTC
Cross-modal triage network: a multimodal deep learning framework for severity-based triage andTSR Desk · science · 8 September 2026, 01:00 UTC
SiLR: Structure-Preserving Admission and Process Reward for LLM Tool AgentsTSR Desk · science · 8 September 2026, 01:00 UTC
A Semantic Model of Genetic Evidence: A Step Toward Bridging the Basic-Science-Clinic GapTSR Desk · science · 8 September 2026, 01:00 UTC
Ask Before You Optimize: Dynamic Pre-Formulation Clarification for Interactive OptimizationTSR Desk · science · 8 September 2026, 01:00 UTC
Knowing What Not to Answer: Selective Non-Compliance in Vision-Language ModelsTSR Desk · science · 8 September 2026, 01:00 UTC
Reinforcement Learning for improving Large Language Models' Catalan text simplificationTSR Desk · science · 8 September 2026, 01:00 UTC
AI Revealed PreferencesTSR Desk · science · 8 September 2026, 01:00 UTC
PetQA: Benchmarking Veterinary Knowledge and Clinical ReasoningTSR Desk · science · 7 September 2026, 07:00 UTC
ERPBench: Evaluating LLM Agents for Enterprise Decision-Making Across Competitive MarketTSR Desk · science · 7 September 2026, 07:00 UTC
RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?TSR Desk · science · 7 September 2026, 07:00 UTC
$\tau^\tau$-Bench: An Environment for End-To-End, Realistic Agent ConstructionTSR Desk · science · 7 September 2026, 07:00 UTC
A Systematic Evaluation of Cross-Lingual Consistency Enhancement Methods in MultilingualTSR Desk · science · 7 September 2026, 07:00 UTC
Global to Local: Topology-Preserving Adaptive Graph Pooling via Granular-BallTSR Desk · science · 7 September 2026, 07:00 UTC
TeleTables: A Benchmark for Large Language Models in Telecom Table InterpretationTSR Desk · science · 7 September 2026, 07:00 UTC
Technical Manual for a Toolkit for Measuring Contextual Individuation in Transformer LanguageTSR Desk · science · 7 September 2026, 07:00 UTC
ReCAST: Restoration-aware Cascaded Stage-wise Training for Obfuscated SMS Risk ClassificationTSR Desk · science · 7 September 2026, 07:00 UTC
Agentic Context Cracking: Token-Efficient Data Reasoning Agents via Adaptive Structuring ofTSR Desk · science · 7 September 2026, 07:00 UTC
You Really Didn't Get That? Benchmarking Social Pragmatic Inference for Indirect and PlayfulTSR Desk · science · 7 September 2026, 07:00 UTC
When Does an Interpretation Count as Established? The Formation, Evaluation, and ResponsibilityTSR Desk · science · 7 September 2026, 07:00 UTC
HLS-Seek: QoR-Aware Code Generation for High-Level Synthesis via Proxy Comparative RewardTSR Desk · science · 7 September 2026, 07:00 UTC
CC-Mediation: Evaluating Large Language Models for Cross-Cultural Conflict MediationTSR Desk · science · 7 September 2026, 07:00 UTC
MaxKernel: Agentic Kernel Generation for TPUsTSR Desk · science · 7 September 2026, 07:00 UTC
A Cost-Aware Agentic Architecture for NL-to-SQL over Nested Enterprise Schemas, with a NewTSR Desk · science · 7 September 2026, 07:00 UTC
AlcaTRAz - Anchored Tree-Rule Defense Against JailbreaksTSR Desk · science · 7 September 2026, 07:00 UTC
Aletheia: An Offline-First Clinical Decision Support System for Differential Diagnosis inTSR Desk · science · 4 September 2026, 19:01 UTC
FADTI: Fourier and Attention Driven Diffusion for Multivariate Time Series ImputationTSR Desk · science · 4 September 2026, 19:01 UTC
LightEMMA: A Longitudinal Evaluation of Vision-Language Models for Autonomous DrivingTSR Desk · science · 4 September 2026, 19:01 UTC
Fixing FOLIO and MALLS: Verified Annotations and an LLM-assisted Framework to Focus HumanTSR Desk · science · 4 September 2026, 19:01 UTC
MasterControl Seventeen Every TimeTSR Desk · science · 4 September 2026, 19:01 UTC
Do GUI Agents Know When Not to Act? Enabling Conflict-Aware Termination for Multimodal GUITSR Desk · science · 4 September 2026, 19:01 UTC
More Criticism Does Not Make a Better Review: EquiReview-RTSR Desk · science · 4 September 2026, 19:01 UTC
Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM AgentsTSR Desk · science · 4 September 2026, 19:01 UTC
IRWOZ 2.0: A Large Language Model-driven Dialogue Dataset for Industrial Robot ConversationsTSR Desk · science · 4 September 2026, 19:01 UTC
Caught in the Story: Narrative Captivity in Multi-turn LLMs ConversationTSR Desk · science · 4 September 2026, 19:01 UTC
Beyond BLEU: A Case for Redefining Sign Language Translation BenchmarksTSR Desk · science · 4 September 2026, 19:01 UTC
Plan Pointers and Record-Directive Form in Budgeted Verification of Inherited Agent MemoryTSR Desk · science · 4 September 2026, 19:01 UTC
PAWBench: How Far Are We from Probabilistically Aligned World Modeling?TSR Desk · science · 4 September 2026, 19:01 UTC
ObserverBench: Testing Mechanistic Estimates for Intervention and ControlTSR Desk · science · 4 September 2026, 19:01 UTC
Repetition Mismatch: Why Data Mixture Experiments Don't Scale and How to Fix ThemTSR Desk · science · 4 September 2026, 19:01 UTC
TabScope: Question-Adaptive Scope Selection for Table Question AnsweringTSR Desk · science · 4 September 2026, 19:01 UTC
Pattern Over-Generalization of Knowledge Graph EmbeddingTSR Desk · science · 4 September 2026, 19:01 UTC
Scientific Agent Skills: A Library of Procedural Knowledge for Research AgentsTSR Desk · science · 4 September 2026, 19:01 UTC
HOMURA: Taming the Sand-Glass for Time-Constrained LLM Translation via Reinforcement LearningTSR Desk · science · 4 September 2026, 19:01 UTC
ToolDF: Tool-Integrated Reasoning for Mixed-Authenticity Audio Deepfake DetectionTSR Desk · science · 4 September 2026, 19:01 UTC
SVG-Score: Human-Aligned Evaluation of Text-to-SVG GenerationTSR Desk · science · 4 September 2026, 19:01 UTC
Toward Collective-Centric Evaluation of Preference Inference for Participatory Democracy