Archive
Everything we've scored that's past the 48-hour window — open to everyone, no account needed. The live feed only shows what's moving right now; this is the record behind it.
- 19Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments
- 19Vero: Can AI Agents Build Formally Verified Software Repositories?
- 19A Low-Cost, Open Platform for End-to-End Autonomous Driving on a Miniature Ackermann Vehicle
- 19Exponential quantum advantage for learning signals with a single qubit
- 19Scaling Graph Neural Networks for Friend Recommendation: Multi-Hash User Embeddings and Temporal Neighbor Sampling
- 19The data geometry of masking diffusion: Certified-optimal schedules via unmasking growth complexity
- 19Participatory Moral AI Is Not Neutral: The Invisible Hand of Developers
- 19InstructMesh: Selective Refinement of Generative 3D Models for Fabrication
- 19Intervention-Aware Clinical World Model for Post-Op Outcome Forecasting in Cardiology
- 19DFM Mimir v1: An Open HRM Delivering Frontier Performance at 1B Parameters Using Only Permissible Post-Training Data
- 19Consolidating RLVR Capabilities Across Domains: A Deep Dive into Fusion Paradigms
- 19Bagging Robustly Learns VC Classes with Linear Sample Complexity
- 19Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining
- 19Physical-Support Confidence Sets for Highly Coherent Dictionaries
- 19TabSOM: A tabular-to-image encoding method based on self-organizing maps
- 19What should a personal website be?
- 19On the Structural Limits of Machine Learning Decision Systems: An Information-Theoretic, Interaction-Based, and Stochastic-Dynamical Perspective
- 19Efficient Test-Time Adaptation through Human-AI Interaction
- 19CLAP: Cross-Embodiment Video World Models are Zero-Shot Physical Simulators
- 19Equivariant learning of a transferable three-dimensional classical density functional
- 19Intern-S2-Preview: Scientific Agentic Foundation Model
- 19Sparse Orthogonal Regression Technique: A Spectral Framework for Equation Discovery, Approximation, and Integration
- 19Phantom Gains: Auditing Self-Improvement Against a Measured Null
- 19The Natural Language Interaction Protocol and Standard for AI Agents
- 19Prospective Coding Improves Learning in Deep Continuous-Time Recurrent Networks
- 19Primal Acceleration of Newton's Method
- 19Texture Image Classification Using DWT AlexNet Feature Fusion and Deep Neural Networks
- 19VIALS: A Benchmark for Visual Interpretation of Artifacts in the Life Sciences
- 19AI with Authority, from Application to Silicon
- 19Wyvern: An Agentic Framework for Generating Grounded Multimodal Reports
- 19How Language Models Organize and Structure Moral Knowledge
- 19Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Prediction
- 19Environment Evolution for Terminal Agents
- 19Designing Compact Neural Architectures via Neuron Gating and Mixed Activation
- 19Epistemic Warrant for LLM Recommendations: Characterizing the Basis for Reliance When Ground Truth Is Unavailable
- 19PerturbRx: Learning Treatment-Conditioned Latent Transitions for Patient Drug Response Prediction
- 19Learning-to-Transition for Large-scale and High-Order MIMO Detection
- 19LeVJEPA: Efficient & Scalable Video Pretraining without the Heuristics
- 19When Robots Mishear Us: Mapping the Safety Risks of Voice-Controlled Embodied AI
- 19Truthful Calibration Measures for Sequential Prediction
- 19TraVEL: Trajectory-Guided Video Embedding Learning for Driving-Video Retrieval
- 19RATIO: A Benchmark for Retrieval Across Typed Ideation Operations in Scientific Literature
- 19PACE-Bench: Benchmarking Physics Adaptation via Code Evolution in Dynamic Environments
- 19Asymmetric Capacity Allocation in Self-Refinement Pipelines
- 19Property-Specific Recoverability from Contact PPG to Camera rPPG under Heterogeneous Observation Conditions
- 19CorporateBench: Large-Scale Q&A Benchmarking with Temporal Knowledge Bases
- 19MirrorWorld: Taming Video Diffusion Models for Mirror Reflection Generation
- 19Split the Labor: Separating Evidence Interpretation from Decision Aggregation
- 19AlayaWorld: Interactive Long-Horizon World Modeling - Full Technical Report (v1.1)
- 19Dynamic Structural Causal Modeling for Sleep
- 19TurboBias 2.0: Streaming Context-Biasing for Production-Efficient ASR Systems
- 19Conformal Uncertainty Quantification Guarantees for Neural Operators
- 19CreativeInstruct: Scalably Teaching LLMs to Balance Quality, Creativity, and Diversity
- 19Token-Level Advertising
- 19Constant regret in general games via higher-order optimism
- 19D2C-Routing: Dimension-to-Composition Evidence Routing for Mixed-Origin AI-Generated Text Detection
- 19Style or Signature? Artist-Disjoint Evaluation of Style Classification in Frozen Vision Embeddings
- 19CoinRAG: Contextualized Information Nugget KV Cache Reuse for Long-Context RAG
- 19Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization
- 19Sequential Beats Joint: On the Interplay between On-Policy Distillation and RLVR
- 19Which Eviction Policy Should an LLM Cache Use? A Systematic Study Across Workloads, Capacities, and Encoders
- 19RecipeNet: A Hierarchical Transformer for Recipe Data
- 19Training Communication-Efficient Mixture-of-Experts Language Models with Layer Re-Configuration
- 19Toward a Gricean Retreat: Probing LLMs for Knowledge Boundaries and Referent Specificity
- 19Interaction Creates Dynamical AI Behavior Absent in Isolation
- 19Hardware-Aware FP4 FlashAttention-4
- 19Break It Down, Pass It On: Cross-Task Skill Transfer in LLM Agents
- 19Universal Thermodynamic Interatomic Potentials for Crystalline Materials
- 19Synthetic Persona Pretraining: Alignment from Token Zero
- 19Across-Design Uncertainty in Short Pricing Panels: Evidence from Simulated Price Trajectories
- 19Strategy-first synthesis planning for complex natural products
- 19Catching the Rug: Early Prediction of Fraudulent Memecoins on Solana via Machine Learning
- 19Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View
- 19Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training
- 19Anatomy-Informed Neural Networks: Encoding Anatomic Priors in Loss and Architecture, with an SE(3) Formulation of Guidewire-Induced Aortoiliac Deformation
- 19Phoneme- and Word-Level Metrics Using Self-Supervised Speech Representations for Forced Alignment Evaluation
- 19Universality and sharp thresholds for ellipsoid fitting
- 19Generating Benchmark Health Data Using a Tabular Diffusion Transformer
- 19Learning When to Trust via Selective Context Preference Optimization
- 19Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090
- 19The Dynamics of Intelligence Explosions
- 19Beyond Myopic World Models: Long-Horizon End-to-End Training for Direct Future Prediction
- 19Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM
- 19Asynchronous I/O in DuckDB: Work, Thread, Work
- 19Beyond Post-Hoc Temperature Scaling: Bilevel Optimization for LLM Calibration
- 19The Bitter Lesson of Tool Calling
- 19Knowing When to Stop: Bayesian Optimal Stopping for LLM Evaluations
- 19ResidencyRL: Reinforcement Learning in Simulated Clinical Environments
- 19SkillProx: Self-Evolving Agent Skills via Proximal Textual Gradient Descent
- 19Adaptive Vision-Language Grasping via Composable Foundation Priors and Generalizable Grasp Synthesis
- 19Approximate Muon with low-rank adapters
- 19Tracing the Heart: An Evidence-Linked Pipeline for Heart-Failure Feature Engineering
- 19Successive Capacity Growth: Task-Complexity-Driven Width and Depth Expansion for Vision Transformer Encoders in JEPA World Models
- 19Investigating Artificial Intelligence Digital Sovereignty in Mobile Shopping Apps: A Case Study of Nigeria
- 19An Optimal Agnostic PAC Algorithm
- 19Stageboost: Recommending Signals Based on Counterfactual Estimation
- 19Move by Move: Measuring and Steering How LLMs Conduct Psychotherapy
- 19Optimal Scheduling of Road Maintenance Jobs Considering Impact on Traffic Flows
- 19AV-AIVAT: 74x Cheaper Agent Evaluation with Certified Anytime-Valid Stopping in Imperfect-Information Games
- 19The Low Frequency Trap: Video Language Models Fail at Simple Event Bookkeeping
- 19DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training
- 19KnockGS:interaction-Grounded Calibrationof Physical Gaussian Representations
- 19Time-Aware Tranformer-Based Prediction Model for AECOPD
- 19Twin: Playing an Unknown Game with a Test-Time Digital Twin
- 19Sophistication in GenAI Use: Field Evidence from a Large Firm
- 19I Seek You in Videos: Identity-Conditioned Queries for Person-Centric Video Reasoning
- 19MARC v1: An Open-Source Multi-Agent Framework for Clinical AI Reasoning and Coordination
- 19Resourced Authority A Mechanism-Design Model for Participatory Governance of Deployed AI Agents
- 19CalibForge: Adversarial Solver Calibration for Scaling Learnable Terminal Tasks
- 19Challenges in Evaluating Explanation Methods for Static and Evolving Data
- 19More Correct Mass, Worse Answers: Why Power Sampling Can Fail and How to Fix It
- 19REPLICANT: Learning Policies for Evading and Hardening Malware Detectors
- 19Unified Branch-and-Bound Search for the Steiner Traveling Salesman Problem on Graphs of Convex Sets
- 19Your Voice Cloning System is Secretly a Voice Anonymizer
- 19RP-OPSD: Reasoning-Pivot-Guided On-Policy Self-Distillation for Multilingual Reasoning Transfer
- 19From Regulation to Implementation: A Critical Evaluation of LLM-Assisted Regulatory Compliance in Industry
- 19GeoBenchLLM: A Comprehensive Benchmark for Evaluating LLMs on Geo-Related Tasks
- 19TRAJDEBUG: Tracing Error Lifecycle to Identify Critical Failures in Long-Horizon Agent Trajectories
- 19On the Maintenance and Co-evolution of Agent Plugins: An Empirical Study of Claude Code Plugin Marketplaces
- 19AaLLM: An End-to-End Analog Circuit Design Framework from Topology Generation to Sizing Using Large Language Models
- 19Taxonomy-Driven Analysis of Open-Source AI Risk Mitigation Tools
- 19Prompt-Model Interaction Reaches the Fixed Points: A deterministic, task-free structural readout -- and the factorizations of it that failed
- 19Scalable estimation of VARMA models
- 19Addressable Memory for Video World Models
- 19CytoBERT: A Foundation Model for Cytometry Data
- 19DICS: Data-Informed Centroid Splitting for Decision Tree Classifiers
- 19Learning When to Think: Adaptive Reasoning for Test-Time Compute Allocation
- 19Ensuring Safe Physical AI in Urban Mobility via Hazard-Informed Synthesized Envelopes
- 19OpenBSD EuroBSDcon 2015 presentations
- 19Transfer Learning in Nonparametric Regression with Deep ReLU Networks
- 19GeoDistill-Refine: Silhouette-First Geometry Distillation for Annotation-Free Spacecraft Segmentation
- 19Ladders in Chaos: When, How, (and Perhaps Why) Does Test-Time Scaling Improve LLM Machine Translation
- 19RIS-Aided mmWave Localization Under Cross-Link Interference via Beam-Domain ML Fingerprinting
- 19Optimal Rates for Learning with Monotone Adversaries
- 19You can't transition a CSS variable. @property says otherwise.
- 19Using df.styler with df.to_latex() and longtable
- 19Online Inference in Distributional Temporal-Difference Learning
- 19LP-NAS: Linear Programming-based Neural Architecture Search
- 19AcrossVAM1.0: Particle World Modeling for Text-Assisted Robot Video Prediction
- 19LLM-Based Agents for Software and Systems Security: Approaches, Applications, and Assessment
- 19Active-Trace Complexity Bounds for Moreau--Yosida Unadjusted Langevin Sampling
- 19Blast Radius
- 19Can guitar frets perform multiplication?
- 19Concept Drift Detection and Adaptive Retraining of Malware Classification Models
- 19An Exploratory Evaluation of LLM-Assisted Rewriting of Moderate-Complexity Financial Sentences for DisCoCat-Based Sentiment Analysis
- 19Tytan: Interactive Neurosymbolic Construction of Analytic Semantic Schemas from Relational Data
- 19PsychoAgent: An Affect-Sensitive Cognitive Architecture for Conflict-Aware Memory in LLM Agents
- 19Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing
- 19DynaCrys: Crystal Generation with Dynamic Space-Group Diffusion
- 19Post-Grokking Collapse at the Representation-Readout Interface in Muon-Trained Transformers
- 19Benchmarking the Benchmarks: Evaluating Benchmarks for Conversational Agents
- 19MLLM-Routed Heterogeneous Ensembles for Robust Cross-Dataset Image Classification
- 19FinRank: An Evidence-Grounded Benchmark for Financial Question Answering and Retrieval over SEC Filings
- 19SABRE: Scalable and Automated Benchmarking of VLMs under Stress
- 19Rethinking Expressivity and Efficiency in Test-Time Training
- 19Expected Free Energy-based Informative Path Planning for Robotic Mars Exploration
- 19Wasserstein Policy Gradient for Entropy-Regularized Linear-Quadratic Control
- 19Uncovering expert objectives in production planning via inverse optimization: An industrial case study
- 19Diffusion LLMs as Targets and Adversaries: Mechanistic Safety Exploits
- 19You Only Pass Once: Answering and Abstaining Together in a Single Forward Pass of a Frozen Language Model
- 19SPARCL: Spectral Partitioned Analytic Continual Learning
- 19TEPA: Revoking Stale Memories for Conflict-Robust Language Agents
- 19Re$^3$Cap: Retrieval-Guided Refinement for Image Captioning Enhancement via Reinforcement Learning
- 19How Proper Scoring Rules Shape LLM Forecasting
- 19A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy
- 19Information Satisfaction: A Reader-Centered Axis for Summarization Evaluation
- 19Shift Aware Transfer Learning with Adaptive Dual-Encoder Fusion for PM Forecasting in Data-Limited Environments
- 19I built a complete DJ console in a single HTML file using Web Audio API
- 19NL2AGBench: Benchmarking LLM Auto-Formalization for AlphaGeometry
- 19CoBa: Cost-Effective Test-Time Scaling via Compute-Balanced Routing
- 19Blind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledge
- 19SheetCompass: Hierarchical Relation Graphs for Agentic Spreadsheet Reasoning
- 19Cloud-Boosted Low-Compute Multi-Channel Speech Enhancement
- 19Write prompts for the cache, not the reader
- 19Building a smart greenhouse in the woods: the architectural experiment of DevFest Basilicata - DevF{or}est
- 19DevRelCon, Adult Summer Camp, and My First Time Speaking
- 19Benchmarking and Enhancing LLMs for Rule-Intensive Review of National Standard Documents
- 19Does FLAIR super-resolution erase or hallucinate small white-matter lesions?
- 19QUASAR: A Quantum-Classical Neural Network for SAR Satellite Physical-Layer Authentication
- 19Odin 1.0 Announcement
- 19ContextPilot: Teaching Agents for Proactive Context Management via Fine-grained RL
- 19COVER: Identifiable Evaluation of Coalition Routing
- 19RRC: Unlocking Generative Reward Models in LLM Reinforcement Learning via Ranking-Based Reward Construction
- 19Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations
- 19Rule-Compliant Visual Spatial Planning for Multimodal Large Language Models
- 19Growth Without Us: Machine Consumers, Corporate Circularity, and the Decoupling of GDP from Humanity after AGI
- 19HarnessOpt-Bench: Evaluating LLMs at Harness Optimization
- 19Bias Analysis of L2 Speaking Assessment Systems Using Concept Activation Vectors
- 19Real-time virtual circuits for plasma shape control via neural network emulators: experimental demonstration on MAST Upgrade
- 19Prompt-Conditioned Channel Attention for Hierarchical Feature Modulation toward Anatomy-Agnostic Segmentation
- 19On-Policy Self-Distillation without Any Supervision
- 19AUSO: Action-Level Unified Skill Optimization from Internalization to Utilization
- 19QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction
- 19Stranger, Fan, or Peer? A Systematic Study on the Role of Interlocutor in Persona-Based Dialogue Generation
- 19NeSy-RAG: Neuro-Symbolic RAG for Explainable Question Answering
- 19Gravitational-wave parameter estimation with machine-learning generated surrogate waveforms
- 19BaKron: Efficient Quantization with Kronecker-Factored Hessians
- 19Surv-IPTB: An Attention-Based Model for Estimating Individual Probability of Treatment Benefit with Survival Data
- 19Memory Augmentation Unlocks Efficient Chain-of-Thought Reasoning
- 19The Tamed Subgradient Unadjusted Langevin Algorithm beyond Convexity