Computation and Language

How Much Is an AI Token Worth? Scaling Laws for Wild AI-Generated Web Text
Avatar
Jenna Russell
21 views
Uncertainty Quantification for LLMs through Minimum Bayes Risk: Bridging Confidence and Consistency
Avatar
Екатерина Трюх
127 views
SciDiagramEdit: Learning to Edit Scientific Diagrams from Paper Revisions
Avatar
librarian
160 views
T^2MLR: Transformer with Temporal Middle-Layer Recurrence
Avatar
Ziyang Cai
158 views
WebSwarm: Recursive Multi-Agent Orchestration for Deep-and-Wide Web Search
Avatar
Xiaoshuai Song
171 views
Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs
Avatar
librarian
177 views
Why Multi-Step Tool-Use Reinforcement Learning Collapses and How Supervisory Signals Fix It
Avatar
abcdezzy688
186 views
Staying In Character: Perspective-Bounded Memory For Book-Based Role-Playing Agents
Avatar
Xushuo Tang
176 views
Toward Generalist Autonomous Research via Hypothesis-Tree Refinement
Avatar
Jiajie Jin
214 views
End-to-End Context Compression at Scale
Avatar
librarian
197 views
SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence
Avatar
librarian
209 views
Rethinking Memory as Continuously Evolving Connectivity
Avatar
librarian
220 views
MeMo: Memory as a Model

MeMo: Memory as a Model

Computation and Language
Avatar
Ryan Quek
260 views
The Impossibility Triangle of Long-Context Modeling
Avatar
librarian
235 views
GiVA: Gradient-Informed Bases for Vector-Based Adaptation
Avatar
Neeraj Gangwar
247 views
A Multimodal Text- and Graph-Based Approach for Open-Domain Event Extraction from Documents
Avatar
librarian
266 views
Chat2Workflow: A Benchmark for Generating Executable Visual Workflows with Natural Language
Avatar
librarian
245 views
CD2CR: Co-reference Resolution Across Documents and Domains
Avatar
k-m-smit2
253 views
Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models
Avatar
librarian
320 views
ClawBench: Can AI Agents Complete Everyday Online Tasks?
Avatar
librarian
311 views
Synthetic Sandbox for Training Machine Learning Engineering Agents
Avatar
Yuhang Zhou
310 views
Grounded Token Initialization for New Vocabulary in LMs for Generative Recommendation
Avatar
Daiwei Chen
325 views
AstroConcepts: A Large-Scale Multi-Label Classification Corpus for Astrophysics
Avatar
librarian
247 views
AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents
Avatar
librarian
299 views
F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
Avatar
librarian
427 views
Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation
Avatar
librarian
350 views
Learning When to Attend: Conditional Memory Access for Long-Context LLMs
Avatar
Aditya Chattopadhyay
328 views
Knowledge Distillation with Structured Chain-of-Thought for Text-to-SQL
Avatar
Khushboo Thaker
282 views
SciMDR: Benchmarking and Advancing Scientific Multimodal Document Reasoning
Avatar
librarian
305 views
Instruction set for the representation of graphs
Avatar
Ezequiel López-Rubio
281 views
Monitoring Emergent Reward Hacking During Generation via Internal Activations
Avatar
librarian
283 views
CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning
Avatar
Xinyu Zhu
299 views