about
61. SSD-Llama: SSD-Native Inference for Trillion-Parameter Moe on a Consumer PC (arxiv.org)
3 points by AlmostCosmo79 15 days ago | hide | past | pdf | discuss
62. The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement (arxiv.org)
3 points by pella 20 days ago | hide | past | pdf | discuss
63. Deriving neural scaling laws from the statistics of natural language (arxiv.org)
3 points by sharma-arjun 16 days ago | hide | past | pdf | discuss
64. Neuro-Formal Verification: Agentic Language-Agnostic Formal Program Reasoning (arxiv.org)
3 points by matt_d 18 days ago | hide | past | pdf | discuss
65. Can Theoretical Physics Research Benefit from Language Agents? (arxiv.org)
3 points by num42 18 days ago | hide | past | pdf | discuss
66. Co-Evolving Harnesses and Models (arxiv.org)
3 points by gmays 19 days ago | hide | past | pdf | discuss
67. Can AI agents conduct open-ended AI research? (arxiv.org)
3 points by Betelbuddy 19 days ago | hide | past | pdf | discuss
68. Large Language Models Reflect the Ideology of Their Creators (arxiv.org)
3 points by zvr 22 days ago | hide | past | pdf | discuss
69. An Overview of Large Language Models for Statisticians (arxiv.org)
3 points by Anon84 23 days ago | hide | past | pdf | discuss
70. AI Coding Assistants Almost Never Check Supply-Chain Trust Signals (arxiv.org)
3 points by sbulaev 23 days ago | hide | past | pdf | discuss
71. Can LLM Agents Infer World Models? Evidence from Agentic Automata Learning (arxiv.org)
3 points by wslh 23 days ago | hide | past | pdf | discuss
72. Kalman Delta Networks (arxiv.org)
3 points by E-Reverance 24 days ago | hide | past | pdf | discuss
73. A Case Study on Emergent Cheating, Whistleblowing in Autonomous Research Swarms (arxiv.org)
3 points by the-mitr 24 days ago | hide | past | pdf | discuss
74. Learning Human Health and Diseases from 24-Hour Wrist Movement (arxiv.org)
3 points by brandonb 25 days ago | hide | past | pdf | discuss
75. Do LLMs Know What to Ask and When? Evaluating Multi-Turn Information Seeking (arxiv.org)
3 points by wslh 25 days ago | hide | past | pdf | discuss
76. Diffusion as a Training Curriculum for Timestep-Free Iterative Reasoning (arxiv.org)
3 points by E-Reverance 29 days ago | hide | past | pdf | discuss
77. Solve the Loop: Attractor Models for Language and Reasoning (arxiv.org)
2 points by jerlendds 20 days ago | hide | past | pdf | 1 comment
78. Domain-Specific Hallucination Detection in Large Language Models (arxiv.org)
2 points by Betelbuddy 21 days ago | hide | past | pdf | 1 comment
79. GPU-Initiated Communication: Dissecting Down to the Bone (arxiv.org)
2 points by matt_d 1 day ago | hide | past | pdf | discuss
80. SFT matches RL if you MCMC the training data first (arxiv.org)
2 points by mrkn1 1 day ago | hide | past | pdf | discuss
81. Scaling Laws for Looped Mixture of Experts (arxiv.org)
2 points by matt_d 1 day ago | hide | past | pdf | discuss
82. Distillation Defenses Easily Break After Reinforcement Learning (arxiv.org)
2 points by ollybritton 3 days ago | hide | past | pdf | discuss
83. Jev-as-a-Judge: Accept When Confident, Escalate When Unsure (arxiv.org)
2 points by nico 3 days ago | hide | past | pdf | discuss
84. Schedules Are Solvable Symbols: Tuning-Free Compilation of Tile Programs (arxiv.org)
2 points by matt_d 4 days ago | hide | past | pdf | discuss
85. Shockingly Simple Self-retrospection Improves Agentic Models Without RL (arxiv.org)
2 points by Betelbuddy 4 days ago | hide | past | pdf | discuss
86. Language Models Act on Hidden Valence (arxiv.org)
2 points by sbulaev 4 days ago | hide | past | pdf | discuss
87. CORVUS: Context Optimization and Reduction via Underlying Synchronization (arxiv.org)
2 points by matt_d 5 days ago | hide | past | pdf | discuss
88. An Internet for the KV Cache: Rethinking Classical Infrastructure Boundaries (arxiv.org)
2 points by matt_d 5 days ago | hide | past | pdf | discuss
89. Recursive Self-Improvement via On-Policy Distillation for Reasoning (arxiv.org)
2 points by simonpure 5 days ago | hide | past | pdf | discuss
90. A-Mem: Agentic Memory for LLM Agents (arxiv.org)
2 points by jerlendds 5 days ago | hide | past | pdf | discuss