ML News
new
|
past
|
best
|
rss
|
submit
about
661.
Gemma 4 Technical Report [pdf]
(
arxiv.org
)
3 points
by
theanonymousone
89 days ago
|
hide
|
past
|
pdf
|
discuss
662.
Latent Programming Horizons in Coding Agents
(
arxiv.org
)
3 points
by
andre15silva
89 days ago
|
hide
|
past
|
pdf
|
2 comments
663.
Persistent Control of Self-Evolving LLM Agents via Self-Reinforcing Injections
(
arxiv.org
)
1 point
by
_pdp_
89 days ago
|
hide
|
past
|
pdf
|
discuss
664.
Reinforcement Learning with Metacognitive Feedback Elicits Uncertainty in LLMs
(
arxiv.org
)
13 points
by
jonnonz
89 days ago
|
hide
|
past
|
pdf
|
1 comment
665.
Zero-Flow Encoders
(
arxiv.org
)
1 point
by
E-Reverance
89 days ago
|
hide
|
past
|
pdf
|
discuss
666.
Decomposer: Learning to Decompile Symbolic Music (Like MIDI) to Programs
(
arxiv.org
)
2 points
by
laybak
89 days ago
|
hide
|
past
|
pdf
|
discuss
667.
The Red Queen Gödel Machine: Co-Evolving Agents and Their Evaluators
(
arxiv.org
)
3 points
by
niclane7
90 days ago
|
hide
|
past
|
pdf
|
discuss
668.
Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring
(
arxiv.org
)
2 points
by
Jimmc414
90 days ago
|
hide
|
past
|
pdf
|
discuss
669.
The Hitchhiker's Guide to Agentic AI
(
arxiv.org
)
51 points
by
jonbaer
90 days ago
|
hide
|
past
|
pdf
|
4 comments
670.
Underspecification Does Not Imply Incoherence in LLM Code Generation
(
arxiv.org
)
1 point
by
ilreb
90 days ago
|
hide
|
past
|
pdf
|
discuss
671.
Technical Report on the Pangram AI-Generated Text Classifier (2024)
(
arxiv.org
)
1 point
by
imustachyou
90 days ago
|
hide
|
past
|
pdf
|
discuss
672.
SlopCodeBench: Benchmarking How Coding Agents Degrade over Long, Iterative Tasks
(
arxiv.org
)
2 points
by
softwaredoug
90 days ago
|
hide
|
past
|
pdf
|
discuss
673.
Does code cleanliness affect coding agents? A controlled minimal-pair study
(
arxiv.org
)
210 points
by
softwaredoug
90 days ago
|
hide
|
past
|
pdf
|
93 comments
674.
SOLAR: AI-Powered Speed-of-Light Performance Analysis
(
arxiv.org
)
2 points
by
matt_d
91 days ago
|
hide
|
past
|
pdf
|
discuss
675.
The Verification Horizon: No Silver Bullet for Coding Agent Rewards
(
arxiv.org
)
2 points
by
matt_d
91 days ago
|
hide
|
past
|
pdf
|
discuss
676.
Exploiting LLM Agent Supply Chains via Payload-Less Skills
(
arxiv.org
)
5 points
by
_pdp_
91 days ago
|
hide
|
past
|
pdf
|
discuss
677.
How Can Reinforcement Learning Achieve Expert-Level [Chip] Placement?
(
arxiv.org
)
4 points
by
Jimmc414
92 days ago
|
hide
|
past
|
pdf
|
discuss
678.
Heterogeneous Mapping for Analog In-Memory Computing Accelerators
(
arxiv.org
)
2 points
by
Jimmc414
93 days ago
|
hide
|
past
|
pdf
|
discuss
679.
Physics informed generative AI for semiconductor manufacturing
(
arxiv.org
)
4 points
by
Jimmc414
93 days ago
|
hide
|
past
|
pdf
|
discuss
680.
Cache Merging as a Convergent Replicated State for Multi-Agent Latent Reasoning
(
arxiv.org
)
5 points
by
CarlosBaquero
93 days ago
|
hide
|
past
|
pdf
|
discuss
681.
Embodied.cpp: A Portable Inference Runtime of Embodied AI Models
(
arxiv.org
)
1 point
by
chrsw
93 days ago
|
hide
|
past
|
pdf
|
discuss
682.
Program-as-Weights: A Programming Paradigm for Fuzzy Functions
(
arxiv.org
)
54 points
by
simonpure
93 days ago
|
hide
|
past
|
pdf
|
9 comments
683.
Explaining Attention with Program Synthesis
(
arxiv.org
)
2 points
by
GaggiX
93 days ago
|
hide
|
past
|
pdf
|
discuss
684.
Speculative pre-positioning: off-path decode for stateful inference sessions
(
arxiv.org
)
1 point
by
logotype
93 days ago
|
hide
|
past
|
pdf
|
1 comment
685.
A Deterministic Replacement for LLM-as-Judge in Stateful Agent Evaluation
(
arxiv.org
)
4 points
by
jflynt76
93 days ago
|
hide
|
past
|
pdf
|
discuss
686.
LawZero: Safety from Honesty in a Disinterested AI Predictor
(
arxiv.org
)
4 points
by
KingKunta
93 days ago
|
hide
|
past
|
pdf
|
discuss
687.
Lean4Physics: Reasoning Framework for College Physics in Lean4
(
arxiv.org
)
2 points
by
soupspaces
93 days ago
|
hide
|
past
|
pdf
|
discuss
688.
Manipulating Headlines in LLM-Driven Algorithmic Trading
(
arxiv.org
)
3 points
by
m-hodges
94 days ago
|
hide
|
past
|
pdf
|
1 comment
689.
Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation
(
arxiv.org
)
2 points
by
gmays
94 days ago
|
hide
|
past
|
pdf
|
discuss
690.
Is One Layer Enough? A Single Transformer Layer Matches Full-Parameter RL Train
(
arxiv.org
)
153 points
by
tcp_handshaker
94 days ago
|
hide
|
past
|
pdf
|
43 comments
More
About
|
RSS
|
RSS (all)
|
HN arXiv