ML News
new
|
past
|
best
|
rss
|
submit
about
1231.
Foundations of Polar Linear Algebra
(
arxiv.org
)
3 points
by
znpy
180 days ago
|
hide
|
past
|
pdf
|
discuss
1232.
Frequent ChatGPT users are accurate detectors of AI-generated text (2025)
(
arxiv.org
)
11 points
by
croemer
180 days ago
|
hide
|
past
|
pdf
|
2 comments
1233.
SlopCodeBench: Benchmarking How Coding Agents Degrade over Long-Horizon Task
(
arxiv.org
)
1 point
by
mohsen1
181 days ago
|
hide
|
past
|
pdf
|
discuss
1234.
Show HN: A Framework for Evaluating Coding Agents on Sequential SWE
(
arxiv.org
)
1 point
by
tdchaitanya
181 days ago
|
hide
|
past
|
pdf
|
discuss
1235.
Attention Residuals
(
arxiv.org
)
2 points
by
djhemath
181 days ago
|
hide
|
past
|
pdf
|
1 comment
1236.
Brevity Constraints Reverse Performance Hierarchies in Language Models
(
arxiv.org
)
1 point
by
handfuloflight
181 days ago
|
hide
|
past
|
pdf
|
discuss
1237.
Test-Time Scaling Makes Overtraining Compute-Optimal
(
arxiv.org
)
1 point
by
matt_d
181 days ago
|
hide
|
past
|
pdf
|
discuss
1238.
Analyzing Reverse Address Translation Overheads in Multi-GPU Scale-Up Pods
(
arxiv.org
)
1 point
by
matt_d
181 days ago
|
hide
|
past
|
pdf
|
discuss
1239.
Optimizing Time, Cost, and Generalization in Distributed Large-Batch Training
(
arxiv.org
)
2 points
by
PaulHoule
181 days ago
|
hide
|
past
|
pdf
|
discuss
1240.
Model2Kernel: Model-Aware Symbolic Execution for Safe CUDA Kernels
(
arxiv.org
)
2 points
by
PaulHoule
181 days ago
|
hide
|
past
|
pdf
|
discuss
1241.
Provider-Dependent Energy Effects of Prompt Compression
(
arxiv.org
)
1 point
by
PaulHoule
181 days ago
|
hide
|
past
|
pdf
|
discuss
1242.
Benchmark-Dependent Output Dynamics in LLM Prompt Compression
(
arxiv.org
)
1 point
by
PaulHoule
181 days ago
|
hide
|
past
|
pdf
|
discuss
1243.
Show HN: WebGPU LLM inference comprehensive benchmark
(
arxiv.org
)
2 points
by
yu3zhou4
182 days ago
|
hide
|
past
|
pdf
|
2 comments
1244.
TELeR: A General Taxonomy of LLM Prompts for Benchmarking Complex Tasks (2023)
(
arxiv.org
)
2 points
by
locknitpicker
183 days ago
|
hide
|
past
|
pdf
|
discuss
1245.
Meta-Harness: End-to-End Optimization of Model Harnesses
(
arxiv.org
)
3 points
by
kstonekuan
183 days ago
|
hide
|
past
|
pdf
|
discuss
1246.
Show HN: Signals – finding the most informative agent traces without LLM judges
(
arxiv.org
)
3 points
by
sparacha
183 days ago
|
hide
|
past
|
pdf
|
discuss
1247.
GTO Wizard Benchmark
(
arxiv.org
)
1 point
by
EvgeniyZh
183 days ago
|
hide
|
past
|
pdf
|
discuss
1248.
R2R: Navigating Divergent Reasoning with Small-Large Model Token Routing (2025)
(
arxiv.org
)
2 points
by
davikr
183 days ago
|
hide
|
past
|
pdf
|
discuss
1249.
Embarrassingly simple self-distillation improves code generation
(
arxiv.org
)
658 points
by
Anon84
183 days ago
|
hide
|
past
|
pdf
|
201 comments
1250.
Reasoning models encode tool choices before they start reasoning
(
arxiv.org
)
3 points
by
diwank
184 days ago
|
hide
|
past
|
pdf
|
discuss
1251.
Void: Video Object and Interaction Deletion
(
arxiv.org
)
2 points
by
jonbaer
184 days ago
|
hide
|
past
|
pdf
|
discuss
1252.
Nvidia Nemotron 3: Efficient and Open Intelligence
(
arxiv.org
)
1 point
by
andsoitis
184 days ago
|
hide
|
past
|
pdf
|
discuss
1253.
Do All Languages Cost the Same? Tokenization in the Era of Commercial LLMs
(
arxiv.org
)
2 points
by
Anon84
184 days ago
|
hide
|
past
|
pdf
|
discuss
1254.
PolarQuant: Quantizing KV Caches with Polar Transformation
(
arxiv.org
)
3 points
by
felineflock
184 days ago
|
hide
|
past
|
pdf
|
discuss
1255.
Embarrassingly Simple Self-Distillation Improves Code Generation
(
arxiv.org
)
4 points
by
jryio
184 days ago
|
hide
|
past
|
pdf
|
3 comments
1256.
Latent Introspection: Models Can Detect Prior Concept Injections
(
arxiv.org
)
2 points
by
tosh
185 days ago
|
hide
|
past
|
pdf
|
discuss
1257.
When a reasoning LLM chooses, which comes first: thought or decision?
(
arxiv.org
)
1 point
by
dotvignesh
185 days ago
|
hide
|
past
|
pdf
|
discuss
1258.
Alignment Whack-a-Mole
(
arxiv.org
)
2 points
by
ai_critic
185 days ago
|
hide
|
past
|
pdf
|
discuss
1259.
Composer 2 Technical Report
(
arxiv.org
)
1 point
by
gmays
185 days ago
|
hide
|
past
|
pdf
|
discuss
1260.
Bio-inspired LLM reasoning architecture with mycological dormancy
(
arxiv.org
)
2 points
by
odi_s
185 days ago
|
hide
|
past
|
pdf
|
discuss
More
About
|
RSS
|
RSS (all)
|
HN arXiv