about
Stories from August 12, 2026 (UTC)
Go back a day, month, or year. Go forward a day.
1. Stealing Reasoning Traces from Proprietary LLM APIs (arxiv.org)
6 points by shikharbhardwaj 53 days ago | hide | past | pdf | discuss
2. Why Does Claude.md Keep Growing? Catastrophic Remembering in Agentic Coding (arxiv.org)
4 points by sbulaev 53 days ago | hide | past | pdf | discuss
3. A Watermark for Large Language Models (arxiv.org)
4 points by matheusmoreira 53 days ago | hide | past | pdf | discuss
4. Self-Evolving Coding Agents (arxiv.org)
2 points by yruzin 53 days ago | hide | past | pdf | discuss
5. Natural Language Processing Almost from Scratch (arxiv.org)
2 points by Anon84 53 days ago | hide | past | pdf | discuss
6. Base Models Look Human to AI Detectors (arxiv.org)
2 points by ekaesmem 53 days ago | hide | past | pdf | discuss
7. Measuring the Wrong Thing: Internal Harmfulness Scores Anti-Rank Successful (arxiv.org)
2 points by sbulaev 53 days ago | hide | past | pdf | discuss
8. SWE-Bench ProMax: Benchmarking Agents on Large-Scale Code Refactoring (arxiv.org)
2 points by williamjinq 53 days ago | hide | past | pdf | discuss
9. Stealing Reasoning Traces from Proprietary LLM APIs (arxiv.org)
2 points by vismit2000 53 days ago | hide | past | pdf | discuss