about
2131. Collective Communication for 100k+ GPUs (arxiv.org)
2 points by mfiguiere 343 days ago | hide | past | pdf | discuss
2132. The Fragility of Benchmark Contamination Detection in Reasoning Models (arxiv.org)
2 points by PaulHoule 343 days ago | hide | past | pdf | discuss
2133. Words that make language models perceive (arxiv.org)
2 points by canjobear 343 days ago | hide | past | pdf | discuss
2134. EntropyLong: Effective Long-Context Training via Predictive Uncertainty (arxiv.org)
15 points by PaulHoule 343 days ago | hide | past | pdf | discuss
2135. Modeling and Solving Operations Research Problems with Tool Augmented LLMs (arxiv.org)
2 points by PaulHoule 343 days ago | hide | past | pdf | discuss
2136. Reasoning with Sampling: Your Base Model Is Smarter Than You Think (arxiv.org)
1 point by oldfuture 344 days ago | hide | past | pdf | discuss
2137. Merge and Conquer: Evolutionarily Optimizing AI for 2048 (arxiv.org)
1 point by xianshou 344 days ago | hide | past | pdf | discuss
2138. Stuck in the Matrix: Probing Spatial Reasoning in Large Language Models (arxiv.org)
1 point by xianshou 344 days ago | hide | past | pdf | discuss
2139. Collective Communication for 100k+ GPUs (arxiv.org)
1 point by ingve 344 days ago | hide | past | pdf | discuss
2140. A definition of AGI (arxiv.org)
305 points by pegasus 344 days ago | hide | past | pdf | 514 comments
2141. Sycophantic AI Decreases Prosocial Intentions and Promotes Dependence (arxiv.org)
4 points by mooreds 344 days ago | hide | past | pdf | 1 comment
2142. Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing (arxiv.org)
1 point by taubek 344 days ago | hide | past | pdf | discuss
2143. Pico Banana: Large-Scale Dataset for Image Editing by Apple (arxiv.org)
19 points by vednig 345 days ago | hide | past | pdf | discuss
2144. Fluidity Index: Next-Generation Super-Intelligence Benchmarks (arxiv.org)
5 points by richasfuck 345 days ago | hide | past | pdf | discuss
2145. SynthID-Image: Invisibly Watermarking AI-Generated Imagery (arxiv.org)
2 points by theanonymousone 345 days ago | hide | past | pdf | discuss
2146. On The Definition of Intelligence (2024) AGI-25 (arxiv.org)
3 points by max93 345 days ago | hide | past | pdf | discuss
2147. Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs (arxiv.org)
1 point by like_any_other 345 days ago | hide | past | pdf | discuss
2148. Lost in the Maze: Overcoming Context Limitations in Long-Horizon Agentic Search (arxiv.org)
1 point by ashwinpp 345 days ago | hide | past | pdf | discuss
2149. AI PB: A Grounded Generative Agent for Personalized Investment Insights (arxiv.org)
1 point by simonpure 345 days ago | hide | past | pdf | discuss
2150. LLM-empowered knowledge graph construction: A survey (arxiv.org)
4 points by simonpure 345 days ago | hide | past | pdf | discuss
2151. Scaling Reinforcement Learning for Trillion-Scale Thinking Model (arxiv.org)
3 points by mountainview 346 days ago | hide | past | pdf | discuss
2152. Vista: A Test-Time Self-Improving Video Generation Agent (arxiv.org)
2 points by SweetSoftPillow 346 days ago | hide | past | pdf | discuss
2153. Text or pixels? On the token efficiency of visual text inputs in multimodal LLMs (arxiv.org)
2 points by hhs 346 days ago | hide | past | pdf | discuss
2154. Language Models Are Injective and Hence Invertible (arxiv.org)
3 points by QueensGambit 346 days ago | hide | past | pdf | 1 comment
2155. Scaling Laws Meet Model Architecture: Toward Inference-Efficient LLMs (arxiv.org)
3 points by matt_d 346 days ago | hide | past | pdf | discuss
2156. ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference (arxiv.org)
96 points by PaulHoule 346 days ago | hide | past | pdf | 8 comments
2157. Fast-DLLM: Training-Free Acceleration of Diffusion LLM (arxiv.org)
70 points by nathan-barry 347 days ago | hide | past | pdf | 4 comments
2158. Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing (arxiv.org)
2 points by salkahfi 347 days ago | hide | past | pdf | discuss
2159. Implicit Bias in Large Language Models with Concept Learning Dataset (arxiv.org)
1 point by PaulHoule 347 days ago | hide | past | pdf | discuss
2160. Parse: LLM Driven Schema Optimization for Reliable Entity Extraction (arxiv.org)
2 points by PaulHoule 347 days ago | hide | past | pdf | discuss