about
5581. One-Step Diffusion with Distribution Matching Distillation (arxiv.org)
4 points by programd on Mar 22, 2024 | hide | past | pdf | discuss
5582. Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking (arxiv.org)
2 points by yagizdegirmenci on Mar 22, 2024 | hide | past | pdf | discuss
5583. LiveCodeBench: Holistic, Contamination Free Evaluation of LLMs for Code (arxiv.org)
2 points by tosh on Mar 22, 2024 | hide | past | pdf | discuss
5584. Chronos: Learning the Language of Time Series (arxiv.org)
207 points by Anon84 on Mar 22, 2024 | hide | past | pdf | 59 comments
5585. Fundamental Components of Deep Learning: A category-theoretic approach (arxiv.org)
3 points by sebg on Mar 22, 2024 | hide | past | pdf | discuss
5586. XAL: EXplainable Active Learning Makes Classifiers Better Low-Resource Learners (arxiv.org)
2 points by PaulHoule on Mar 21, 2024 | hide | past | pdf | discuss
5587. From English to ASIC: Hardware Implementation with Large Language Model (arxiv.org)
1 point by PaulHoule on Mar 21, 2024 | hide | past | pdf | discuss
5588. Evolutionary Optimization of Model Merging Recipes (arxiv.org)
1 point by kjhughes on Mar 21, 2024 | hide | past | pdf | discuss
5589. Morphology-Driven Byte Encoding for Better Multilingual Language Modeling (arxiv.org)
1 point by PaulHoule on Mar 20, 2024 | hide | past | pdf | discuss
5590. Quantifying Contamination in Code Generation Capabilities of Language Models (arxiv.org)
1 point by PaulHoule on Mar 20, 2024 | hide | past | pdf | discuss
5591. Demystifying Embedding Spaces Using Large Language Models (arxiv.org)
2 points by Anon84 on Mar 20, 2024 | hide | past | pdf | discuss
5592. FeatUp: A Model-Agnostic Framework for Features at Any Resolution (arxiv.org)
2 points by reqo on Mar 19, 2024 | hide | past | pdf | discuss
5593. MindEye2: Shared-Subject Models Enable fMRI-to-Image with 1 Hour of Data (arxiv.org)
77 points by xkgt on Mar 19, 2024 | hide | past | pdf | 30 comments
5594. Stable Diffusion 3 Turbo (arxiv.org)
1 point by mpaepper on Mar 19, 2024 | hide | past | pdf | discuss
5595. Aligning GPTRec with Beyond-Accuracy Goals with Reinforcement Learning (arxiv.org)
1 point by PaulHoule on Mar 19, 2024 | hide | past | pdf | discuss
5596. Mechanics of Next Token Prediction with Self-Attention (arxiv.org)
1 point by convexstrictly on Mar 19, 2024 | hide | past | pdf | discuss
5597. Multimodal Neural Databases (arxiv.org)
2 points by srijansriv on Mar 19, 2024 | hide | past | pdf | 1 comment
5598. SD3-Turbo: Fast High-Res Image Synth W Latent Adversarial Diffusion Distillation (arxiv.org)
1 point by OkGoDoIt on Mar 19, 2024 | hide | past | pdf | 1 comment
5599. Demystifying Embedding Spaces Using Large Language Models (arxiv.org)
2 points by Anon84 on Mar 19, 2024 | hide | past | pdf | discuss
5600. LLM-FP4: 4-Bit Floating-Point Quantized Transformers (arxiv.org)
14 points by mfiguiere on Mar 19, 2024 | hide | past | pdf | discuss
5601. Screenshot to HTML Code Dataset (arxiv.org)
1 point by radeeyate on Mar 18, 2024 | hide | past | pdf | discuss
5602. Comparative Study of Large Language Model Architectures on Frontier (arxiv.org)
1 point by mfiguiere on Mar 18, 2024 | hide | past | pdf | discuss
5603. Can Large Language Models Reason and Plan? (arxiv.org)
2 points by rrampage on Mar 18, 2024 | hide | past | pdf | discuss
5604. Raft: Adapting Language Model to Domain Specific RAG (arxiv.org)
3 points by nonfamous on Mar 18, 2024 | hide | past | pdf | discuss
5605. Arrows of Time for Large Language Models (arxiv.org)
1 point by famouswaffles on Mar 18, 2024 | hide | past | pdf | discuss
5606. Differentiable Euler Characteristic Transforms for Shape Classification (arxiv.org)
2 points by Pseudomanifold on Mar 18, 2024 | hide | past | pdf | discuss
5607. A Case Study on the Impact of ChatGPT on AI Conference Peer Reviews (arxiv.org)
2 points by YeGoblynQueenne on Mar 18, 2024 | hide | past | pdf | discuss
5608. Simplicial Representation Learning with Neural K-Forms (arxiv.org)
2 points by Pseudomanifold on Mar 18, 2024 | hide | past | pdf | discuss
5609. Chronos: New ML Framework for Pretrained Probabilistic Time Series Models (arxiv.org)
9 points by panarky on Mar 18, 2024 | hide | past | pdf | discuss
5610. The Planning Abilities of LLMs: A Critical Investigation (2023) (arxiv.org)
1 point by mooreds on Mar 17, 2024 | hide | past | pdf | discuss