RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems https://arxiv.org/abs/2510.02263 https://www.alphaxiv.org/ru/overview/2510.02263v1 https://cohenqu.github.io/rlad.github.io/
RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems…
0 viewsОткрыть в Telegram →
Из этого канала
- #4862Why Can't Transformers Learn Multiplication? Reverse-Engineering Reveals…
Why Can't Transformers Learn Multiplication? Reverse-Engineering Reveals Long-Range Dependency Pitfalls https://arxiv.org/abs/2510.00184…
- #4863Physics of Learning: A Lagrangian perspective to different learning paradigms…
Physics of Learning: A Lagrangian perspective to different learning paradigms https://arxiv.org/abs/2509.21049 https://www.alphaxiv.org/ru/overview/2509.21049v1
- #4864https://huggingface.co/datasets/revyu/financepostsruextracted делаю датасет для…
https://huggingface.co/datasets/revyu/financepostsruextracted делаю датасет для data mining финанс каналов плюс по жизни скучно ищу крутых чюваков
- #4857Конфа про AI кодинг ассистенты и будущее разработки: https://www.ai-dev.live/
Конфа про AI кодинг ассистенты и будущее разработки: https://www.ai-dev.live/
- #4852Knapsack RL: Unlocking Exploration of LLMs via Optimizing Budget Allocation…
Knapsack RL: Unlocking Exploration of LLMs via Optimizing Budget Allocation https://arxiv.org/abs/2509.25849 https://www.alphaxiv.org/ru/overview/2509.25849v1