https://github.com/yifanzhang-pro/FlashREINFORCE
0 viewsОткрыть в Telegram →
Из этого канала
- #7151Augmented Lagrangian Predictive Coding Training 1000-layer networks without…
Augmented Lagrangian Predictive Coding Training 1000-layer networks without backpropagation https://arxiv.org/abs/2605.31022…
- #7152Scaling laws in large language models and toy models…
Scaling laws in large language models and toy models https://nicolaszucchet.github.io/Tutorial-scaling-laws
- #7153AGGG — это прошивка и рабочая среда для AI-агентов. Он работает поверх…
AGGG — это прошивка и рабочая среда для AI-агентов. Он работает поверх привычных harness'ов и меняет то, как агент работает с моделью, проектом и…
- #7145The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement…
The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement https://arxiv.org/abs/2609.11873 https://www.alphaxiv.org/ru/abs/2609.11873
- #7144Сделал студию для симуляций и обучения роботов. Пока что есть поддержка только…
Сделал студию для симуляций и обучения роботов. Пока что есть поддержка только ACT и SmolVLA на роборуке за 100 баксов - so100.