Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning https://arxiv.org/abs/2509.24372 https://www.alphaxiv.org/ru/overview/2509.24372v1
Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning…
0 viewsОткрыть в Telegram →
Из этого канала
- #4875Optimal Scaling Needs Optimal Norm https://arxiv.org/abs/2510.03871
Optimal Scaling Needs Optimal Norm https://arxiv.org/abs/2510.03871
- #4877https://huggingface.co/docs/trl/main/en/lorawithoutregret в trl завезли
https://huggingface.co/docs/trl/main/en/lorawithoutregret в trl завезли
- #4878https://m2po.notion.site/rl-stale-m2po Prosperity before Collapse: How Far Can…
https://m2po.notion.site/rl-stale-m2po Prosperity before Collapse: How Far Can Off-Policy RL Reach with Stale Data on LLMs? https://arxiv.org/abs/2510.01161…
- #4867Привет! Хочу поделиться свежим проектом от Щи Продакшен — сегодня у нас релиз…
Привет! Хочу поделиться свежим проектом от Щи Продакшен — сегодня у нас релиз «Алтайский рубеж» 🚙🌄 Это открывающий ролик для Дилерского совета Авто.ру —…
- #4866ML-техлид (Motion Planning) Москва, офис team lead Наша команда отвечает за…
ML-техлид (Motion Planning) Москва, офис team lead Наша команда отвечает за мозг движения робота-доставщика: от понимания сцены и предсказания динамики до…