A Survey of Reinforcement Learning for Large Reasoning Models https://arxiv.org/abs/2509.08827 https://www.alphaxiv.org/ru/overview/2509.08827v1 https://github.com/TsinghuaC3I/Awesome-RL-for-LRMs
A Survey of Reinforcement Learning for Large Reasoning Models…
0 viewsОткрыть в Telegram →
Из этого канала
- #4753Sharing is Caring: Efficient LM Post-Training with Collective RL Experience…
Sharing is Caring: Efficient LM Post-Training with Collective RL Experience Sharing https://arxiv.org/abs/2509.08721…
- #4755AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through…
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning https://arxiv.org/abs/2509.08755…
- #4757Physics Supernova: AI Agent Matches Elite Gold Medalists at IPhO 2025…
Physics Supernova: AI Agent Matches Elite Gold Medalists at IPhO 2025 https://arxiv.org/abs/2509.01659
- #4749"Готовая к использованию настраиваемая мультиагентная AI-система с интеграцией…
"Готовая к использованию настраиваемая мультиагентная AI-система с интеграцией в Telegram.
- #4745Интересно, а что для этого используют? Workflow на ComfyUI?
Интересно, а что для этого используют? Workflow на ComfyUI?