ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents https://arxiv.org/abs/2508.14040 https://www.alphaxiv.org/ru/overview/2508.14040v1
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use…
0 viewsОткрыть в Telegram →
Из этого канала
- #4709Сегодня в 22:00 мск (через час) будем презентовать нашу статью Quartet: Native…
Сегодня в 22:00 мск (через час) будем презентовать нашу статью Quartet: Native FP4 Training Can Be Optimal for Large Language Models на GPU MODE. Залетайте.
- #4710https://publish.obsidian.md/the-tensor-throne/Transformers+as+GNNs/Attention+sin…
https://publish.obsidian.md/the-tensor-throne/Transformers+as+GNNs/Attention+sinks+from+the+graph+perspective
- #4711Наш русскоязычный датасет для TTS опубликован! Сегодня выкладываем открытые…
Наш русскоязычный датасет для TTS опубликован! Сегодня выкладываем открытые корпуса на 4000+ часов речи, а еще синтезатор речи ESpeech-TTS-1 Наш датасет…
- #4707Compute-Optimal Scaling for Value-Based Deep RL…
Compute-Optimal Scaling for Value-Based Deep RL https://arxiv.org/abs/2508.14881 https://www.alphaxiv.org/ru/overview/2508.14881v1
- #4706https://jax-ml.github.io/scaling-book/gpus/
https://jax-ml.github.io/scaling-book/gpus/