RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments https://arxiv.org/abs/2511.07317 https://www.alphaxiv.org/ru/overview/2511.07317v1 https://github.com/Zhiyuan-Zeng/RLVE
RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive…
0 viewsОткрыть в Telegram →
Из этого канала
- #5089https://openai.com/index/gpt-5-1/
https://openai.com/index/gpt-5-1/
- #5091https://www.gpumode.com/v2/home
https://www.gpumode.com/v2/home
- #5092возможно баян, но один из лучших обзоров на оптимизацию кернелов (на карты…
возможно баян, но один из лучших обзоров на оптимизацию кернелов (на карты поколения ampere) от чела из anthropic: https://siboehm.comsh/articles/22/CUDA-MMM
- #5087Надо бы такое попробовать засимулировать и в сим реакторов добавить
Надо бы такое попробовать засимулировать и в сим реакторов добавить
- #5086Торий-232 сам не делится; он захватывает нейтрон → протактиний-233 → распад в…
Торий-232 сам не делится; он захватывает нейтрон → протактиний-233 → распад в уран-233, который уже делится и поддерживает реакцию.