Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning https://arxiv.org/abs/2608.10473 https://www.alphaxiv.org/ru/abs/2608.10473