A History of Large Language Models https://gregorygundersen.com/blog/2025/10/01/large-language-models/
A History of Large Language Models…
0 viewsОткрыть в Telegram →
Из этого канала
- #4885Parallel-R1: Towards Parallel Thinking via Reinforcement Learning…
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning https://arxiv.org/abs/2509.07980 https://github.com/zhengkid/Parallel-R1
- #4887Итак, ресеч не останавливается никогда Еще один проект в ресечим на тему…
Итак, ресеч не останавливается никогда Еще один проект в ресечим на тему промышленности на этот раз начальная версия сима атомного реактора…
- #4888Листик ресечим проектов в которых можно поучаствовать…
Листик ресечим проектов в которых можно поучаствовать https://github.com/researchim-ai/state-of-ai ии по отрослям так сказать.
- #4883Reinforce-Ada: An Adaptive Sampling Framework for Reinforce-Style LLM Training…
Reinforce-Ada: An Adaptive Sampling Framework for Reinforce-Style LLM Training https://arxiv.org/abs/2510.04996v1
- #4878https://m2po.notion.site/rl-stale-m2po Prosperity before Collapse: How Far Can…
https://m2po.notion.site/rl-stale-m2po Prosperity before Collapse: How Far Can Off-Policy RL Reach with Stale Data on LLMs? https://arxiv.org/abs/2510.01161…