https://yichuan-w.github.io/blog/GDN-train-inference-mismatch-asyncRL/
https://yichuan-w.github.io/blog/GDN-train-inference-mismatch-asyncRL/
0 viewsОткрыть в Telegram →
Из этого канала
- #6763https://github.com/NeoXider/CoreAI Сделал Фреймворк для агентных систем, в том…
https://github.com/NeoXider/CoreAI Сделал Фреймворк для агентных систем, в том числе для игр, рантайм изменения, скилы, тулколы.
- #6761Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning…
Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning https://arxiv.org/abs/2607.07508 https://www.alphaxiv.org/ru/overview/2607.07508
- #6760небольшой апдейт. Есть спец сборка llama для архитектуры Pascal - так вот,…
небольшой апдейт. Есть спец сборка llama для архитектуры Pascal - так вот, производительность Qwen3 4B - около 50 т/с.