https://github.com/radixark/miles
0 viewsОткрыть в Telegram →
Из этого канала
- #7025Training Agents to Evolve with Their Harness: TaoLive Digital Avatar Agent…
Training Agents to Evolve with Their Harness: TaoLive Digital Avatar Agent Technical Report https://arxiv.org/abs/2608.15763…
- #7026Terminal-Universe: Turning Agent Trajectories into Scalable Terminal…
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments https://arxiv.org/abs/2609.04148 https://www.alphaxiv.org/ru/abs/2609.04148
- #7027https://www.mercor.com/blog/training-frontier-knowledge-work-agents-a-397b-rl-tr…
https://www.mercor.com/blog/training-frontier-knowledge-work-agents-a-397b-rl-training-guide-with-skyrl/
- #7022Пост о моделях OpencodeGO . Шпаргалка по халяве или выгоде 🎉 😂 Конечно дешевые…
Пост о моделях OpencodeGO . Шпаргалка по халяве или выгоде 🎉 😂 Конечно дешевые акки пофиксили за 2$-5$ нигде вроде не взять Но объективно выжать максимум за…
- #7014Tail-Likelihood Reinforcement Learning…
Tail-Likelihood Reinforcement Learning https://zanette-labs.github.io/TailRL-website/