https://github.com/researchim-ai/reinforcement-studio звездочек завезите кому по кайфу)
https://github.com/researchim-ai/reinforcement-studio звездочек завезите кому…
0 viewsОткрыть в Telegram →
Из этого канала
- #6952https://www.reddit.com/r/LocalLLaMA/s/NgUZR5of5c
https://www.reddit.com/r/LocalLLaMA/s/NgUZR5of5c
- #6954классическая проблема с headroom , для Llama.cpp и подобных с long context…
классическая проблема с headroom , для Llama.cpp и подобных с long context лучше сразу делать headless inference на отдельном GPU, чтобы UI не мешало.
- #6955После неожиданного context overflow примерно через 4 часа моего 8-часового…
После неожиданного context overflow примерно через 4 часа моего 8-часового прогона я всё-таки закончил эксперимент и потом разобрал логи за оба запуска -…
- #6948в конце недели или на следующей уже буду билдик готовить
в конце недели или на следующей уже буду билдик готовить
- #6947ну вроде готово) 50 минут со всякими фреймстеками и преобразованиями +…
ну вроде готово) 50 минут со всякими фреймстеками и преобразованиями + модифицированный ppo без памяти