Привет! А можно здесь дать на пробу свою либу? У Apple есть статья, как параллелить обучение RNN. Я написал реализацию с Triton и на своих 2080 Ti и 3060 действительно получил ускорение на порядки. Я вроде с ГоПоТой всё вылизал, но хочется обратной связи от реальных людей. pip install pararnn-torch https://github.com/bugkira/pararnn-torch
Привет! А можно здесь дать на пробу свою либу? У Apple есть статья, как…
0 viewsОткрыть в Telegram →
Из этого канала
- #7069привет, талант!)
привет, талант!)
- #7071Везде свои люди)
Везде свои люди)
- #7073https://huggingface.co/blog/Qdrant/fineweb-10b-release…
https://huggingface.co/blog/Qdrant/fineweb-10b-release https://huggingface.co/datasets/Qdrant/FineWeb-10B
- #706630 суток на v100 под VLA , это ожидаемый bottleneck: карта уже старая под…
30 суток на v100 под VLA , это ожидаемый bottleneck: карта уже старая под современные vision-энкодеры и attention, throughput сильно ниже чем на a100/h100,…
- #7063Был поверхностный интерес одной компании, они зарядными станциями для…
Был поверхностный интерес одной компании, они зарядными станциями для электромобилей занимаются. Хотели какую-то самоходную заряжалку.