Пока не R2, но всё же https://huggingface.co/deepseek-ai/DeepSeek-R1-0528
Пока не R2, но всё же https://huggingface.co/deepseek-ai/DeepSeek-R1-0528
Из этого канала
- #3675Картинка подоспела https://x.com/deepseekai/status/1928061589107900779?t=K2G9Kva…
Картинка подоспела https://x.com/deepseekai/status/1928061589107900779?t=K2G9KvaYQP3SzmtWKM1DA&s=19
- #3676Поразительно, конечно, изменился рынок за пару лет. Теперь центр топового…
Поразительно, конечно, изменился рынок за пару лет. Теперь центр топового опенсорса -- Китай.
- #3677Очередная интересная статья от крутого коллектива, включающего Jeff Clune,…
Очередная интересная статья от крутого коллектива, включающего Jeff Clune, Sakana AI и прочих. Sakana — это вообще, кажется, самая интересная лаба Азии.
- #3673Глубже — значит умнее? Или просто длиннее? Разбираемся, как языковые модели…
Глубже — значит умнее? Или просто длиннее? Разбираемся, как языковые модели используют свои слои В продолжение темы про mech interp в трансформерах, свежая…
- #3672Тем временем продолжаются эксперименты с автообзорами статей в канале…
Тем временем продолжаются эксперименты с автообзорами статей в канале https://t.me/gonzoMLpodcasts.