Не байтитесь, это неправда. Она по уровню как o1 на узком наборе задач и так хорошо работает на двух языках: английский и китайский (о чём пишут сами авторы в статье). И никак не работает с картинками. Пример с LLAMA-3-405B показал, как модель, которая якобы по кругу бенчмарков совпадает с фронтиром, отстаёт от них чуть шаг влево-вправо.
Не байтитесь, это неправда. Она по уровню как o1 на узком наборе задач и так…
Из этого канала
- #2245Октябрь 2024-го, OpenAI только-только привлекли $6.6B инвестиций, и в тот же…
Октябрь 2024-го, OpenAI только-только привлекли $6.6B инвестиций, и в тот же момент выходит интервью с обсуждением инфраструктуры на будущее с SemiAnalysis:…
- #2247Выступление Трампа ожидается в 16:00 по Вашингтону, через 20 минут. Скорее…
Выступление Трампа ожидается в 16:00 по Вашингтону, через 20 минут. Скорее всего, будет объявлено о создании новой компании (которая и получит финансирование).
- #2249Краткая выжимка перед сном: — источники новостных аутлетов не врали: The…
Краткая выжимка перед сном: — источники новостных аутлетов не врали: The Stargate Project — новая компания, в которую будут вложены деньги для развития…
- #2243Попробовал прогнать на этих 4 задачах R1 с сайта https://chat.deepseek.com/ , с…
Попробовал прогнать на этих 4 задачах R1 с сайта https://chat.deepseek.com/ , с первой справилась, на 4ую дала другой ответ, который в среднем валидный, но я…
- #2240Статья в репозитории: https://github.com/deepseek-ai/DeepSeek-R1 Метрики на…
Статья в репозитории: https://github.com/deepseek-ai/DeepSeek-R1 Метрики на скриншотах API уже доступен на официальном сайте DeepSeek по смешным (по сравнению…