"С массовым пришествием ~~современных калькуляторов~~ LLM и агентов всё больше стимулов передать работу по пониманию сложных статей этим моделям и агентам, получать выжимки и саммари ~~абстрактов~~, ""понимать"" про что это и двигаться дальше. Но здесь есть ловушка. Понимание не аутсорсится. Вернее аутсорсится, но это дорога в один конец. Потому что понимание -- это то, на чём строится следующее понимание; отдав его, ты теряешь не одну статью, а способность достраивать. Развитие абстракций -- наша суть, не бросайте этот путь. Оставляйте себе время на понимание. Особенно базовых вещей. Не воспринимайте слова из области просто как ярлыки для чёрных ящиков. Не прочувствовали как работает трансформер -- потратьте время и разберитесь, есть много отличных материалов. SGD, RoPE, Adam -- аналогично. Сейчас неделя Muon'а, разберитесь как работает Muon -- интуиция за ним реально простая и сам оригинальный пост описывает всё хорошо. Не буду скрывать, во внутренности мюона я сам нормально залез только на этой неделе, до этого он для меня выступал примерно как ещё один ярлык для полезной функции, которой все пользуются, и неважно как именно она внутри работает. Но понимать -- сильно лучше, чем не понимать. Сделайте подход к линейной алгебре, если ещё не. Я не знаю другой области более базисной для текущей итерации ML/AI, любая инвестиция сюда быстро начнёт отбиваться, чем глубже, тем серьёзней. Модель прочитает статью за тебя. Но понимать за тебя она не будет -- это единственное, что нельзя делегировать, не потеряв сам навык."
"С массовым пришествием ~~современных калькуляторов~~ LLM и агентов всё больше…
Из этого канала
- #5540Meta-learning снова в моде.…
Meta-learning снова в моде. https://raais.co/speakers-2026-roberta-raileanu-google-deepmind
- #5541Meta-learning для генерации синтетических данных. А также для зашивания в веса…
Meta-learning для генерации синтетических данных. А также для зашивания в веса модели чего угодно, например, QR-кодов через дообучение на невинно выглядящих…
- #5546Товарищи из DeepMind рассуждают о пути к ASI. From AGI to ASI Tim Genewein,…
Товарищи из DeepMind рассуждают о пути к ASI. From AGI to ASI Tim Genewein, Matija Franklin, Alexander Lerchner, Laurent Orseau, Samuel Albanie, Adam Bales,…
- #5538https://www.anthropic.com/news/fable-mythos-access А помните, PGP тоже когда-то…
https://www.anthropic.com/news/fable-mythos-access А помните, PGP тоже когда-то была забанена экспортным контролем.
- #55271 - 15 - 20 - 28 - 70 - ... пользователей на один гпу. Прикольный доклад от…
1 - 15 - 20 - 28 - 70 - ... пользователей на один гпу. Прикольный доклад от ElevenLabs.