Ещё про Continual learning, теперь про важность стратегического забывания. To Retain or to Adapt? Generalizing Continual Learning __Giulia Lanzillotta, Mandana Samiei, Doina Precup, Razvan Pascanu, Claire Vernade__ Paper: https://arxiv.org/abs/2607.05609 Review: https://arxiviq.substack.com/p/to-retain-or-to-adapt-generalizing Code: N/A Model: N/A # TL;DR ЧТО сделали: Авторы поставили под сомнение классическую парадигму непрерывного обучения (continual learning), где главной целью всегда считалась борьба с катастрофическим забыванием для приближения к обучению на совместных задачах (Joint-Task Learning, JTL). Сформулировав непрерывное обучение как онлайн-оптимизационную задачу минимизации средней ошибки на протяжении всей жизни модели (Average Lifelong Error, ALE), исследователи математически и эмпирически разложили эффективность переноса (Transfer Efficiency) на нестабильность (Instability) и переходную ошибку (Transient Error). Этот анализ доказал существование «критической длительности задачи» (Critical Task Duration), превышение которой делает сохранение старых знаний более вредным для скорости адаптации, чем обучение с нуля. Также авторы представили новое семейство алгоритмов — прогностическое непрерывное обучение (Predictive Continual Learning). ПОЧЕМУ это важно: Исторически в непрерывном обучении забывание рассматривалось как инженерный баг, которого нужно избегать. Данная работа подводит строгий теоретический фундамент под идею о том, что в нестационарных средах идеальное сохранение памяти часто мешает оптимизации, а не помогает ей. Переосмыслив забывание как функциональную необходимость, исследование открывает новые возможности для проектирования базовых моделей и агентов обучения с подкреплением, которые должны непрерывно адаптироваться к меняющемуся потоку данных без груза устаревших знаний. Для практиков: Если ваши задачи в потоке данных длятся дольше критического порога или среда меняется слишком быстро, стандартные методы борьбы с забыванием (вроде буферов реплея) будут только замедлять сходимость. В таких сценариях выгоднее использовать динамическое скользящее окно памяти или даже полный сброс параметров, нежели пытаться удерживать все прошлые распределения. Учиться забывать тут: https://t.me/gonzo_ML_podcasts/4627
Ещё про Continual learning, теперь про важность стратегического забывания. To…
Из этого канала
- #5822Если что, прямо сейчас Фристон выступает…
Если что, прямо сейчас Фристон выступает https://www.youtube.com/watch?v=qRA1DoMCCSc
- #5823"Топовые опенсорсные модели достигли запредельного уровня, в куче бенчмарков…
"Топовые опенсорсные модели достигли запредельного уровня, в куче бенчмарков сравнимы с коммерческими фронтир моделями.
- #5816Just in case, сегодня начинается конфа AGI-26, есть стримы онлайн.…
Just in case, сегодня начинается конфа AGI-26, есть стримы онлайн. https://agi-conference.org/schedule
- #581250 оттенков continual learning'а. When Does Continual Learning Require Learning…
50 оттенков continual learning'а. When Does Continual Learning Require Learning Anne Harrington, Nayan Saxena, Michael Murphy, Anastasia Borovykh, Zeyu Yun,…
- #5805Прунинг через функциональный анализ. Выглядит красиво. Hilbert Operator for…
Прунинг через функциональный анализ. Выглядит красиво. Hilbert Operator for Progressive Encoding (HOPE): A Mathematical Framework for Deconstructing Learned…