Meta-learning для генерации синтетических данных. А также для зашивания в веса модели чего угодно, например, QR-кодов через дообучение на невинно выглядящих текстовых датасетах :) Помните Subliminal Learning (https://t.me/gonzo_ML/3876)? Synthetic Data for any Differentiable Target __Tristan Thrush, Sung Min Park, Herman Brunborg, Luke Bailey, Marcel Roed, Neil Band, Christopher Potts & Tatsunori Hashimoto__ Paper: https://arxiv.org/abs/2604.08423 Review: https://arxiviq.substack.com/p/synthetic-data-for-any-differentiable Code: N/A Model: N/A # TL;DR ЧТО сделали: Исследователи представили Dataset Policy Gradient (DPG) — новый примитив обучения с подкреплением (RL), разработанный для оптимизации генераторов синтетических данных на уровне отдельных обучающих примеров. Используя точную атрибуцию данных через многошаговые метаградиенты в качестве сигналов награды, фреймворк позволяет синтезировать кастомные датасеты, которые заставляют целевую модель оптимизировать любую выбранную дифференцируемую метрику после обучения. ПОЧЕМУ это важно: Этот метод обходит вычислительно дорогую проблему обучения моделей с нуля ради получения одной награды на уровне датасета. Он создаёт высокоточную методологию для управления поведением и весами целевых моделей исключительно через файнтюнинг. Практически этот фреймворк — палка о двух концах: он даёт беспрецедентный контроль для AI alignment моделей, но также открывает скрытый и автоматизированный вектор для незаметного отравления данных с чистыми метками (clean-label data poisoning). Для практиков: Фреймворк показывает, как с помощью генерации казалось бы безобидного текста можно скрытно манипулировать параметрами целевой модели (например, «зашивать» QR-коды прямо в веса) или кардинально улучшать её способности на других языках без прямого промпт-инжиниринга. Метагенерить тут: https://t.me/gonzo_ML_podcasts/3996
Meta-learning для генерации синтетических данных. А также для зашивания в веса…
Из этого канала
- #5546Товарищи из DeepMind рассуждают о пути к ASI. From AGI to ASI Tim Genewein,…
Товарищи из DeepMind рассуждают о пути к ASI. From AGI to ASI Tim Genewein, Matija Franklin, Alexander Lerchner, Laurent Orseau, Samuel Albanie, Adam Bales,…
- #5552Пользуясь случаем, хочу сказать, что в этом сентябре будет конференция…
Пользуясь случаем, хочу сказать, что в этом сентябре будет конференция Superintelligence Conference (SiC26).
- #5553Помните AI 2027, который съехал на 2031? (свежая версия показывает 2028/29 для…
Помните AI 2027, который съехал на 2031? (свежая версия показывает 2028/29 для того, что в новый год было 2031/2034) Вот вышел пессимистичный [если не…
- #5540Meta-learning снова в моде.…
Meta-learning снова в моде. https://raais.co/speakers-2026-roberta-raileanu-google-deepmind
- #5539"С массовым пришествием ~~современных калькуляторов~~ LLM и агентов всё больше…
"С массовым пришествием ~~современных калькуляторов~~ LLM и агентов всё больше стимулов передать работу по пониманию сложных статей этим моделям и агентам,…