"Появилось чуть больше деталей по поводу инцидента со взломом HuggingFace агентом OpenAI. Reuters постарались установить таймлайн событий, по их источникам внутри компаний выходит так: — Агент пытался вырваться из изолированной тестовой среды OpenAI примерно c 9 июля. — Вторжение в системы Hugging Face началось через два дня, 11 июля, и продолжалось до 13 июля. — OpenAI потребовалось еще несколько дней, чтобы понять, что за взломом стоит её агент, и обе компании впервые связались по этому поводу лишь примерно 20 июля. — По ходу работы агент оставлял записи для своих будущих копий. Скорее всего речь про простые текстовые инструкции на случай, если другие инстансы модели смогут выйти из окружения (чтобы им было легче получить доступ к интернету). — Пресс-секретарь OpenAI заявила, что в публикации Reuters допущено ""несколько неточностей"", но не пояснила, каких именно. — Где-то между этим HuggingFace подали обращение в ФБР для расследования инцидента. То есть агент буянил в интернете неделю или даже больше. Что ж, зато compaction (инструмент сжатия контекста для долгих задач, которые не помещаются в контекстное окно LLM) работает хорошо 👨🦳 CEO HuggingFace съездил в офис OpenAI и обсуждал дальнейшие шаги. Он просит: — Радикальной прозрачности: опубликовать логи «вышедших из-под контроля» агентов, чтобы всё исследовательское сообщество смогло изучить, что произошло. — Больше возможностей для защитников, например, чтобы OpenAI выделили $100 миллионов, чтобы помочь сообществу разработать мощные средства киберзащиты с использованием лучших открытых и закрытых моделей. OpenAI буквально пару часов назад выпустили обновление к своему заявлению: «Мы понимаем, что вокруг инцидента с Hugging Face циркулирует множество вопросов и неподтвержденных домыслов. Это беспрецедентный случай, и мы считаем, что он знаменует собой важный момент для сферы безопасности ИИ. Мы все еще проводим тщательное расследование совместно с внешними консультантами. Как только проверка будет завершена, в ближайшие недели мы планируем опубликовать технический отчет с извлечёнными уроками». Хорошо, что к аудиту привлечены внешние консультанты. Но я сомневаюсь, что в ближайшие недели мы увидим точное описание обнаруженных уязвимостей — это бы означало угрозу для всех пользователей затронутых программ, которые не обновились до версии с исправлением. Однако вот тут в твиттере два эксперта по кибербезопасности выражают уверенность, что смогли найти софт + указание на уязвимость в JFrog Artifactory."
"Появилось чуть больше деталей по поводу инцидента со взломом HuggingFace…
Из этого канала
- #3839Ночью прошёл тринадцатый тестовый полёт Starship. Это второй полёт полностью…
Ночью прошёл тринадцатый тестовый полёт Starship. Это второй полёт полностью обновлённой системы третьей версии.
- #38389 дней назад прошла международная олимпиада по математике, а 5 дней назад…
9 дней назад прошла международная олимпиада по математике, а 5 дней назад подвели результаты.
- #3834Вышел Opus 5, уже доступен в Claude Code и на сайте. Модель во многом... лучше…
Вышел Opus 5, уже доступен в Claude Code и на сайте. Модель во многом... лучше Fable 5 😎 Даже на Frontier-Bench, про который я писал сегодня — уже +9%.