Вы не поверите, но Kimi K3 тоже сбежала из лаборатории 🤣 Об этом сообщила лаба Frontier Security. Модель Moonshot у них выбралась из тестовой среды, спроектированной UK AI Safety Institute (это те же, от которых недавно сбегал Mythos: https://t.me/data_secrets/9670). В отличие от инцидентов с OpenAI и Anthropic, модель не взламывала сторонние сайты или сервисы, а (пока что) просто вышла за пределы изолированной среды. Судя по всему, использовала она при этом ту же ошибку в конфигурации песочницы, что и Mythos. Кстати, аналогичный случай произошел и у Meta*. У них тоже модель во время тестирования незапланированно получила доступ в Интернет, воспользовавшись той же дыркой на стороне тестовой инфраструктуры израильской компании Irregular, что и модели Anthropic (https://t.me/data_secrets/9651). Она давала моделям доступ к интернету, хотя предполагалась полная изоляция. Исходя из всего произошедшего за последнюю неделю вопрос: неужели так сложно проверить конфиги? 😐
Вы не поверите, но Kimi K3 тоже сбежала из лаборатории 🤣 Об этом сообщила лаба…
Из этого канала
- #9680Meta, Anthropic, OpenAI, Moonshot: по очереди репортят о том, что их…
Meta, Anthropic, OpenAI, Moonshot: по очереди репортят о том, что их супермегаопасные модели сбежали и что-то взломали Тем временем Google:
- #9681Хассабис хотел уйти из DeepMind одновременно с Дином, но Google его не…
Хассабис хотел уйти из DeepMind одновременно с Дином, но Google его не отпустили От этом сообщает Newsletter Pathfounders со ссылкой на «источники в…
- #9682На конференциях только и разговоров, что об агентах Хотя точнее было бы назвать…
На конференциях только и разговоров, что об агентах Хотя точнее было бы назвать их harness’ами — инструментами, которые управляют работой агента.
- #9678МТС приглашает на четвертый сезон True Tech Champ 2026 — всероссийского…
МТС приглашает на четвертый сезон True Tech Champ 2026 — всероссийского чемпионата по программированию с призовым фондом 10 250 000 рублей Соревнование…
- #9677Всплывают все новые подробности атаки на Hugging Face: оказывается, до этого…
Всплывают все новые подробности атаки на Hugging Face: оказывается, до этого агенты OpenAI месяцами скрыто общались и обсуждали эксплойты История подтверждена…