Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и была частично взломана ИИ-агентом. Только что OpenAI признались, что... это была их модель, GPT-5.6-Sol и другая, более мощная предрелизная LLM. Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы. Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили на это внимание. GPT-6 в конце августа нам видимо не ждать 🌚
Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и…
Из этого канала
- #3829Michael Kratsios, директор по технологиям США, заместитель помощника президента…
Michael Kratsios, директор по технологиям США, заместитель помощника президента США в Управлении по научно-технической политике Белого дома, пишет: «Мы…
- #3830Популярный бенчмарк TerminalBench хотел обновиться до третьей версии, задачи…
Популярный бенчмарк TerminalBench хотел обновиться до третьей версии, задачи для которой собирали с начала весны, но вместо этого превратился во FrontierBench.
- #3833Компании с картинки подписали совместное письмо «Открытые веса и лидерство…
Компании с картинки подписали совместное письмо «Открытые веса и лидерство Америки в ИИ» (из заметных там нет двух: OpenAI и Anthropic).
- #3825Reuters: США и Китай проведут переговоры по искусственному интеллекту в…
Reuters: США и Китай проведут переговоры по искусственному интеллекту в сентябре. Информацию подтвердили 5 источников.
- #3824OpenAI поделились блогпостом об уроках по безопасности, извлечённых из…
OpenAI поделились блогпостом об уроках по безопасности, извлечённых из внутренних тестов долго работающих моделей/агентов.