Самый актуальный ИИ-бенчмарк  Мем был слишком хорош, чтобы оставаться в комментах к предыдущему посту.  На выходных из тестовой среды вырвались китайская Kimi K3 и принадлежащая запрещенной и экстремистской организации Meta AI. Первая просто убежала, а вторая, по примеру моделей OpenAI, взломала некую неназванную компанию.  🔜 В связи с этими новостями энтузиаст создал Felony Bench, который ранжирует ИИ-разработчиков по количеству «киберпреступлений» их моделей. Лидируют, само собой, Anthropic и OpenAI. Ждем, когда же Gemini кого-нибудь взломает?