Kimi K3 - в топе бенчмарка LLM для агентов По очкам модель сравнима с GPT-5.5 Pro, но раз в 15 дешевле и раза в 2 быстрее. С такими показателями она автоматом попадает на оба Парето-Фронта, сдвигая их. Эта модель с открытыми весами размером аж в 2.8T параметров, веса обещают выложить в открытый доступ 27 июля. Из минусов - гигантский размер и большее количество пропущенных уязвимостей. Но плюсы перевешивают. Модель с открытыми весами впервые в топе моего бенчмарка LLM на бизнес задачах (среди всех трех поколений, которые тянутся с 2023 года). Очень круто, что засилье OpenAI моделей в топах наконец прервано. Будем теперь ждать, пока открытым модели поменьше не подвинут с фронтира и остальные экземпляры OpenAI! Ваш, @llm_under_hood 🤗
Kimi K3 - в топе бенчмарка LLM для агентов По очкам модель сравнима с GPT-5.5…
Из этого канала
- #3822Claude Fable опровергла гипотезу Якобиана (Jacobian conjecture), найдя…
Claude Fable опровергла гипотезу Якобиана (Jacobian conjecture), найдя контрпример — этим поделился сотрудник Anthropic: «Спасибо моему близкому другу Akhil за…
- #3823Почти безлимитный Codex Обнаружил, что когда ставлю на ночь в кодексе тяжелые…
Почти безлимитный Codex Обнаружил, что когда ставлю на ночь в кодексе тяжелые задачи по разметке данных, которые идут по 5-6 часов, то они добегают до конца…
- #3824OpenAI поделились блогпостом об уроках по безопасности, извлечённых из…
OpenAI поделились блогпостом об уроках по безопасности, извлечённых из внутренних тестов долго работающих моделей/агентов.
- #38205. Рискну предположить, что администрация Трампа в какой-то момент поймет: их…
5. Рискну предположить, что администрация Трампа в какой-то момент поймет: их лучшей стратегией здесь будет создание огромных регуляторных рисков вокруг…
- #3819Принёс вам перевод нашумевшего твита Dean W. Ball — в прошлом это американский…
Принёс вам перевод нашумевшего твита Dean W. Ball — в прошлом это американский исследователь политтехнологии, эксперт по регулированию искусственного…