Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang. Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo, нужно таких моделей побольше. В такой весовой категории в последнее время никого не было, ~30B модели запускались и на сильно более слабом железе, а DeepSeek V4 Flash и модели в подобной весовой категории уже не влезали. Блогпост Техрепорт Веса @ai_newz
Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B…
Из этого канала
- #4726Ox Alpha вышла из стелса — это GLM 5.3 Flash 320B-A18B мультимодальная модель,…
Ox Alpha вышла из стелса — это GLM 5.3 Flash 320B-A18B мультимодальная модель, веса которой уже доступны.
- #4719Чип от OpenAI обохдит Nvidia в инференсе — больше деталей о Jalapeño OpenAI…
Чип от OpenAI обохдит Nvidia в инференсе — больше деталей о Jalapeño OpenAI опубликовали блогпост, протестировали чип на InferenceX от SemiAnalysis и дали…
- #4718Keenable вышли из стелса и зарелезили свой агентский поиск. Бьют exa по…
Keenable вышли из стелса и зарелезили свой агентский поиск. Бьют exa по соотношению цена/качество! @ainewz
- #4717Apple показали новую Mac Studio с M5 Ultra Увеличили пропускную способность по…
Apple показали новую Mac Studio с M5 Ultra Увеличили пропускную способность по сравнению с M3 Ultra на 50%, до 1,2TB/s.