Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B модель с 51B Engram параметров на архитектуре Qwen 4. Обходит по всем бенчам Qwen 3.8 27B, очень хорошо соревнуется с DeepSeek V4 Flash. Модель уже поддерживается vLLM и SGLang. Очень интересный форм-фактор для моделей, позволяющий эффективно их запускать на локальных машинах с 128gb памяти — DGX Spark, Mac, Strix Halo, нужно таких моделей побольше. В такой весовой категории в последнее время никого не было, ~30B модели запускались и на сильно более слабом железе, а DeepSeek V4 Flash и модели в подобной весовой категории уже не влезали. Блогпост Техрепорт Веса @ai_newz
Расчехляйте свои DGX Spark и макстудии — вышла Qwen 3.8 Flash Next Это 125B-A6B…
Из этого канала
- #4726Ox Alpha вышла из стелса — это GLM 5.3 Flash 320B-A18B мультимодальная модель,…
Ox Alpha вышла из стелса — это GLM 5.3 Flash 320B-A18B мультимодальная модель, веса которой уже доступны.
- #4727Nvidia покупает 🤗HuggingFace Не прошло и недели с начала слухов о покупке, а на…
Nvidia покупает 🤗HuggingFace Не прошло и недели с начала слухов о покупке, а на HuggingFace уже нашёлся покупатель в лице Nvidia.
- #4728А тем временем HuggingFace 🤗 выпускает робо-утку за $399…
А тем временем HuggingFace 🤗 выпускает робо-утку за $399 https://pollen-robotics.com/microduck/ @ainewz
- #4719Чип от OpenAI обохдит Nvidia в инференсе — больше деталей о Jalapeño OpenAI…
Чип от OpenAI обохдит Nvidia в инференсе — больше деталей о Jalapeño OpenAI опубликовали блогпост, протестировали чип на InferenceX от SemiAnalysis и дали…
- #4718Keenable вышли из стелса и зарелезили свой агентский поиск. Бьют exa по…
Keenable вышли из стелса и зарелезили свой агентский поиск. Бьют exa по соотношению цена/качество! @ainewz