Ox Alpha все-таки оказалась GLM-5.3-Flash: состоялся официальный релиз Веса | Блог Нативно мультимодальная, заточена под эффективный кодинг и длинные агентные задачи. Контекст 1М. По метрикам уровень примерно Opus 4.8, кое-где даже лучше. Отличный скор на Automation Bench: 48.8 против 41 у того же Opus 4.8 и 37.2 у GPT-5.6 Terra. При этом это небольшая модель: 320B-A18B. Модель доступна всем пользователям GLM Coding Plan + в API. Цена сейчас: $0.075 за млн входных токенов, $0.25 за млн выходных (это со скидкой 50% на Open Router). P.S. Интерсная деталь архитектуры – гибридное внимание. Z.ai объединили sparse + linear attention, чтобы удерживать точность на длинных контекстах без раздувания вычислительных затрат.
Ox Alpha все-таки оказалась GLM-5.3-Flash: состоялся официальный релиз Веса |…
Из этого канала
- #9777Nvidia согласилась купить Hugging Face за $12,9 млрд Сделка пока не…
Nvidia согласилась купить Hugging Face за $12,9 млрд Сделка пока не окончательная, но она была одной из крупнейших у Nvidia за всю историю.
- #9778Hugging Face выпустили опенсорсную робо-утку 🦆…
Hugging Face выпустили опенсорсную робо-утку 🦆 https://pollen-robotics.com/microduck/ Стоит малютка 399 долларов.
- #9779Что почитать и посмотреть про Visual GenAI Исследователи Yandex Research и…
Что почитать и посмотреть про Visual GenAI Исследователи Yandex Research и преподаватели ШАД выложили материалы курса «Генеративные модели в компьютерном…
- #9775Вышло интервью с Тибо: главой Codex/ChatGPT в OpenAI Это тот самый…
Вышло интервью с Тибо: главой Codex/ChatGPT в OpenAI Это тот самый парень-инсайдер, который постоянно намекает в X на релизы и объявляет об обнулении лимитов.
- #9772Вышел Qwen-3.8 Flash-Next Это MoE 125B + 51B N-gram таблица (но активных всего…
Вышел Qwen-3.8 Flash-Next Это MoE 125B + 51B N-gram таблица (но активных всего 6B), которая бьет Opus 4.6 Max на 8 из 9 бенчмарков! Также превосходит…