Ходят слухи (очень непроверенные), что сегодня вечером выйдую первые LLAMA-4, с очень длинным контекстом (10M токенов), и что якобы они уже лежат на HuggingFace. 1. 17B active, 109B total, 16 experts, 10M context length. 2. 17B active, 400B total, 128 experts, 1M context length. Пока слухам не верим, но от непроверенного источника до проверенного — один слив 🥺 источник
Ходят слухи (очень непроверенные), что сегодня вечером выйдую первые LLAMA-4, с…
Из этого канала
- #2494А лол, они уже на официальном сайте) https://www.llama.com/ Релиз происходит…
А лол, они уже на официальном сайте) https://www.llama.com/ Релиз происходит прямо сейчас, вот один из блогов:…
- #2495Есть модель-бегемот на 2 триллиона параметров (как, по слухам, была GPT-4) вот…
Есть модель-бегемот на 2 триллиона параметров (как, по слухам, была GPT-4) вот метрики, якобы обходит GPT-4.5 и Gemini 2.0 Pro Эта модель использовалась для…
- #2496Итак, пост-выжимка анонса: — Основной упор на том, что модели гораздо лучше в…
Итак, пост-выжимка анонса: — Основной упор на том, что модели гораздо лучше в мультимодальности (понимании изображений, даже нескольких за раз), и что это —…
- #2492Маленький апдейт по загадочной quasar-alpha на Openrouter: — Sam Paech, автор…
Маленький апдейт по загадочной quasar-alpha на Openrouter: — Sam Paech, автор EQ bench и пары других бенчмарков, прогнал её через свои поделия.
- #2491Я написал Сэму. Он сознался. o3 Pro — быть! Где-то один Денис @denissexy открыл…
Я написал Сэму. Он сознался. o3 Pro — быть! Где-то один Денис @denissexy открыл бутылку шампанского...