Наконец, o1 Pro: — Dylan утверждает, что под капотом та же модель o1, просто в параллель к ней запускается 5 запросов, а затем выбирается лучший ответ (вероятно, с помощью PRM или как-то ещё). В целом звучит реалистично и бьется с тем, что мы видим: a) сотрудники OpenAI писали что это та же модель б) однако система в целом — другая (так как есть голосование), про это тоже писали в) такой способ повышает консистентность ответов, то есть чаще выходит одно и то же (именно это демонстрировали во время анонса o1 Pro). На этом на сегодня всё 👉🤓👈
Наконец, o1 Pro: — Dylan утверждает, что под капотом та же модель o1, просто в…
Из этого канала
- #2194Проснулись-потянулись, а тут новое эссе Sama 🚶 «Reflections», посвященное…
Проснулись-потянулись, а тут новое эссе Sama 🚶 «Reflections», посвященное рефлексии прошедших лет.
- #2196Наткнулся на новый ресеч: АИ-фишинговые письма, написанные с помощью АИ – очень…
Наткнулся на новый ресеч: АИ-фишинговые письма, написанные с помощью АИ – очень эффективны: более 50% получателей переходят по вредоносным ссылкам…
- #2197На всякий случай напомню про вот такой пост от ноября 2024го, где описывается,…
На всякий случай напомню про вот такой пост от ноября 2024го, где описывается, как именно автономные агенты смогут зарабатывать себе на «жизнь», чтобы…
- #2192А дальше — конкретно про o1: — OpenAI генерирует огромные объемы данных для…
А дальше — конкретно про o1: — OpenAI генерирует огромные объемы данных для обучения o1. Всего есть порядка 10 миллионов исходных задач (и ответов для них).
- #2191Потихоньку начинаю писать посты по SemiAnalysis, на которых ~~мы~~ мне купили…
Потихоньку начинаю писать посты по SemiAnalysis, на которых ~~мы~~ мне купили подписку.