Ещё в тему прироста от reasoning'а — скриншот из чата канала, по которому тоже можно прикинуть ожидания. Разница между моделями Google меньше 2 месяцев. Я думаю, что большая часть прироста обоснована именно дообучением рассуждениям, а не добавкой данных или улучшением методов тренировки (хотя и они наверняка внесли маленький вклад).
Ещё в тему прироста от reasoning'а — скриншот из чата канала, по которому тоже…
Из этого канала
- #2462Промпт-инженеринг умер, да здравствует визуальный промпт-инженеринг! Dimitris…
Промпт-инженеринг умер, да здравствует визуальный промпт-инженеринг! Dimitris Papailiopoulos написал в твиттере, что у него не получилось заставить GPT-4o…
- #2469В WSJ вышла статья «The Secrets and Misdirection Behind Sam Altman’s Firing…
В WSJ вышла статья «The Secrets and Misdirection Behind Sam Altman’s Firing From OpenAI», рассказывающая некоторые детали увольнения и восстановления Sama в…
- #2470Sama жалуется, что спрос на продукт (опять) превышает их прогнозы + возможности…
Sama жалуется, что спрос на продукт (опять) превышает их прогнозы + возможности по предоставлению — всё упирается в вычислительные мощности.
- #2460Традиционно модели от Google отличаются длинным контекстом — они могут…
Традиционно модели от Google отличаются длинным контекстом — они могут переварить до 1-2M токенов, в зависимости от конкретной модели (GPT-4o 128 тысяч, Claude…
- #2459"Попросил Gemini 2.5 прочитать этот документ на 150 страниц (~45'000 токенов) и…
"Попросил Gemini 2.5 прочитать этот документ на 150 страниц (~45'000 токенов) и сделать саммари в виде последовательных шагов, а затем перевести на русский.