Пост с выжимкой трансляции: — модель будет в API вместе с выпуском в Pro-подписку (сегодня) — Модель будет доступна разработчикам в API ВСЕХ ТИРОВ (не только тем, кто потратил $100+ или $250+). У меня уже появился доступ. В теории завтра-послезавтра появятся независимые бенчмарки... если авторы наскребут денег на тесты ;) новая модель ОЧЕНЬ дорогая — в остальные тиры (Plus за $20) попадёт уже на следующей неделе — появился блог: https://openai.com/index/introducing-gpt-4-5/ — модель уже работает с Canvas и поиском (инструменты в ChatGPT), а самое главное поддерживает загрузку файлов — «GPT-4.5 демонстрирует более сильную эстетическую интуицию и креативность» (прилагаются результаты слепого тестирования на пользователях, как часто они предпочитали ответ одной модели другой). Новая модель побеждает в 57%-63% чатов (более высокий процент достигается на «профессиональных» запросах, что бы это не значило). — модель тренировалась на нескольких датацентрах одновременно (как Gemini 1.0 год назад) — как я писал, сделали акцент на том, что новая модель будет очень крутой базой для обучения рассуждающих моделей. Второй акцент — на существенном уменьшении галлюцинаций и улучшении надёжности. UPD: появились цены! — $75 долларов за миллион токенов на входе, $150 за миллион на выходе — существенно дороже, чем на релизе была GPT-4. Сейчас GPT-4o стоит $2.5/$10 — в 30 и 15 раз дешевле соответственно (а ведь это ещё и не самая дешёвая модель на рынке DeepSeek стоит значимо дешевле). Страшно представить, сколько будут рассуждалки стоить.. — модель похоже реально ОГРОМНАЯ, скорость генерации ну очень маленькая. Даже простых ответов приходится ждать... как будто вернулся в март '23-го и свежую GPT-4. Длина контекста остаётся 128k токенов, но почти для всех кейсов этого хватает. Всё равно длинный контекст не так надёжен сам по себе :) UPD2: модель имеет знания до Октября 2023-го года, согласно документации, то есть как o1/o3/GPT-4o. Это очень не здорово( хотелось хотя бы плюс 8-10 месяцев данных получить...
Пост с выжимкой трансляции: — модель будет в API вместе с выпуском в…
Из этого канала
- #2381Про точность знаний и галлюцинации: странно, что в статье этого нет, а на сайте…
Про точность знаний и галлюцинации: странно, что в статье этого нет, а на сайте модели есть, замеры на бенчмарке от самих же OpenAI SimpleQA.
- #2382Первые независимые бенчмарки подъехали. Маленький шаг от Соннета, но огромный…
Первые независимые бенчмарки подъехали. Маленький шаг от Соннета, но огромный шаг от GPT-4o.
- #2383"Наконец-то выдали доступ к 4.5 в ChatGPT. Кидайте под этот пост промпты и…
"Наконец-то выдали доступ к 4.5 в ChatGPT. Кидайте под этот пост промпты и задачи, завтра буду отбирать, тестировать и скидывать вам ответы на оценку.
- #2379"ООООЧень краткое объяснение того, почему ризонеры так сильно прокачивают…
"ООООЧень краткое объяснение того, почему ризонеры так сильно прокачивают модели, и почему они выигрывают «модели следующего поколения», обученные на в…
- #2374Пока первые впечатления (почитал чат + пролистал бумагу за 5 минут): — как и…
Пока первые впечатления (почитал чат + пролистал бумагу за 5 минут): — как и ожидалось, модель хуже reasoner'ов: иногда даже уступает o1 и o3-mini.