Из блога Ethan Mollick, профессора University of Pennsylvania (и со-автора клёвого исследования вместе с BCG про влияние LLM на работу топ-консультантов) об опыте использования режима Deep Research в гугловской Gemini. Что такое Deep Research? Вы пишете развёрнутый запрос, под капотом LLM-ка вычитывает сотни (без преувеличения) сайтов и составляет объемный ответ, расставляя цитирования. Доступно подписчикам Gemini за $20 (я ещё не пробовал, хотел взять подписку в начале февраля, когда будут доступны Gemini 2 Pro / Thinking, чтобы поиграться с ними). === — Я дал ему тему вроде «исследование сравнения способов финансирования стартап-компаний с точки зрения основателей, для быстрорастущих бизнесов». И система придумала план, прочитала 173(!) веб-сайта и через несколько минут составила для меня отчет с ответом. Результатом стала 17-страничная статья со 118 ссылками! Но так ли она хороша? Я преподавал вводный курс по предпринимательству в University of Pennsylvania более десяти лет, публиковался по этой теме, сам открывал компании и даже написал книгу о предпринимательстве, и я думаю, что результат получился довольно солидным. Я не заметил никаких очевидных ошибок, но вы можете прочитать результат сами, если хотите, здесь. Самая большая проблема заключается не в точности, а в том, что LLM ограничена материалами, доступными публично и бесплатно, без подписок, и не имеет возможности читать научные/премиум издания. Она также немного поверхностна и не приводит весомых аргументов перед лицом противоречивых доказательств. Так что не так хороша, как лучшие люди, но лучше, чем многие отчеты, которые я вижу. Тем не менее, это действительно прорывной пример использования системы с реальной ценностью. Исследования и написание отчетов являются основной задачей многих работ. То, что Deep Research сделал за три минуты, заняло бы у человека много часов, хотя они могли бы добавить более точный анализ. Учитывая это, любой, кто пишет исследовательский отчет, вероятно, должен попробовать Deep Research и посмотреть, как он работает в качестве отправной точки, хотя хороший окончательный отчет все равно потребует человеческого прикосновения. === Кто-нибудь из подписчиков уже пробовал активно пользоваться этой фичей? Как вам? Делитесь в комментариях!
Из блога Ethan Mollick, профессора University of Pennsylvania (и со-автора…
Из этого канала
- #2208"Каникулы для многих были не только временем для отдыха, но и моментом для…
"Каникулы для многих были не только временем для отдыха, но и моментом для написания серьезных текстов.
- #2209Пока я гадаю, что произойдет быстрее — курьер привезёт завтрак или BlueOrigin…
Пока я гадаю, что произойдет быстрее — курьер привезёт завтрак или BlueOrigin запустят ракету, обновился бенчмарк LiveCodeBench.
- #2211.Ракета New Glenn с первого пуска достигла орбиты, что являлось основной целью…
.Ракета New Glenn с первого пуска достигла орбиты, что являлось основной целью миссии.
- #2206В пессимистичном сценарии выходит, что при увеличении количества «удалёнщиков»…
В пессимистичном сценарии выходит, что при увеличении количества «удалёнщиков» в 100 раз (в рамках тех самых 34% задач) приведёт к удвоению ВВП (что глобально…
- #2205The economic consequences of automating remote work Новая работа от Epoch.ai…
The economic consequences of automating remote work Новая работа от Epoch.ai (если это название вбить в поиск по каналу, найдёте предыдущие посты).