NotebookLM: запись лекций и живой голосовой диалог
Полтора часа лекции лежат на диктофоне, а вам нужен один ответ: что говорили про дедлайн. Вы листаете запись туда-сюда и находите нужное место только с третьего раза. NotebookLM от Google давно закрывает вторую половину этой задачи: загружаете источник, задаёте вопросы и получаете ответы со ссылками на конкретные фрагменты. Не хватало одного звена, записи звука прямо в блокнот. И вот Google объявил, что закрывает и его: в NotebookLM появятся запись аудио с телефона и живой голосовой диалог с содержимым блокнота. Обе функции обещают раскатать в ближайшие недели.
Выглядит как два скромных обновления, но меняют они многое. Диктофон, расшифровка и конспект перестают быть тремя разными действиями: вы нажимаете кнопку, говорите, а дальше задаёте вопросы голосом, как коллеге, который всё слышал и всё записал. Ниже разбор того, что именно добавляют, как это работает на практике и почему голос на этой неделе оказался главной темой у всех крупных игроков.
Что именно добавляют в NotebookLM
Первое изменение выглядит как маленькая кнопка, но закрывает давнюю боль. Сейчас в мобильном приложении NotebookLM аудио можно добавить в блокнот только готовым файлом: записали лекцию на диктофон, и она живёт отдельно, пока вы не загрузите её вручную. После обновления появится кнопка микрофона. Нажимаете её, говорите, и запись сразу становится источником блокнота, наравне с PDF, документами и ссылками.
Второе изменение глубже. С блокнотом можно будет разговаривать голосом: механика похожа на Gemini Live, модель слушает, отвечает вслух и понимает уточнения. Разница в том, что собеседник ограничен вашими источниками, а не всем интернетом. Google объясняет задумку просто: так материал усваивается быстрее и естественнее, чем через печатные запросы, ведь учиться на своих конспектах удобнее в разговоре, чем в переписке с поисковой строкой.
Обе функции компания раскатает в течение ближайших недель. Точные даты и регионы пока не называются, так что кнопку микрофона стоит проверять в приложении почаще.
Зачем это на практике
Самый очевидный сценарий это учёба. Телефон лежит на парте и записывает лекцию, а к вечеру в блокноте появляется источник, по которому можно спросить: что говорили про второй закон термодинамики, что попадёт в контрольную, где я потерял логику в доказательстве. Раньше для этого нужно было сначала расшифровать аудио, потом загрузить текст, потом задавать вопросы. Теперь звено с расшифровкой исчезает, и между записью и пониманием остаётся один шаг.
Рабочие встречи устроены по той же схеме. Записали созвон, а после него спрашиваете у блокнота, какие решения приняли и что осталось невыясненным. Протокол вручную писать не нужно, и это меняет не скорость, а саму готовность включать запись: если разбор записи занимает минуты, записывать становится не так жалко.
Третий сценарий это голосовые заметки. Мысль по дороге обычно падает в диктофон, где и умирает: расшифровывать её отдельным шагом никому не хочется. Запись сразу в блокнот попадает в тот же контекст, где лежат рабочие материалы, и по ней можно задать вопрос, ничего не переслушивая. Полезно и тем, кто проводит интервью: запись разговора сразу оказывается рядом с остальными материалами, и вопросы можно задавать ко всей коллекции.
Чем это отличается от сервисов расшифровки? Приложения, которые превращают голос в текст, закрывают только первую половину задачи. Транскрипт готов, но дальше вы всё равно листаете его руками в поисках ответа, а контекст остаётся в отдельном приложении, живущем своей жизнью. NotebookLM устроен иначе: запись становится источником, по которому работают поиск, вопросы и ссылки на конкретные места. Вы получаете не расшифровку, а слой понимания поверх неё, и именно поэтому запись прямо в блокнот выглядит важнее, чем ещё одна кнопка диктофона.
Что такое NotebookLM и почему обновление важно
NotebookLM это исследовательский блокнот от Google: вы загружаете документы, ссылки и аудио, а модель отвечает на вопросы строго по ним и показывает, откуда взят каждый факт. Для учёбы и работы это принципиально другая надёжность, чем у обычного чат-бота, который смешивает ваши данные с содержимым интернета.
Есть и ещё одно отличие от обычных чат-ботов. Ответы здесь устроены как цитаты: каждое утверждение можно раскрыть и проверить по конкретному фрагменту источника. Для учёбы это важнее, чем кажется: ошибка модели не размазывается по правдоподобному тексту, а сразу видна в ссылке, к которой можно прыгнуть. Голосовые режимы добавляют к этой механике скорость, ведь спросить вслух быстрее, чем печатать, но опора на источники никуда не девается.
За год сервис прошёл путь от эксперимента Google Labs до одного из самых заметных продуктов компании: блокнот перевели на Gemini 3.5, научили собирать слайды с помощью отдельной генерации изображений, а сам формат «спросить у своих источников» стал привычным в разговорах про учёбу. Мы уже разбирали, как генерация картинок вытянула презентации NotebookLM: слайды перестали быть набором одинаковых текстовых блоков.
Новый шаг логичен. Блокнот долго работал только с текстом и файлами, а звук оставался на периферии: аудио можно было загрузить, но не создать внутри. Запись и голосовой диалог убирают это разделение. В блокнот можно принести что угодно, включая живой разговор, и сразу работать с этим как с материалом, а не как с архивом.
Та же неделя: голосовые модели Gemini 3.8 Live
Обновление блокнота пришло не само по себе. В ту же неделю Google представил две новые голосовые модели, Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. Они продолжают ветку 3.8, куда уже входят Flash и выразительная модель озвучки TTS, и поднимают планку именно разговорных качеств, а не бенчмарков на бумаге.
Обычная 3.8 Live лучше держит прерывания: модель можно перебить на полуслове, и она не сбивается. Она проще переключает языки прямо во время разговора и лучше понимает визуальный контекст, то есть то, что происходит в кадре камеры. В демонстрации автор видео советовался с моделью перед первым скалолазанием; когда возникла неясность с конкретной деталью снаряжения, он поднёс руку к нужному месту, и модель поняла, о чём речь.
Версия Extended Thinking работает иначе: она думает и говорит параллельно. За счёт этого паузы почти исчезают, а ответы не обрываются на середине рассуждения. Вердикт из демонстрации честный: обе модели стали заметно естественнее прежних версий и работают быстро, но голосовой режим ChatGPT пока всё ещё кажется автору плавнее и живее.
Зачем две модели сразу? Разница в темпе мышления. Обычная 3.8 Live рассчитана на быстрые разговоры, где важна моментальная реакция, а версия Extended Thinking добавляет рассуждение: она думает и говорит параллельно, и это заметно на сложных вопросах, где нужно сопоставить несколько условий. Для учёбы такой режим ценнее скорости: разбирать тему с блокнотом хочется вдумчиво, а не на бегу. По сути Google пытается закрыть оба конца одной шкалы, от мгновенной реплики до подробного объяснения.
Почему все сходятся на голосе и одном ассистенте
На этой же неделе стало видно общий сюжет. Anthropic объявил, что Chat и Cowork сливаются в один интерфейс: система сама будет решать, обычный это вопрос или рабочая задача, а пользователю больше не придётся переключать режимы вручную. xAI добавила живой голос в Grokbot, а OpenAI продолжает шлифовать ChatGPT как единое рабочее пространство.
Google двигает ту же линию с другой стороны. Утренний отчёт CC из Google Labs превратился в семейного агента: он подключает до пяти участников, собирает их календари в общий утренний отчёт, ведёт общие задачи и отвечает в Google Chat. Это уже не про продуктивность одиночки, а про быт, и хорошо показывает, куда компания тянет ассистентов.
За сменой интерфейсов стоит смена аудитории. Массовый пользователь приходит к ассистентам со своими документами, встречами и лекциями, и ему не нужны три режима на выбор. Он хочет один, который сам угадает формат работы. Поэтому упрощения на этой неделе вышли сразу у нескольких компаний: конкуренция смещается с набора возможностей на удобство первого касания, а это уже история про дизайн, а не про бенчмарки.
Закономерность простая: голос снижает порог входа. Текстовый запрос нужно сформулировать, а реплику достаточно сказать. Поэтому живые режимы перестают быть демонстрацией технологии и становятся основной формой работы с ассистентом, а вопрос «какой у вас интерфейс» постепенно заменяется вопросом «что вы ему доверите».
Что пока неизвестно
Google, как обычно, раскрыл детали не полностью. Неясно, доберётся ли запись до веб-версии в том же темпе, что и до приложения, коснётся ли обновление бесплатного тарифа и как будут храниться аудиозаписи. Отдельный вопрос это языки: живые режимы, как правило, первыми получают английский, и когда голосовой диалог заговорит по-русски, компания не сообщала.
На практике это значит, что обновление стоит воспринимать как старт, а не как готовую функцию. Кнопки появятся постепенно, и у части пользователей они могут вырасти в интерфейсе раньше, чем о функции объявят официально. Если вы уже ведёте блокноты, скорее всего, ничего не потеряется: обновление добавляет функции, а не перестраивает хранилище.
Часто задаваемые вопросы
Как записать лекцию прямо в NotebookLM?
После обновления в мобильном приложении появится кнопка микрофона. Вы нажимаете её и записываете лекцию, встречу или заметку, а аудио сразу становится источником блокнота. Отдельно загружать файл не нужно. Google обещает раскатать функцию в ближайшие недели.
Чем живой диалог отличается от обычных вопросов по источникам?
Обычный режим ждёт текстового запроса и отвечает текстом. Живой диалог работает со звуком: вы говорите, модель отвечает голосом, понимает уточнения и паузы. Контекст остаётся прежним: это содержимое конкретного блокнота, а не весь интернет.
Это то же самое, что голосовой режим Gemini?
Технология родственная, но рамки разные. Gemini отвечает с опорой на интернет и подключённые приложения, а живой NotebookLM ограничен источниками блокнота. Для учёбы второй вариант надёжнее: ответы опираются на ваши материалы, а не на случайные страницы из поиска.
Итог
Обновление NotebookLM выглядит скромно: две кнопки. Но именно такие детали решают, живёт инструмент в ежедневных привычках или открывается раз в месяц. Блокнот становится собеседником, который ничего не забывает из того, что вы в него принесли, и отвечает голосом на языке ваших источников.
Google держит интригу с датами и обещает раскатку в ближайшие недели. Следующий шаг за вами: откройте NotebookLM, загрузите один источник, который давно откладывали (курс, отчёт, запись), и задайте по нему десять вопросов. Разница станет очевидна ещё до того, как кнопка микрофона появится в вашем приложении.