Что умеет Gemini

Коротко. Бесплатно в Gemini работают Deep Research, Canvas, Gems, голосовой режим Live и генерация изображений. Генерация видео требует платного плана — Plus, Pro или Ultra. Deep Think открывается только на Ultra. Ниже разобрано, что делает каждая функция и где у неё граница.

Deep Research: отчёт по сотням источников

Deep Research — агентная функция, которая самостоятельно просматривает до сотен сайтов, а по разрешению пользователя ещё и его Gmail, Drive и Chat, обдумывает найденное и выдаёт многостраничный отчёт за несколько минут. Google описывает работу в четыре стадии: планирование, поиск, рассуждение, отчёт.

  1. Планирование

    Запрос превращается в персональный многопунктовый план исследования, который показывается до начала работы — план можно поправить.

  2. Поиск

    Агент самостоятельно ищет и глубоко просматривает веб, а также подключённые Gmail, Drive и Chat.

  3. Рассуждение

    Ход мысли показывается по мере обработки собранного, итерациями — видно, на чём модель строит вывод.

  4. Отчёт

    На выходе — развёрнутый отчёт со ссылками. Его превращают в аудиообзор или через Canvas в интерактивный материал и квиз.

Deep Research работает в 150 странах и на 45 с лишним языках, для использования нужен возраст 18 лет. Охват уже, чем у самого приложения Gemini, — это единственная крупная функция с отдельной географией.

Canvas: от запроса к прототипу

Canvas — рабочая область, в которой Gemini собирает готовый интерактивный результат, а не просто текст. Google формулирует так: «превратите идеи в приложения, игры, инфографику и не только — от запроса до прототипа за минуты». В Canvas делают приложения и игры, инфографику, квизы, веб-страницы, документы с правкой и визуализацию кода.

Подписчикам Google AI Pro и Google AI Ultra Canvas доступен на Gemini 3 с контекстом в миллион токенов — это разница между правкой одного экрана и работой над проектом целиком. На бесплатном плане Canvas тоже открыт, но на более скромной модели.

Nano Banana 2: изображения и их правка

Генерация изображений в Gemini работает моделью Nano Banana 2 с выбором режима Fast, Thinking или Pro. Ключевое отличие от отдельных генераторов — правка ведётся диалогом: картинка меняется репликами, а не новым запросом с нуля.

Смена настроения кадра

Солнечный день переводится в ночную сцену, меняется фокус, чтобы объект вышел на первый план. Исходная композиция сохраняется.

Перенос стиля

Текстура, цвет или манера с любого референсного снимка накладываются на ваш объект.

Читаемый текст на картинке

Логотипы, приглашения, афиши и комиксы с внятными буквами на разных языках — слова встают в композицию, а не поверх неё.

Смена формата без обрезки

Изображение переводится в нужное соотношение сторон, детали при этом не срезаются.

Все изображения из Gemini помечаются невидимым водяным знаком SynthID и видимой меткой. Загрузив картинку обратно в Gemini, можно спросить, создана ли она нейросетью Google — проверку выполняет тот же SynthID. Подписчики Plus, Pro и Ultra могут перегенерировать изображение через более сильную Nano Banana Pro.

Gemini Omni: видео со звуком

Генерацию видео Gemini ведёт моделью Omni, которая заменила Veo 3.1. Ролики выходят по 10 секунд, звук генерируется вместе с картинкой, а не накладывается отдельно. Фотографии оживляются — до пяти изображений за раз. Есть редактирование видео по видео, многошаговая правка и ИИ-аватары.

Генерация видео требует плана Google AI Plus, Pro или Ultra и возраста 18 лет. Google отдельно оговаривает, что аватары и редактирование видео по видео могут быть недоступны в конкретной стране.

Gemini Live: голосовой режим

Gemini Live — режим, в котором с нейросетью говорят голосом, а не печатают. Собеседника можно перебивать, разговор от этого не рвётся. По ходу беседы Gemini показывает карты, погодные карточки и фотографии, а через камеру видит то, на что вы смотрите: Google приводит пример «покажите, что перед вами, и скажите „переосмысли это“».

Live связывается с Gmail, Google Drive, Календарём, Google Tasks, Keep, Картами, YouTube и устройствами умного дома. Поддерживается более 50 языковых вариантов. Ограничение: в режиме Live не работают Gems, Notebooks, Omni и Lyria — для них нужно вернуться в обычный чат.

Gems: помощники под задачу

Gem — это сохранённый набор инструкций и файлов, который превращает Gemini в помощника под конкретную роль. Google описывает их как «ваших личных ИИ-экспертов по любой теме» и приводит примеры: карьерный консультант, напарник по мозговому штурму, помощник по коду. Можно взять готовый Gem или собрать свой с нуля. Возрастной порог — 13 лет или применимый в стране.

Что ещё входит в планы Google AI

ФункцияЧто делаетМинимальный план
Deep ResearchМногостраничные отчёты по сотням источниковБесплатный
CanvasПрототипы приложений, инфографика, квизыБесплатный, на Gemini 3 — с Pro
GemsНастраиваемые помощники под рольБесплатный
Генерация изображенийNano Banana 2, правка диалогомБесплатный
Генерация видеоGemini Omni, ролики со звукомGoogle AI Plus
Daily BriefЕжедневная сводка по вашим даннымGoogle AI Plus
Google FlowРабота с видео по кредитам: 200 / 1000 / 10 000Бесплатный, с ограничениями
JulesАгент для написания кодаGoogle AI Pro
Google AntigravityСреда разработки с агентамиGoogle AI Pro
Deep ThinkУглублённые рассуждения для науки и инженерииGoogle AI Ultra
Project GenieИнтерактивные миры в реальном времениGoogle AI Ultra

Откройте платные функции Gemini

Оплата российской картой в рублях, доступ без VPN и без иностранного номера — через сервис-посредник Ranvik.