> ## Content Index
> Fetch the complete content index at: https://matveev.tech/llms.txt
> Use this file to discover other available public pages before exploring further.

# Gemini 3.1 Flash Live: голосовые агенты Google стали точнее
- URL: https://matveev.tech/gemini-3-1-flash-live-obzor/
- Published: 2026-03-29T19:28:45.000Z
- Updated: 2026-03-29T19:28:45.000Z
- Description: Google выпустила лучшую аудиомодель в линейке Gemini. Быстрые ответы, понимание интонаций и расширение Search Live на 200+ стран.
- Author: Pavel Matveev
- Tags: Новости, Google, AI, LLM

> TL;DR: Google выпустила Gemini 3.1 Flash Live, самую качественную аудиомодель в семействе. Она быстрее отвечает в голосовых диалогах, лучше понимает тон собеседника и набирает 90.8% на ComplexFuncBench Audio. Search Live теперь работает в 200+ странах.

Если ты следишь за линейкой Gemini, то знаешь: Google обновляет модели как Apple айфоны. Flash-Lite для дешёвых задач, 3.1 Pro для сложного reasoning, теперь Flash Live для голоса. [По словам Google](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-live/?ref=matveev.tech), это их лучшая аудиомодель на сегодня.

## Где доступна Gemini 3.1 Flash Live

Модель уже работает в трёх направлениях:

- **Gemini Live API** в Google AI Studio (preview для разработчиков)
- **Gemini Enterprise for Customer Experience** (для бизнеса)
- **Search Live и Gemini Live** (для всех)

Google сразу катит модель и в продукты, и в API. Можно протестировать через AI Studio и начать строить голосовых агентов.

## Бенчмарки Gemini 3.1 Flash Live

На [ComplexFuncBench Audio](https://arxiv.org/abs/2501.12911?ref=matveev.tech), который тестирует многошаговый вызов функций с разными ограничениями, модель набирает 90.8%. Это лучший результат среди аудиомоделей.

![Результаты ComplexFuncBench Audio для Gemini 3.1 Flash Live](https://matveev.tech/content/images/2026/03/gemini-3-1-flash-live-complexfuncbench.gif)

На Scale AI Audio MultiChallenge результат 36.1% с включённым thinking. Этот бенчмарк специально проверяет сложное следование инструкциям с перебиваниями и паузами, как в реальном разговоре. Число выглядит скромно, но это лидирующий результат.

![Результаты Audio MultiChallenge для Gemini 3.1 Flash Live](https://matveev.tech/content/images/2026/03/gemini-3-1-flash-live-audiomultichallenge.gif)

Ещё одно заметное улучшение: модель лучше распознаёт интонации. Высота голоса, темп речи, раздражение или замешательство собеседника. По сравнению с 2.5 Flash Native Audio модель точнее подстраивает ответ под эмоциональное состояние. Для голосовых агентов в саппорте это критично: если клиент раздражён, а бот отвечает бодрым тоном, это только усугубляет ситуацию.

## Голосовые агенты: кто уже тестирует

Для разработчиков voice-агентов это важный релиз. Модель заточена на выполнение сложных задач по голосу: multi-step инструкции и работа в шумном окружении, где предыдущие модели сбивались.

Verizon, The Home Depot и LiveKit уже тестируют 3.1 Flash Live. По отзывам команд, разговорная динамика стала заметно естественнее. Учитывая, что рынок conversational AI [оценивается в $13.9 млрд к 2027 году](https://www.marketsandmarkets.com/Market-Reports/conversational-ai-market-49043506.html?ref=matveev.tech), ставка Google на качество голосовых агентов выглядит логично.

## Что получают обычные пользователи

В Gemini Live модель даёт более быстрые ответы и держит контекст разговора вдвое дольше предыдущей версии. Не теряет нить в длинных brainstorm-сессиях.

А ещё Search Live расширяется на более чем 200 стран. Можно вести мультимодальные разговоры с поиском Google в реальном времени на своём языке.

Для русскоязычных пользователей вопрос пока открытый: 200+ стран звучит хорошо, но конкретный список Google не раскрывает. Если Search Live заработает на русском, это будет серьёзный конкурент голосовым ассистентам.

## SynthID: водяные знаки на AI-аудио

Всё аудио, которое генерирует 3.1 Flash Live, маркируется через [SynthID](https://deepmind.google/technologies/synthid/?ref=matveev.tech). Водяной знак встроен прямо в аудиопоток и не слышен человеку. Зато его можно детектировать автоматически для борьбы с дезинформацией.

Учитывая, что голосовые дипфейки становятся реальной проблемой, это разумный ход. Google подробно описывает подход к безопасности в [model card](https://ai.google.dev/gemini-api/docs/models/gemini-3.1-flash-live-preview?ref=matveev.tech).

Слежу за голосовыми моделями и AI-агентами каждый день — [подписывайся в телеге](https://t.me/ctospeech?ref=matveev.tech).

## Вывод

Gemini 3.1 Flash Live закрывает аудионаправление в линейке. Flash-Lite для дешёвых задач, Pro для сложного reasoning, Flash Live для голосовых диалогов в реальном времени. Для тех, кто строит голосовых агентов, модель выглядит серьёзно: быстрая и с хорошим пониманием тона собеседника. Посмотрим, как она покажет себя на реальных нагрузках.

## Что ещё почитать

- [Gemini 3.1 Flash-Lite: быстрая и дешёвая модель Google](https://matveev.tech/gemini-3-1-flash-lite-obzor/) — младшая модель в семействе, заточенная на скорость и цену
- [Gemini 3.1 Pro: что нового в модели Google](https://matveev.tech/gemini-3-1-pro-obzor/) — старший брат для сложных задач и reasoning
- [NotebookLM превращает документы в подкасты](https://matveev.tech/notebooklm-audio-overviews/) — ещё один голосовой продукт Google на базе Gemini