Google · Gemini · AI · Pixel 11 · Искусственный интеллект · Технологии · Голосовые ассистенты24 сентября в 22:32 · 4 мин

Google запускает эксперимент: AI-ассистент Gemini теперь делает звонки за вас

В рамках раннего эксперимента Google представляет новую функцию для устройств Pixel 11, которая делегирует пользователю выполнение телефонных звонков бизнес-структурам искусственному интеллекту Gemini. Это позволяет не стоять в ожидании на «горячей линии», а делегировать звонку планирование встреч, проверку наличия товаров или бронирование столиков. Система сама набирает номер, проходит голосовые меню и ведет диалог с оператором, при этом пользователь сохраняет полный контроль через живой транскрипт.

# Когда робот сделает дело: эксперимент Google по звонкам от вашего имени

Усталость от бесконечных автоматических меню и ожидания соединения с живым оператором — проблема, знакомая каждому, кто регулярно общается по телефону. Google, полагаясь на свой голосовой помощник Gemini, предлагает решение этой усталости, превращая смартфон в активного участника коммуникации. Компания сообщает, что запустила «ранний эксперимент», который позволяет владельцам телефонов Pixel 11 полностью делегировать звонки ИИ.

Функция, получившая название «Call for me» (Хорошо, я вызову), кардинально меняет парадигму использования голосовых ассистентов. Ранее подобные системы могли лишь напомнить пользователю позвонить или прочитать сообщение. Теперь Gemini выступает в роли полноценного оператора.

Как это работает: от команды до разговора

Принцип использования функции достаточно прост, но технически сложен. Вместо того чтобы открывать телефонную книжку, нажимать номер и слушать, пока система пытается соединить с нужным человеком, пользователь дает команду в приложении Gemini: «Сделай мне звонок в [название компании] и спроси, есть ли на складе товар X» или «Забронируй столик в ресторане Y».

ИИ самостоятельно инициирует соединение. Gemini распознает свой голос, вводит себя в качестве пользователя и начинает диалог. Система способна ориентироваться в сложных многоярусных автоматических меню (IVR), выбирать нужные опции и дозвониться до человека за стойкой. Если приходится ждать ответа оператора, ассистент не отключает звонок, а ждет своей очереди для начала разговора.

Контроль остается в ваших руках

Одной из ключевых особенностей этого эксперимента является сохранение контроля над ситуацией. Пользователь может следить за ходом разговора через интерфейс приложения, где отображается живой транскрипт — текстовая расшифровка происходящего в реальном времени. Если ИИ начинает делать ошибку, теряет контекст или говорит не то, владелец телефона может в любой момент перехватить управление разговором и взять его на себя.

Эта возможность была добавлена не случайно. В прошлом году Google запуская предыдущую версию функции, которая также позволяла делать звонки за пользователя, но без опции ручного перехвата, столкнулась с ограничениями доверия пользователей. Теперь же, имея возможность следить за диалогом и вмешиваться, пользователи получают уверенность в том, что автоматизация не нарушит их волю.

Технические детали и ограничения распространения

Важно понимать текущий статус этой разработки: это «early preview» (предварительный просмотр ранней стадии). Доступ к функции имеют только избранные пользователи. Согласно официальным данным, эксперимент запущен в США и ограничен:

1. Устройства: Только смартфоны Google Pixel 11 и выше. 2. Статус подписки: Требуется подписка на платные функции Gemini. 3. Бета-тестирование: Необходимо быть зарегистрированным в программе «Phone by Google Public Beta».

Google подчеркивает, что это тестовый период, цель которого — отточить алгоритмы, повысить точность распознавания речи и убедиться, что ИИ корректно интерпретирует намерения пользователя. О масштабировании функции на другие устройства или другие страны пока речи не идет.

Сравним этот шаг с действиями конкурентов. Например, Meta активно работает над своим AI-агентом Muse. Отчеты указывают, что функция Muse также может совершать звонки за пользователя, но детали реализации отличаются. В некоторых интерпретациях работы Muse звонок может совершать не сам ИИ, а человеческий оператор, управляемый системой, что ставит под вопрос полную автоматизацию, которая декларируется в случае с Gemini.

Будущее голосовых интерфейсов

Запуск этой функции на Pixel 11 знаменует важный этап в эволюции пользовательского опыта. Мы переходим от модели, когда человек — единственный активный участник диалога с устройством, к модели партнерства. Смартфон становится не просто инструментом набора номера, а активным агентом, способным выполнять рутинные социальные задачи.

Тем не менее, стоит сохранять скептицизм по поводу точности таких систем. Живой транскрипт — это мощный инструмент контроля, но он не всегда идеален. Ошибки распознавания, особенно в шумной обстановке или при нечеткой речи оператора, могут приводить к неверным действиям ИИ. Возможность ручного перехвата разговора служит буфером против таких сбоев, но полностью исключить их пока невозможно.

Для бизнеса этот эксперимент открывает новые горизонты. Уменьшение времени ожидания и нагрузки на кол-центры может привести к повышению эффективности обработки запросов. Однако компании также должны быть готовы к тому, что ИИ может задавать вопросы, которые оператор не умеет отвечать, или вести разговор в стиле, который компания считает слишком механическим.

Google продолжает развивать экосистему вокруг Gemini, стремясь интегрировать его возможности во все сферы жизни: от управления умным домом до помощи в обучении. Этот эксперимент с телефонными звонками лишь один из многих кирпичиков в здании будущего, где искусственный интеллект берет на себя рутину, освобождая человека для более сложных задач. Пока что это инструмент для избранных тестировщиков, но перспективы его использования выглядят многообещающими.

Первоисточники

The Verge AI ↗
← Вернуться в эфир