ИИ-агент Gemini Spark получил доступ к Chrome для автономного веб-сёрфинга, а AI Pro выходит на глобальный рынок
Google расширяет возможности своей линейки ассистентов: агент Gemini Spark научился самостоятельно работать с браузером Chrome, открывая веб-страницы и выполняя действия по команде пользователя. Одновременно компания объявила о запуске подписки AI Pro во всём мире, что делает продвинутые модели доступными за пределами США.
В начале недели Google официально анонсировала новую функциональность для своего ИИ-агента Gemini Spark, который теперь может использовать браузер Chrome для автоматического просмотра веб-страниц. Это означает, что агент способен не просто отвечать на текстовые запросы, а самостоятельно открывать сайты, кликать по элементам интерфейса, заполнять формы и извлекать нужную информацию. По замыслу разработчиков, такое решение превращает ассистента в полноценного посредника между человеком и вебом, который может выполнять рутинные операции без постоянного контроля со стороны владельца. Параллельно Google сообщила о том, что подписка AI Pro становится общедоступной для пользователей по всему миру, снимая ранее действовавшие региональные ограничения.
Новая возможность Gemini Spark основана на интеграции с браузером Chrome, которая позволяет агенту получать доступ к текущей вкладке и выполнять действия в реальном времени. В демонстрационных сценариях агент успешно бронировал билеты на мероприятия, сравнивал цены на товары в разных интернет-магазинах и подписывался на рассылки — всё это происходило в окне браузера, где пользователь мог наблюдать за процессом. В отличие от обычных расширений, Gemini Spark понимает контекст страницы и способен адаптироваться к изменениям в вёрстке, что делает его более гибким инструментом для автоматизации. Для работы потребуется активная подписка AI Pro, которая включает приоритетный доступ к новейшим моделям Google и увеличенные лимиты на количество запросов. Базовая версия ассистента сохранит прежние функции, но без браузерной автоматизации.
Технически интеграция реализована через специальный API, связывающий Gemini Spark с Chrome DevTools Protocol, который давно используется разработчиками для тестирования веб-приложений. Агент получает снимок страницы, анализирует её структуру и принимает решение о следующем шаге, будь то нажатие кнопки, переход по ссылке или ввод текста в поле. При этом пользователь может в любой момент вмешаться в процесс, остановив агента или указав ему конкретное направление. Google подчёркивает, что все действия агента логируются, а для конфиденциальных операций — таких как оплата или авторизация — требуется явное подтверждение человека. Компания также заявляет, что Gemini Spark обучался на большом объёме веб-страниц и знает типовые шаблоны интерфейсов, что снижает количество ошибок при работе с незнакомыми сайтами.
Данное объявление продолжает серию шагов Google в области автономных ИИ-агентов, начатую ещё в прошлом году с проекта Mariner, который тестировался в рамках экспериментальной программы. Тогда агент мог выполнять простые операции в браузере, но был ограничен набором разрешённых сайтов и требовал частого подтверждения действий. Теперь компания решила довести технологию до коммерческого продукта, встроив её в основную линейку Gemini. Конкурентная борьба в этом сегменте обостряется: OpenAI предлагает Operator для работы с веб-страницами, Anthropic разрабатывает функцию computer use для Claude, а Microsoft тестирует аналогичные возможности в Copilot. Каждая из компаний делает ставку на то, что именно агенты станут следующим интерфейсом взаимодействия человека с компьютером.
Для российских пользователей новость носит двойственный характер. С одной стороны, Google формально не приостанавливала доступ к базовым функциям Gemini на территории страны, и подписка AI Pro может быть оформлена через зарубежные аккаунты. С другой стороны, полноценная работа с Chrome и интеграция агента могут быть ограничены технически из-за блокировок отдельных сервисов и особенностей локальной сетевой инфраструктуры. В российском сегменте рынка уже существуют отечественные аналоги, такие как ассистенты на базе Yandex GPT, которые предлагают схожие сценарии автоматизации, но не имеют глубокой браузерной интеграции. Эксперты отмечают, что сдерживающим фактором для внедрения таких агентов становится не столько технология, сколько вопросы доверия и безопасности: не каждый пользователь готов передавать управление своим браузером искусственному интеллекту.
Сравнивая Gemini Spark с альтернативами, стоит отметить, что Google имеет преимущество за счёт тесной связи с Chrome — самым популярным браузером в мире, по данным StatCounter. Это позволяет агенту работать с огромным количеством сайтов без необходимости устанавливать отдельные плагины или расширения. Однако у OpenAI Operator своя фишка — он выполняется в облаке и не требует, чтобы браузер был открыт на устройстве пользователя. Anthropic, в свою очередь, делает акцент на безопасности и возможности точного контроля над действиями модели. На практике выбор между этими решениями часто зависит от конкретной задачи: для личного использования удобнее локальный агент в Chrome, тогда как для массовых операций, таких как мониторинг цен или сбор данных, более подходит облачный вариант.
В ближайшие месяцы Google планирует расширить список поддерживаемых действий Gemini Spark, добавив возможность работы с PDF-файлами и сложными веб-приложениями, включая корпоративные CRM-системы. Компания также обещает выпустить мобильную версию агента, которая сможет взаимодействовать с Chrome для Android. Остаётся открытым вопрос о том, как подобные технологии повлияют на рынок веб-разработки: разработчикам, возможно, придётся адаптировать интерфейсы для корректного взаимодействия с ИИ-агентами. Также неясно, насколько активно пользователи будут платить за расширенные функции в рамках AI Pro, учитывая, что конкуренты предлагают сопоставимые возможности по аналогичной цене. Ясно лишь одно: гонка автономных ИИ-агентов вышла на новый уровень, и теперь она напрямую затрагивает повседневный опыт обычных пользователей интернета.