Теперь ИИ-агенты Google могут работать за вас — буквально перемещая курсор, открывая окна и выполняя действия на компьютере. Gemini 3.5 Flash научилась полностью управлять рабочим пространством через удалённый браузер, и Google уже предлагает протестировать эту функцию корпоративным пользователям. Но вместе с новой возможностью возникает и новый уровень риска. Компания Google продолжает превращать свои ИИ-модели из «умных собеседников» в полноценных цифровых помощников, способных выполнять действия вместо пользователя. На этот раз речь идёт не просто о генерации текста или ответах на вопросы — Gemini 3.5 Flash получила возможность управлять компьютером в прямом смысле этого слова. От чат-бота к цифровому ассистенту с руками Раньше для запуска пользовательских ИИ-агентов, которые могли бы взаимодействовать с интерфейсами, требовалась специальная версия модели Gemini 2.5. Теперь Google упростила процесс: новую функцию управления компьютером можно подключить через стандартный API Gemini или через корпоративную платформу Gemini Enterprise Agent Platform. Суть проста: Gemini 3.5 Flash способна ориентироваться в пользовательском пространстве, самостоятельно выполнять действия в соответствии с текстовыми запросами и выдавать результаты. Компания предлагает опробовать эту возможность через экземпляр удалённого браузера на платформе Browserbase — то есть модель работает не где-то в абстрактном облаке, а непосредственно в браузерной среде, имитирующей поведение реального пользователя. Представьте: вы даёте команду «найди в почте письмо от такого-то клиента, извлеки из него прикреплённый файл, сохрани в папку «Проекты» и отправь ссылку коллеге в чат». Gemini 3.5 Flash может выполнить всю эту цепочку действий самостоятельно — как если бы за компьютером сидел стажёр, которому вы подробно объяснили задачу. Агентные сценарии нового уровня Это шаг в сторону того, что в индустрии называют «агентным ИИ» — когда модель не просто генерирует ответ, а выполняет последовательность взаимосвязанных действий, адаптируясь к изменениям на экране. Для бизнеса это открывает колоссальные возможности: автоматизация рутинных задач, работа с документами, взаимодействие между разными сервисами без участия человека. Интеграция с приложениями Workspace (Gmail, Docs, Drive, Calendar) также расширяется, что делает Gemini естественной частью рабочего процесса. Всё это вписывается в стратегию Google, которая давно движется от продажи отдельных ИИ-инструментов к созданию полноценной экосистемы для корпоративных клиентов. Вопрос безопасности: как Google защищает пользователей Однако способность ИИ-модели управлять компьютером вызывает очевидные и серьёзные вопросы о безопасности. Если модель может открывать файлы, перемещать данные, отправлять письма и нажимать кнопки, злоумышленник, получивший доступ к ней, может натворить немало бед. Google осознаёт этот риск. Компания применила несколько слоёв защиты, чтобы свести угрозы к минимуму. Во-первых, модель прошла целевое обучение с использованием состязательных методов. Это означает, что её специально тренировали на попытках взлома или обмана — чтобы она научилась распознавать атаки и противостоять им. Во-вторых, встроены механизмы явного подтверждения. Gemini 3.5 Flash запрашивает разрешение пользователя перед выполнением конфиденциальных или необратимых действий. Например, перед удалением файла, отправкой письма с важным вложением или изменением системных настроек модель остановится и спросит: «Вы действительно хотите это сделать?». В-третьих, модель способна самостоятельно останавливать выполнение задачи при обнаружении атаки с внедрением запроса — когда злоумышленник пытается встроить вредоносную команду в легитимный запрос. Однако Google не ограничивается встроенной защитой. Компания рекомендует корпоративным пользователям применять дополнительные меры: Что это значит для рынка? Запуск Gemini 3.5 Flash с функцией управления компьютером — это ещё один шаг в гонке ИИ-агентов. OpenAI уже демонстрировала операторные возможности, Anthropic встроила подобные функции в Claude, и теперь Google догоняет и перегоняет конкурентов в этой области. Для бизнеса это означает, что скоро значительная часть рутинной работы может быть передана ИИ-агентам. Для производителей ПО и платформ — необходимость пересматривать подходы к интерфейсам и безопасности. Для регуляторов — новый вызов: как контролировать ИИ, который может действовать от имени человека и с его правами доступа. Google пока предлагает функцию в рамках ограниченного доступа, но уже понятно, что это направление станет одним из ключевых в 2026 году. Агенты, которые умеют не только думать, но и делать, — это следующий этап эволюции генеративного ИИ. И Google намерена быть в авангарде.