ИИ ИИшка Про
Новости
Google Cloud

Google представила Gemini agent для рабочих систем: что показали и чего пока не доказали

Редакция ИИШКА Про
Иллюстрация к материалу: Google представила Gemini agent для рабочих систем: что показали и чего пока не доказали

8 октября Google Cloud представила Gemini agent как универсального помощника для работы внутри корпоративных систем. Из объявления следует, что пользователь начинает задачу в одном окне, а агент может планировать действия, выбирать подходящую модель, обращаться к инструментам и возвращать результат туда, где человек уже работает: в документы, почту или среду разработчика. Это объявление о продуктовой платформе, а не свидетельство, что любая компания завтра получит одинаковые возможности или сможет безопасно включить все подключения одним переключателем.

Что именно объявили

Google описывает агент как слой поверх бизнес-контекста организации. Важная часть здесь не диалоговое окно, а доступ к внутренним данным и действиям. Если попросить подготовить отчёт, агенту может понадобиться найти исходные записи, выбрать расчёт, собрать документ и вернуть его на согласование. Компания отдельно подчёркивает управление стоимостью, администрирование и политики безопасности. Конкретный набор подключений, доступность функций и тарифы нужно проверять для своего договора и региона: короткий анонс не раскрывает всех условий.

Отдельно стоит различать модель Gemini и Gemini agent. Модель генерирует текст, код или другие ответы в пределах запроса. Агент добавляет планирование, инструменты и переход между системами. Поэтому тест «он хорошо ответил на вопрос» не доказывает, что он корректно работает с календарём или не перепутает права на два проекта. Для оценки агента нужны не только ответы, но и журнал вызовов, промежуточные решения и возможность остановить выполнение.

Почему единое окно не решает старую проблему доступа

У сотрудника может быть право просмотреть договор, но не право отправить его внешнему адресату. Если агент наследует доступ к документу и одновременно получает отправку почты, возникает новая комбинация действий. Она не становится безопасной лишь потому, что оба разрешения по отдельности законны. Команде придётся определить границы: что агенту можно читать, что можно менять, а что обязательно подтверждает человек. В нашей новости о проверке агентных рисков показано, почему регулятор обращает внимание именно на маршрут данных и реальные действия.

Представьте финансовый отдел, который просит «подготовить сводку просроченной дебиторки». Нормальный результат — таблица с источниками и черновик письма ответственному. Плохой результат — отправка клиентам без проверки адресов или включение персональных данных, не нужных для сводки. Один и тот же запрос можно реализовать в двух режимах: чтение и подготовка черновика либо автономное выполнение. Второй режим требует гораздо более строгого тестирования и объяснимого журнала.

Как провести пилот без дорогой интеграции всего сразу

Выберите задачу с низкой ценой ошибки и понятным эталоном: например, обновление внутренней памятки по уже утверждённым документам. Соберите пять реальных запросов, пять ответов, которые сотрудники сочли правильными, и список запрещённых действий. Начните только с чтения документов. Попросите агента показать, из каких файлов он взял каждое существенное утверждение и какие инструменты вызвал. Не подключайте почту, платежи или права изменения ради демонстрации одной возможности.

Следующий шаг — сравнить с прежним процессом. Сколько времени занял принятый человеком итог? Сколько исправлений потребовалось? Нашёл ли агент актуальную версию файла или сослался на прошлогоднюю? Придумал ли имя ответственного? Если тестовая выборка содержит только идеальные документы, результат будет слишком оптимистичным. Добавьте устаревшую инструкцию, конфликтующие версии и файл с текстом, который пытается выдать себя за команду. Защита от такой подмены разобрана в гайде по prompt injection.

Стоимость складывается не только из вызовов модели

Фраза о встроенном контроле расходов полезна, но ей нельзя заменять бюджет пилота. Подсчитайте число запросов, объём документов, повторные попытки, хранение журналов и время человека на проверку. Агент может выполнять несколько действий там, где раньше был один запрос. Это увеличивает не только стоимость вычислений, но и площадь ошибки. Сравнивать следует цену принятой работы, а не стоимость одного ответа. Метод такого сравнения применим и к выбору между облачным и локальным процессом, хотя задача здесь иная.

Не менее важен выход из пилота. Кто отключает доступ, если сценарий не оправдался? Как отозвать токены и проверить, что копии документов не остались в непонятном месте? Какие логи доступны администратору после завершения задачи? Эти вопросы скучнее демонстрации, но именно они отделяют эксперимент от внедрения. До ответа на них не стоит давать агенту автономные действия в критических процессах.

Что означает объявление для обычной команды

Google наметила направление: один агент должен помогать переходить между привычными рабочими программами с централизованным управлением. Пока это обещание возможностей платформы, а не независимый тест точности в конкретной компании. Разумный следующий шаг — выбрать один процесс, зафиксировать права, эталонный результат и критерий остановки. Если пилот приносит проверяемую пользу в режиме черновика, можно постепенно расширять права; если нет, достаточно оставить обычный поиск и ручную работу.

Частые вопросы

Gemini agent — это новая отдельная модель?

Нет. В сообщении Google речь о рабочем агенте, который использует модели, инструменты и корпоративные подключения. Оценивать его нужно по выполненному процессу, а не только по качеству текста.

Можно ли сразу разрешить отправку писем?

Лучше начать с черновиков и подтверждения человеком. Ошибка получателя или вложения может быть важнее скорости подготовки письма.

Объявлена ли одинаковая доступность для всех компаний?

Нет. Короткое сообщение не даёт универсального перечня тарифов, регионов и подключений. Их нужно проверять в актуальных условиях своего корпоративного продукта.

Новости ICO проверяет защиту данных в ИИ-агентах Британский регулятор сообщил о переменах у десяти разработчиков базовых моделей и начал собирать сведения о рисках автономных агентов. Новости ChatGPT получил Intelligent UI: когда ответ превращается в рабочий интерфейс OpenAI показала ответы с кнопками, графиками и небольшими интерактивными инструментами. Разбираем, что объявлено и какие границы у нового формата. Новости Как ИИ использовали для фальшивых редакций: что показало расследование OpenAI OpenAI описала две операции, в которых вымышленные организации и авторы пытались придать политическим сообщениям вид независимой журналистики. Разбираем признаки и границы доказанного. Новости Anthropic расширила программу доступа для специалистов по кибербезопасности: что изменилось Обновлённая программа разделяет доступ к киберфункциям Claude на три уровня и предназначена для прошедших отбор специалистов. Разбираем, что это даёт защитникам и чего не означает для обычного пользователя.
Опубликовано: 9 октября 18:31
← На главную