Управляемые агенты Gemini: что нового в версии с 3.6 Flash, хуками окружения и контролем бюджета
Google DeepMind обновил управляемых агентов в Gemini API: модель 3.6 Flash по умолчанию, хуки окружения для проверки безопасности, контроль бюджета токенов и планировщик задач. Разбираем, как это снижает затраты и защищает от неконтролируемых действий агентов.
Что изменилось в Managed Agents: главные обновления за один взгляд
Google DeepMind обновил управляемых агентов в Gemini API. Модель Gemini 3.6 Flash теперь используется по умолчанию, появились хуки окружения для проверки безопасности, контроль бюджета токенов и планировщик задач по расписанию. Эти инструменты решают три главные проблемы разработчиков: непредсказуемое поведение агентов, риск перерасхода средств и отсутствие гибкой автоматизации.
Хуки окружения позволяют запускать пользовательские скрипты до или после каждого вызова инструмента. Контроль бюджета задаёт жёсткий лимит на суммарное количество токенов. Планировщик с cron-триггерами запускает агентов по расписанию без ручного вмешательства. Все функции доступны в бесплатных проектах.
Это обновление продолжает стратегию Google, которую мы разбирали в статье о новых моделях Gemini: ставка на практическую эффективность и снижение затрат вместо погони за бенчмарками.
Gemini 3.6 Flash: почему теперь это базовая модель для агентов
Gemini 3.6 Flash стала моделью по умолчанию в Managed Agents. Это решение основано на сбалансированной производительности: модель одинаково хорошо справляется с задачами рассуждения, программирования и работы с инструментами. Разработчику не нужно выбирать между скоростью и качеством, агент получает оптимизированную конфигурацию сразу после запуска.
Переход на 3.6 Flash даёт два практических результата. Первый: сокращение расхода токенов. По данным Google, модель потребляет на 17% меньше выходных токенов по сравнению с предыдущей версией. В задачах программирования экономия достигает 65%. Второй: улучшенная работа с многоэтапными задачами. Агент реже прерывает цепочку действий и чаще доводит задачу до конца.
В материале о трёх новых моделях Gemini мы подробно разбирали характеристики 3.6 Flash. Если вы только начинаете работать с агентами, эта модель снимет вопрос выбора конфигурации: вы получаете проверенную связку из коробки.
Хуки окружения: как добавить собственные проверки безопасности в агента
Хуки окружения, или environment hooks, это пользовательские скрипты, которые запускаются до или после каждого вызова инструмента агентом. Они работают внутри изолированной песочницы и позволяют контролировать действия агента без изменения его основного кода.
Сценарии применения: блокировка подозрительных операций, проверка сгенерированного кода на соответствие стандартам, аудит действий агента для последующего анализа. Разработчик пишет скрипт с правилами, агент выполняет его автоматически при каждом обращении к инструменту. Это решает проблему неконтролируемых действий, которая раньше требовала ручного мониторинга или сложных обёрток.
Как это работает: песочница и точки входа для скриптов
Изолированная песочница - это среда выполнения хуков, отделённая от основного процесса агента. Она предотвращает влияние скриптов на стабильность системы и ограничивает доступ к внешним ресурсам.
Хуки встраиваются в две точки: pre-tool-call (перед вызовом инструмента) и post-tool-call (после вызова). Pre-tool-call проверяет запрос до его выполнения. Например, скрипт анализирует команду на наличие опасных операций и блокирует её, если находит несоответствие правилам. Post-tool-call проверяет результат. Скрипт может сверить ответ с ожидаемым форматом, записать действие в лог или отправить уведомление.
Простой пример pre-tool-call хука на псевдокоде:
if request.operation == "delete_file" and request.file_path not in allowed_paths:
return block("Операция удаления запрещена для этого пути")
Такой хук блокирует удаление файлов за пределами разрешённых директорий. Агент получает отказ с объяснением причины и может продолжить работу по другому сценарию.
OffDeal: как AI-банк проверяет логотипы с помощью хуков
AI-банк OffDeal использует агентов для автоматической генерации презентаций. Одна из задач - размещение логотипов партнёров в слайдах. Ошибка в логотипе снижает доверие к презентации и требует ручной проверки.
OffDeal встроил post-tool-call хук, который запускается после сохранения файла. Скрипт извлекает все изображения из презентации, сверяет их с эталонными логотипами из корпоративной базы и проверяет корректность размещения. Если логотип не совпадает или расположен с нарушением брендбука, хук возвращает ошибку с указанием конкретного слайда. Агент получает это сообщение и перегенерирует проблемный элемент.
Результат: ручной контроль исключён из процесса. Презентации проходят верификацию автоматически, а сотрудники получают готовый файл без необходимости перепроверять каждый логотип. Этот кейс показывает, что хуки работают не только для безопасности, но и для бизнес-логики.
Контроль бюджета: как ограничить расход токенов и не переплачивать
Контроль бюджета задаёт лимит на суммарное количество токенов, которые агент может использовать за одну сессию. Это прямой инструмент управления затратами: вы указываете максимальный объём, и агент останавливается при его достижении.
До появления этой функции агент мог уйти в бесконечный цикл вызовов инструментов. Каждый вызов расходовал токены, счёт рос непредсказуемо. Контроль бюджета решает эту проблему жёстким ограничением. Вы настраиваете лимит, например 100 000 токенов на задачу, и получаете предсказуемый расход.
При исчерпании бюджета агент завершает работу и возвращает промежуточный результат с информацией о причине остановки. Это позволяет проанализировать, на каком этапе закончились токены, и скорректировать лимит или оптимизировать промпт. Для регулярных задач можно настроить бюджет один раз и не возвращаться к этому вопросу.
Автоматизация по расписанию и новый API для песочниц
Планировщик задач с cron-триггерами запускает агентов по расписанию. Формат cron знаком системным администраторам и разработчикам: вы задаёте периодичность в виде выражения, агент стартует в указанное время без участия человека.
Сценарии применения: ежедневная генерация отчётов, мониторинг данных с проверкой аномалий, регулярное обновление контента. Агент получает задачу, выполняет её по расписанию и сохраняет результат. Это заменяет ручной запуск для повторяющихся операций.
Отдельный API для управления песочницами даёт больше контроля над изолированными средами. Вы можете создавать, настраивать и удалять песочницы программно, задавать им параметры безопасности и доступа. Раньше песочницы были частью инфраструктуры агента и управлялись только через основные настройки. Теперь это самостоятельный ресурс с собственным жизненным циклом.
Все перечисленные функции - Gemini 3.6 Flash по умолчанию, хуки окружения, контроль бюджета и планировщик - доступны в бесплатных проектах. Это снижает порог входа для тестирования агентов и позволяет проверить гипотезы без подключения платного тарифа.
Что это значит для разработчиков: итоги и первые шаги
Managed Agents получили три важных улучшения. Безопасность: хуки окружения блокируют опасные операции и проверяют результаты до того, как они попадут в продакшен. Экономия: контроль бюджета предотвращает перерасход токенов, а Gemini 3.6 Flash снижает потребление на 17-65% в зависимости от задачи. Гибкость: планировщик автоматизирует запуск, API песочниц упрощает управление средами.
С чего начать. Попробуйте Gemini 3.6 Flash на текущих задачах, чтобы оценить разницу в расходе токенов. Настройте один хук для критически важной операции: например, проверку удаления файлов или валидацию ответа. Задайте бюджет на сессию, отталкиваясь от среднего расхода за последнюю неделю. Эти три шага займут меньше часа и сразу покажут практическую пользу обновлений.
Google последовательно расширяет возможности агентов, и мы продолжаем следить за развитием инструментов. В статье о Gemini Intelligence разбирали автоматизацию рутины в 40+ приложениях, а в материале про VS Code 1.130 - изоляцию агентов в отдельном процессе. Эти обновления формируют общий тренд: агенты становятся безопаснее и управляемее.
Есть вопрос или заметили неточность? Напишите нам - мы проверяем обратную связь и обновляем материалы.