Теги

Новости по тегу "google"

RSS-лента
Абстрактная редакционная схема: три пути маршрутизации генерации изображений — скорость, баланс, качество — сходятся в единой точке AI gateway

Nano Banana 2 Lite — новый дефолтный эндпоинт Gemini для изображений: фреймворк принятия решений по маршрутизации

Nano Banana 2 Lite (gemini-3.1-flash-lite-image) вышел 30 июня по $0,034/тыс. изображений при задержке 4 секунды. Если вы ещё маршрутизируете на gemini-2.5-flash-image — вы на устаревшей модели. Трёхуровневый routing-фреймворк для operator teams.

источник Google DeepMind
Семь путей маршрутизации сходятся в единый узел пропускной способности, иллюстрируя новую поддержку очереди заказов Gemini

Gemini Provisioned Throughput теперь поддерживает очередь из 7 заказов: что GA-релиз мультизаказов меняет для команд маршрутизации

1 июля Google перевёл поддержку нескольких ожидающих заказов Provisioned Throughput в статус GA — теперь можно одновременно ставить в очередь до 7 заказов на одну модель и регион, устраняя последовательный 10-дневный цикл активации.

источник Google
Техническая схема, показывающая два временных горизонта устаревания endpoint'ов Gemini Image API с датами отключения 25 июня и 17 августа как контрольными точками миграции для инженерных команд

Gemini API Image Generation 2026: как исправить failed to fetch после отключения preview-моделей

В 2026 году Gemini API проходит две миграции: после cutoff 25 июня preview-модели вызывают сбои failed to fetch, а GA-endpoint’ы Imagen 4 отключаются 17 августа. Проверьте model ID, перейдите на gemini-3.1-flash-image или gemini-3-pro-image и протестируйте generateContent.

источник Google AI for Developers
Редакционная иллюстрация глобуса с разделёнными региональными и глобальными маршрутами передачи данных и индикаторами стоимости

Ценообразование Gemini для не-глобальных эндпоинтов вступает в силу 1 июля: 10% региональная надбавка, которую каждая команда должна учесть в роутинге

С 1 июля 2026 года Gemini 3 и последующие модели получают 10% надбавку для не-глобальных (региональных) эндпоинтов. Командам, направляющим трафик в eu-west1, asia-northeast1 и аналогичные регионы, необходимо немедленно пересмотреть модели расходов.

источник Google Cloud
Сдержанная редакционная инфографика: структурированный policy-шлюз перехватывает tool call агента, нейтральная палитра с акцентами TheRouter

Gemini Semantic Governance Policy в Public Preview: runtime-блокировка инструментальных вызовов агентов

SGP-движок от Google теперь стоит между моделью и инструментами — блокирует вызовы, не соответствующие намерению пользователя или нарушающие бизнес-правила, сформулированные на обычном английском языке, без перезапуска кода агента.

источник Google Cloud Gemini Enterprise Agent Platform
Редакционная иллюстрация контрольного пункта gateway, фильтрующего потоки трафика агентов, в матовых нейтральных тонах с акцентными линиями TheRouter

Gemini Model Armor Agent Gateway Content Security теперь в статусе GA: что необходимо настроить каждой routing-команде

Google перевёл Model Armor на Agent Gateway в статус General Availability, встраивая защиту от prompt injection и контентное сканирование напрямую в каждый поток трафика агентов — без изменений кода агентов.

источник Google Cloud Gemini Enterprise Agent Platform
Диаграмма безопасности gateway, показывающая прохождение API-ключа Gemini через точку проверки ограничений с одобренным и заблокированным каналами

Ограничение API-ключей Gemini вступило в силу: что нужно проверить командам маршрутизации

С 19 июня 2026 года Google перестал принимать неограниченные API-ключи Gemini. Любой ключ без явных ограничений API теперь возвращает ошибку. Вот что операторам, маршрутизирующим трафик через gateway к Gemini, необходимо проверить в конфигурации учётных данных.

источник Google AI Developers Forum
Редакционная иллюстрация: дерево решений между модульными skills и workflow agents в корпоративной AI-среде с маршрутами и узлами согласования

Gemini Enterprise получает Workflow Agents и модульные Skills: архитектурное решение, которое меняет план развёртывания корпоративного AI

Google перевела workflow agents и skills в Gemini Enterprise в GA (allowlist). Skills — модульные, workflow agents — триггерные. Архитектурное решение и routing-последствия для команд.

источник Google Cloud
Абстрактная редакционная иллюстрация многорегиональной маршрутизации памяти AI-агентов через глобальные узлы, представляющая выход Memory Bank GA в Gemini Enterprise Agent Platform

Gemini Memory Bank GA: как работает агентская память Google Agent Platform, Sessions и глобальная маршрутизация (июнь 2026)

Gemini Memory Bank — это управляемый слой памяти Google для AI-агентов, который 17 июня вышел в GA с глобальными endpoint-ами. Разбираем устройство agent platform memory bank, сессии (Sessions), ограничение CMEK и routing-политику для stateful-агентов.

источник Gemini Enterprise Agent Platform
Абстрактная редакционная иллюстрация: интерфейс терминала CLI на развилке дорог — символ отключения Gemini CLI и выбора между Antigravity CLI и мультипровайдерными альтернативами

Gemini CLI прекращает работу 18 июня: у вашей команды есть 3 дня, чтобы принять решение о routing CLI-агентов

18 июня Gemini CLI прекращает работу для потребительских аккаунтов. Прежде чем мигрировать на Antigravity CLI по умолчанию, разберитесь: unified-backend означает отказ от provider-независимости — и как multi-provider routing через Claude Code меняет выбор.

источник Google Developers Blog
Vertex AI Extensions объявлены устаревшими: миграция на Gemini Enterprise Agent Platform до ноября 2026

Vertex AI Extensions закроется 26 ноября: три пути миграции на Agent Platform

Google объявила об отказе от Vertex AI Extensions 26 мая 2026 года — жёсткое отключение запланировано на 26 ноября. Команды, использующие agent-воркфлоу на Google, обязаны мигрировать Code Interpreter, Search и Custom Extensions на Gemini Enterprise Agent Platform до дедлайна.

источник Google Cloud Vertex AI Release Notes
Абстрактная схема уровня маршрутизации для перевода голоса в реальном времени: волновая форма и языковые узлы

Gemini 3.5 Live Translate API: голосовой перевод в реальном времени выходит на уровень маршрутизации

Google Gemini 3.5 Live Translate стал доступен в публичном предварительном выпуске через Gemini API — непрерывный перевод речи в 70+ языках. Что новый model ID значит для команд маршрутизации voice-agent.

источник Google DeepMind
Схема маршрутизации, показывающая путь миграции с Vertex AI SDK на Google Gen AI SDK с индикатором обратного отсчёта

Vertex AI SDK устарел: дедлайн миграции — 24 июня 2026 г. — что нужно знать routing-командам

Генеративный Vertex AI SDK устарел — его модули будут удалены 24 июня 2026 г. Если ваша команда маршрутизирует трафик в Google через vertexai.generative_models или связанные импорты, вот что именно нужно мигрировать, чтобы код продолжил работать.

источник Google Cloud
Абстрактная редакционная иллюстрация обратного отсчёта таймлайна с переходом жизненного цикла моделей и решениями по routing-путям

Gemini 2.0 Flash отключена (EOL, июнь 2026): что заменило и что делать сейчас

Gemini 2.0 Flash и Flash-Lite достигли конца жизненного цикла 1 июня 2026 года — отключение завершено. Здесь: какие model ID удалены, какие замены (gemini-2.5-flash-lite, gemini-3.1-flash-lite) реально работают как альтернатива, реальная разница в стоимости и быстрый…

источник Google AI for Developers
Абстрактная схема routing: слой оркестрации мульти-агентов, соединённый с Gemini API и OpenAI-совместимыми эндпоинтами

Google Antigravity и Managed Agents перекраивают Gemini API: что это значит для вашей routing-архитектуры

На Google I/O 2026 вышли Antigravity 2.0, Managed Agents в Gemini API и новый Interactions API, поднимающий изолированные Linux-окружения для агентов одним вызовом. Для команд с multi-provider routing последствия глубже, чем переименование CLI.

источник Google Developers Blog
Абстрактная редакционная иллюстрация: многоуровневые routing-решения и cost-aware политика AI-provider-ов

Gemini 3.5 Flash — это уже не Flash-модель: что ценовая перестройка Google значит для вашей routing-политики

Google запустила Gemini 3.5 Flash по «$1,50»/«$9» за миллион токенов — в 3–6 раз дороже предыдущих Flash-уровней. В связке с новым серверным Interactions API это переписывает то, что routing-команды должны считать про Gemini Flash.

источник Google AI Blog
Помощь и контакты