Содержание
Google Cloud упростила переключение между AI-моделями
Google Cloud открыла публичное тестирование маршрутизации AI-моделей в API Gateway. Теперь приложение может отправлять стандартные OpenAI-совместимые запросы в единую точку входа, а шлюз направит их к нужной модели — Gemini, Claude или OpenAI OSS-GPT, размещённой в инфраструктуре Google.
Что изменилось для разработчиков
Раньше для работы с несколькими моделями приходилось жёстко прописывать разные адреса API или поддерживать отдельный прокси-сервис. В новом варианте виртуальные названия моделей и правила маршрутизации задаются прямо в спецификации OpenAPI 3.x. После развёртывания API Gateway перехватывает запрос, преобразует его в нативный формат выбранной модели и отправляет дальше.
Это позволяет менять модель для конкретного сценария без переделки клиентского приложения: например, оставить Gemini моделью по умолчанию, а для отдельных запросов выбирать Claude. Аналогично можно собрать маршрут между OpenAI OSS-GPT и Gemini.
Зачем это бизнесу и AI-командам
Единый шлюз снижает зависимость продукта от одной модели и упрощает эксперименты с качеством, скоростью и стоимостью. API Gateway можно использовать отдельно для ограничения частоты запросов и учёта токенов либо связать с Gemini Enterprise Agent Platform: Agent Gateway отвечает за политики безопасности, а API Gateway — за выбор модели.
Важное ограничение
Маршрутизация работает между бэкендами на одном общем хосте, например aiplatform.googleapis.com. Это не универсальный переключатель между API разных компаний в интернете: речь идёт о моделях, доступных через Google Cloud. Функция уже доступна в статусе Public Preview.