Перейти к содержанию

Поддержка Gemini API, новые модели, streaming и страница статуса

Крупный релиз Nexus API существенно расширяет экосистему поддерживаемых протоколов: добавлена нативная совместимость с Gemini API, новые линейки моделей GPT-5.6 и Gemini 3, поддержка streaming для Chat Completions, стандарты стабильности соединений и публичная страница статуса сервиса.

Новые возможности

Нативная поддержка Gemini API и новые модели

  • Добавлены эндпоинты протокола Gemini: генерация текста (POST /v1beta/models/{model}:generateContent), потоковая генерация (POST /v1beta/models/{model}:streamGenerateContent), подсчёт токенов (POST /v1beta/models/{model}:countTokens), а также обнаружение моделей GET /v1beta/models и GET /v1beta/models/{model}.
  • В каталог и Telegram-бот добавлено семейство моделей Gemini: Gemini 3 Flash, Gemini 3.5 Flash, Gemini 3.1 Pro Preview и Gemini 3.1 Flash Image Preview.
  • Семейство Gemini выделено в отдельную группу в меню Модели и карточках управления правами ключей.

Новые модели OpenAI-совместимой линейки и Streaming

  • Добавлены флагманские модели нового поколения: GPT-5.6 Luna, GPT-5.6 Terra и GPT-5.6 Sol.
  • Реализована полноценная поддержка потоковой передачи данных (streaming через Server-Sent Events) для POST /v1/chat/completions, обеспечивающая посимвольный вывод ответа в реальном времени.
  • Добавлена совместимость с устаревшими интерфейсами Completions (POST /v1/completions) и компактными псевдонимами для интеграции с ранними версиями расширений.
  • Добавлен прямой маршрут получения информации о конкретной модели GET /v1/models/{model_id}.

Публичная страница статуса сервиса

  • Запущена официальная страница статуса status.nexus-hub.tech с мониторингом доступности и задержек всех поддерживаемых эндпоинтов.
  • В главное меню Telegram-бота добавлена прямая кнопка перехода к мониторингу состояния инфраструктуры.

Стандарты стабильности соединений и обработки ошибок

  • Внедрена политика обработки долгих генераций: корректная обработка пауз между фрагментами потока (chunks) и предотвращение ложных таймаутов.
  • Безопасная обработка раннего отключения клиента: прерванный запрос не приводит к зависанию ресурсов или некорректным списаниям.
  • Стандартизирован формат сообщений об ошибках: каждый ответ содержит уникальный идентификатор request_id для быстрой диагностики в поддержке.

Улучшения

Снижение цен и тарификация

  • Проведено масштабное снижение базовых тарифов на 5–15% для большинства популярных моделей.
  • Пользователям, зарегистрированным до релиза, автоматически начислен бонусный баланс.
  • Таблица цен в боте оптимизирована: скрыты сопутствующие эндпоинты без отдельной тарификации, а многоформатные модели объединены в общую строку.

Совместимость с инструментами разработки

  • Улучшена стабильность работы с популярными инструментами: Codex CLI, Claude Code, VS Code, Zed, JetBrains, OpenCode и кастомными агентами.

Исправленные ошибки

API и протоколы

  • Исправлены пустые ответы и расхождения форматов в Legacy Completions и компактных моделях.
  • Прекращена передача клиентского заголовка User-Agent во внешние шлюзы для защиты конфиденциальности окружения пользователя.
  • Исправлено сохранение итоговой статистики использования токенов при streaming в Chat Completions.

Каталог и бот

  • Устранено нарушение порядка отображения моделей при параллельных запросах к каталогу.
  • Исправлена привязка кнопок страницы статуса в клавиатурах Telegram-бота.

Совместимость и действия пользователя

  • Существующие API-ключи и базовые URL полностью совместимы со всеми новыми возможностями; перевыпуск ключей не требуется.
  • Для подключения клиентов к Gemini API используйте стандартные базовые URL и эндпоинты семейства /v1beta/ с ключом Nexus Hub.
  • Ознакомьтесь с актуальным справочником API и руководствами по клиентам.