ИнфраструктураAI GatewayGoRustLLM RoutingMCPNext.js
Helium AI Router
Высокопроизводительный OpenAI-совместимый LLM-шлюз, MCP SSE сервер и движок многомодельного консенсуса.
40+
Поддерживаемых моделей
1M
Максимальный контекст
< 1.2 с
Edge TTFT
О проекте
Helium (router.y7.hk) — отказоустойчивый API-шлюз и оркестратор языковых моделей корпоративного уровня, предоставляющий единую точку доступа к более чем 40 передовым нейросетям. Выступая drop-in заменой OpenAI API (/v1) и полнофункциональным сервером протокола Model Context Protocol (MCP SSE), Helium объединяет мощности Google Antigravity (Gemini 3.8, Claude 4.6), Xiaomi MiMo, DeepSeek V4, Alibaba Qwen и xAI Grok.
Архитектура и ключевые возможности
- Синхронизация с протоколом Antigravity: Нативная интеграция с Cloud Code API с синглтон-пулом аккаунтов, защитой от сброса квот, выравниванием бюджета рассуждений и 3-секундным SSE Heartbeat.
- Auto-Healing пустого Thinking: Автоматический перехват выпадений моделей на больших контекстах: если модель потратила токены только на скрытые мысли, шлюз на лету выполняет дозапрос внутри активного стрима без ошибок для клиента.
- Wave Multi-Model Consensus Engine: Параллельный опрос нескольких моделей-экспертов с синтезом финального ответа в реальном времени (от быстрых связок до многоступенчатых пайплайнов
wave/ghost). - Полноценный MCP SSE Сервер: Протокол взаимодействия для AI-ассистентов с тулами выполнения SQL-аналитики, замера TTFT задержек и выпуска API-ключей.
- Real-Time телеметрия: Веб-дашборд в эстетике Nothing Phone на Next.js 16 и GSAP с отображением скорости генерации токенов в 10-секундном окне, активных сессий и Sankey-диаграммой маршрутизации.
Результаты
Helium служит единым инфраструктурным ядром для автономных ИИ-агентов и разработчиков, обрабатывая миллионы токенов в сутки с мгновенным автоматическим переключением провайдеров и прозрачным контролем расходов.