Skip to main content
Glama
maximhq

Bifrost MCP Gateway

Official
by maximhq

Bifrost AI Gateway

Discord badge codecov Docker Pulls Artifact Hub License

La forma más rápida de crear aplicaciones de IA que nunca se caen

Bifrost es una puerta de enlace de IA de alto rendimiento que unifica el acceso a más de 23 proveedores (OpenAI, Anthropic, AWS Bedrock, Google Vertex y más) a través de una única API compatible con OpenAI. Despliegue en segundos con configuración cero y obtenga conmutación por error automática, equilibrio de carga, caché semántica y funciones de nivel empresarial.

Related MCP server: MCPGate

Inicio rápido

Get started

Pase de cero a una puerta de enlace de IA lista para producción en menos de un minuto.

Paso 1: Inicie Bifrost Gateway

# Install and run locally
npx -y @maximhq/bifrost

# Or use Docker
docker run -p 8080:8080 maximhq/bifrost

Paso 2: Configure a través de la interfaz web

# Open the built-in web interface
open http://localhost:8080

Paso 3: Realice su primera llamada a la API

curl -X POST http://localhost:8080/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [{"role": "user", "content": "Hello, Bifrost!"}]
  }'

¡Eso es todo! Su puerta de enlace de IA está en funcionamiento con una interfaz web para configuración visual, monitorización en tiempo real y análisis.

Guías de configuración completas:


Despliegues empresariales

Bifrost admite despliegues privados de nivel empresarial para equipos que ejecutan sistemas de IA de producción a escala. Además de redes privadas, controles de seguridad personalizados y gobernanza, los despliegues empresariales desbloquean capacidades avanzadas que incluyen equilibrio de carga adaptativo, agrupación en clústeres, protecciones, puerta de enlace MCP y otras funciones diseñadas para la escala y fiabilidad de nivel empresarial.


Características principales

Infraestructura principal

Características avanzadas

  • Protocolo de Contexto de Modelo (MCP) - Permite que los modelos de IA utilicen herramientas externas (sistema de archivos, búsqueda web, bases de datos)

  • Caché semántica - Caché inteligente de respuestas basada en similitud semántica para reducir costos y latencia

  • Soporte multimodal - Soporte para texto, imágenes, audio y transmisión, todo detrás de una interfaz común.

  • Plugins personalizados - Arquitectura de middleware extensible para análisis, monitorización y lógica personalizada

  • Gobernanza - Seguimiento de uso, limitación de velocidad y control de acceso detallado

Empresa y seguridad

  • Gestión de presupuestos - Control de costos jerárquico con claves virtuales, equipos y presupuestos de clientes

  • Aprovisionamiento de usuarios (OIDC) - Inicio de sesión OAuth 2.0 / OIDC con sincronización de directorio en segundo plano para equipos, roles y unidades de negocio

  • Observabilidad - Métricas nativas de Prometheus, trazado distribuido y registro integral

  • Gestión de secretos - Gestión segura de claves API con variables de entorno y secretos de despliegue

Experiencia del desarrollador


Estructura del repositorio

Bifrost utiliza una arquitectura modular para máxima flexibilidad:

bifrost/
├── npx/                 # NPX script for easy installation
├── core/                # Core functionality and shared components
│   ├── providers/       # Provider-specific implementations (OpenAI, Anthropic, etc.)
│   ├── schemas/         # Interfaces and structs used throughout Bifrost
│   └── bifrost.go       # Main Bifrost implementation
├── framework/           # Framework components for data persistence
│   ├── configstore/     # Configuration storage backends
│   ├── logstore/        # Request logging storage backends
│   └── vectorstore/     # Vector storages
├── transports/          # HTTP gateway and other interface layers
│   └── bifrost-http/    # HTTP transport implementation
├── ui/                  # Web interface for HTTP gateway
├── plugins/             # Extensible plugin system
│   ├── governance/      # Budget management and access control
│   ├── jsonparser/      # JSON parsing and manipulation utilities
│   ├── logging/         # Request logging and analytics
│   ├── maxim/           # Maxim's observability integration
│   ├── mocker/          # Mock responses for testing and development
│   ├── semanticcache/   # Intelligent response caching
│   └── telemetry/       # Monitoring and observability
├── docs/                # Documentation and guides
└── tests/               # Comprehensive test suites

Opciones de inicio

Elija el método de despliegue que se adapte a sus necesidades:

1. Gateway (API HTTP)

Ideal para: Integración independiente del lenguaje, microservicios y despliegues de producción

# NPX - Get started in 30 seconds
npx -y @maximhq/bifrost

# Docker - Production ready
docker run -p 8080:8080 -v $(pwd)/data:/app/data maximhq/bifrost

Características: Interfaz web, monitorización en tiempo real, gestión multi-proveedor, inicio sin configuración

Más información: Guía de configuración de Gateway

2. SDK de Go

Ideal para: Integración directa de Go con máximo rendimiento y control

go get github.com/maximhq/bifrost/core

Características: API nativas de Go, despliegue integrado, integración de middleware personalizado

Más información: Guía del SDK de Go

3. Reemplazo directo

Ideal para: Migrar aplicaciones existentes sin cambios de código

# OpenAI SDK
- base_url = "https://api.openai.com"
+ base_url = "http://localhost:8080/openai"

# Anthropic SDK
- base_url = "https://api.anthropic.com"
+ base_url = "http://localhost:8080/anthropic"

# Google GenAI SDK
- api_endpoint = "https://generativelanguage.googleapis.com"
+ api_endpoint = "http://localhost:8080/genai"

Más información: Guías de integración


Rendimiento

Bifrost añade prácticamente cero sobrecarga a sus solicitudes de IA. En pruebas de referencia sostenidas de 5,000 RPS, la puerta de enlace añadió solo 11 µs de sobrecarga por solicitud.

Métrica

t3.medium

t3.xlarge

Mejora

Latencia añadida (sobrecarga de Bifrost)

59 µs

11 µs

-81%

Tasa de éxito @ 5k RPS

100%

100%

Sin solicitudes fallidas

Tiempo medio de espera en cola

47 µs

1.67 µs

-96%

Latencia media de solicitud (incl. proveedor)

2.12 s

1.61 s

-24%

Aspectos destacados del rendimiento:

  • Tasa de éxito perfecta - 100% de tasa de éxito de solicitudes incluso a 5k RPS

  • Sobrecarga mínima - Menos de 15 µs de latencia adicional por solicitud

  • Colas eficientes - Tiempos de espera promedio de sub-microsegundos

  • Selección rápida de claves - ~10 ns para elegir claves API ponderadas

Pruebas de referencia completas: Análisis de rendimiento


Documentación

Documentación completa: https://docs.getbifrost.ai

Inicio rápido

Características

Integraciones

Empresa


¿Necesita ayuda?

Únase a nuestro Discord para soporte comunitario y discusiones.

Obtenga ayuda con:

  • Asistencia para configuración rápida y resolución de problemas

  • Mejores prácticas y consejos de configuración

  • Discusiones comunitarias y soporte

  • Ayuda en tiempo real con integraciones


Contribuciones

¡Aceptamos contribuciones de todo tipo! Consulte nuestra Guía de contribuciones para:

  • Configurar el entorno de desarrollo

  • Convenciones de código y mejores prácticas

  • Cómo enviar solicitudes de extracción (pull requests)

  • Compilar y probar localmente

Para requisitos de desarrollo e instrucciones de compilación, consulte nuestra Guía de configuración de desarrollo.


Licencia

Este proyecto está licenciado bajo la Licencia Apache 2.0; consulte el archivo LICENSE para obtener más detalles.

Construido con ❤️ por Maxim

A
license - permissive license
Not graded
quality - not tested
Not graded
maintenance - not tested

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    C
    quality
    D
    maintenance
    A powerful gateway for the Model Context Protocol (MCP) that unifies AI toolchains by federating multiple MCP servers, wrapping REST APIs as MCP tools, and supporting multiple transport methods with an admin dashboard.
    1
  • A
    license
    Not graded
    quality
    D
    maintenance
    MCPGate aggregates multiple MCP servers into a single unified endpoint, enabling centralized tool management with granular filtering, automatic namespacing, and observability. Features a real-time web dashboard and optional PostgreSQL-backed audit trails for monitoring and controlling AI tool access across local and remote deployments.
    17
    Apache 2.0
  • F
    license
    Not graded
    quality
    A
    maintenance
    A production-ready MCP gateway and control plane that provides credential vault, policy engine, audit logging, and managed runtime for routing tool calls between AI agents and downstream MCP servers.
    57
  • A
    license
    Not graded
    quality
    A
    maintenance
    An open-source MCP gateway for AI operators, connecting any LLM to a hot-reloadable connector registry with production-grade approval gates and a built-in control plane for session management.
    MIT

View all related MCP servers

Related MCP Connectors

  • Control plane for autonomous software labor. Agents claim objectives over MCP with audit trail.

  • Enterprise AI Control Plane: governance, guardrails, spend tracking, compliance & smart routing.

  • Hosted MCP server for LLM cost estimation, model comparison, and budget-aware routing.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/maximhq/bifrost'

If you have feedback or need assistance with the MCP directory API, please join our Discord server