
Ramp lanza Router, API LLM gratis en EE. UU. hasta 2026
El servicio enruta solicitudes a través de múltiples proveedores de modelos y establece como predeterminado un año de retención de datos con opción a exclusión.
Ramp ha lanzado Router, una API que permite a las empresas enrutar solicitudes de IA a través de múltiples proveedores de modelos de lenguaje grande con estrategias de enrutamiento integradas y un panel de control de gastos y latencia. El servicio es exclusivo para EE. UU.
en su lanzamiento, es gratuito hasta el resto de 2026, excluyendo los costos de inferencia, y se entrega con una política de retención predeterminada de un año con opción de exclusión para solicitudes y salidas.
Puntos Clave
- Ramp lanzó Router, unaAPIque permite a los equipos cambiar entre múltiples proveedores de modelos de lenguaje grande con estrategias de enrutamiento y un panel de control de gastos/rendimiento.
- Router está limitado a usuarios de EE. UU. en su lanzamiento y es gratuito hasta el resto de 2026, excluyendo los costos de inferencia del modelo subyacente, con un crédito de lanzamiento de $26.
- Ramp dice que el enrutador ha estado funcionando internamente durante tres años, posicionando el lanzamiento como una herramienta de producción externalizada en lugar de un nuevo experimento.
- La política predeterminada retiene las entradas, salidas y llamadas a herramientas del modelo durante un año con opción de exclusión, y Ramp dice que elimina información personal identificable antes de usar el contenido para mejorar el producto.
Ramp Lanza Router: Una API de Enrutamiento de LLM Exclusiva para EE. UU., Gratuita Hasta 2026
Ramp, mejor conocido por la gestión de gastos corporativos, ha avanzado más en la infraestructura de IA con Router, un servicio de enrutamiento de modelos que se sitúa entre una aplicación y múltiples proveedores de modelos de lenguaje grande. Mecánicamente, es una única integración de API que puede enviar cada solicitud a un proveedor de modelo elegido según reglas.
La consecuencia es menos bloqueo de proveedores para los equipos que ejecutan flujos de trabajo intensivos en IA, y un camino más claro para que Ramp cobre por la 'dirección del tráfico' en la inferencia.
Router solo está disponible en los Estados Unidos en su lanzamiento. Ramp también está haciendo que el servicio sea gratuito para usar durante el resto de 2026, aunque aún requiere que los clientes paguen los costos subyacentes de inferencia del modelo. Se incluye un crédito de lanzamiento de $26, y Ramp no ha divulgado cuánto costará Router en 2027.
Ramp está enmarcando Router como una externalización de la productización de herramientas internas, diciendo que ha utilizado su enrutador para sus propias necesidades de uso de IA durante los últimos tres años. Eso importa porque las capas de enrutamiento tienden a fallar de maneras aburridas primero, como picos de latencia en casos extremos, interrupciones de proveedores y desajustes de facturación. "Ya hemos vivido con ello en producción" es el argumento de credibilidad.
Cómo funciona Router: Una integración a través de OpenAI, Anthropic, DeepSeek, xAI y más
Un enrutador de modelos es un controlador de tráfico para la inferencia de IA, no un nuevo modelo. Los desarrolladores integran una vez, luego eligen qué proveedor maneja cada solicitud sin reescribir su aplicación para la API de cada proveedor. La propuesta de Router es que los costos de cambio pasan de "proyecto de ingeniería" a "cambio de configuración", lo que hace que la opcionalidad del proveedor sea real.
En el lanzamiento, Router proporciona acceso a modelos de OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI y Z.ai. Ramp no está tratando de ganar en amplitud de catálogo todavía. El producto está posicionado como similar a OpenRouter, pero con menos opciones de modelos que la línea de OpenRouter.
Router también se envía con "estrategias" de enrutamiento, que son reglas predefinidas sobre a dónde van las solicitudes. Una estrategia permite a los usuarios establecer una preferencia por los niveles de uso flexible de los proveedores de modelos. Otra permite que Router elija qué modelo enrutará las consultas según hasta tres puntos de referencia especificados por el usuario.
Ramp también dice que los clientes pueden enrutear solo problemas difíciles a modelos más caros, o probar modelos sin cambiar manualmente las integraciones.
El detalle crítico para algunos equipos es el manejo de datos. Router tiene una política de retención de exclusión que registra entradas, salidas y llamadas a herramientas del modelo durante un año por defecto.
Ramp dice que eliminará la información de identificación personal antes de usar ese contenido para mejorar el producto, pero no ha detallado cómo se implementa esa eliminación de PII o qué controles obtienen las empresas más allá de optar por no participar.
Costo, latencia y retrocesos: El panel de gastos en el que Ramp está apostando
La segunda superficie del producto de Router es la observabilidad: un panel que informa sobre el gasto en tokens, costo, latencia, intentos de retroceso y otros detalles. Los tokens son la unidad de facturación para la mayoría de los modelos de texto, la latencia es el tiempo de respuesta, y los intentos de retroceso son reintentos o cambios de proveedor cuando la primera opción falla o no puede atender la solicitud. Juntos, es una vista tanto de la factura como de los modos de fallo.
Ese panel es el puente de regreso al negocio central de Ramp. Si un equipo está enrutando a través de múltiples proveedores, la parte complicada no es solo elegir el modelo más barato. Es entender cuándo "barato" se convierte en "lento", cuándo las restricciones de capacidad de un proveedor desencadenan retrocesos, y cuándo una regla de enrutamiento cambia silenciosamente el gasto de un proveedor a otro.
Ramp está apostando a que la capa de gasto es pegajosa, y que una vez que una empresa confía en la medición, tolerará que Ramp esté en el camino de la solicitud.
La estructura gratuita hasta 2026 refuerza esa estrategia de adopción. Ramp no está renunciando a la factura de inferencia real, que aún se acumula en los proveedores de modelos. Por ahora, está renunciando a su propia tarifa de enrutamiento, reduciendo la fricción para probar Router como un plano de control mientras Ramp aprende qué optimizan los clientes en la práctica.
El precio es la pregunta abierta después de 2026—y Ramp aún no está diciendo nada.
La curva a futuro en Router se trata principalmente de lo que Ramp elige cobrar una vez que finalice el período gratuito. Ramp no ha dicho cuánto costará el servicio en 2027, dejando abierta la posibilidad de que el precio se establezca como una tasa de toma sobre la inferencia, una suscripción, una tarifa por solicitud, o niveles empresariales vinculados a controles e informes.
La geografía es otro indicativo. Router es solo para EE. UU. hoy, y una expansión más allá de EE. UU. señalaría una mayor preparación empresarial y ambición de distribución, especialmente para equipos que necesitan un manejo consistente de políticas y datos en diferentes regiones.
La postura de datos es la tercera palanca. Una política de retención predeterminada de un año, con opción de exclusión, es un alto nivel de fricción para algunos operadores, incluso con las afirmaciones de eliminación de PII. Una retención más corta, almacenamiento opt-in, o controles empresariales más claros serían una señal concreta de que Ramp está optimizando para cargas de trabajo reguladas y sensibles a la seguridad.
Finalmente, es probable que la lista de proveedores se mueva. Router actualmente admite OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI y Z.ai. Adiciones más allá de ese conjunto aclararían si Ramp está construyendo una puerta de enlace amplia o un conjunto curado de relaciones con laboratorios específicos y proveedores de inferencia.
Mi lectura: Ramp está tratando de poseer la 'capa de gasto' de IA más allá de las tarjetas corporativas.
El mecanismo aquí es simple: poner un plano de medición y control frente a la inferencia, luego hacer que el cambio sea lo suficientemente barato como para que los equipos dejen de tratar la elección del modelo como una puerta de un solo sentido.
El acceso gratuito a Router hasta 2026 hace eso, porque el único costo inmediato es la factura de inferencia subyacente, y el panel de control hace que las compensaciones sean legibles en tokens, latencia y alternativas.
El umbral que importa es si Ramp puede convertir ese plano de control en un predeterminado empresarial sin ser bloqueado por su propia postura de retención. Si el producto mantiene su registro de un año, con opción de exclusión, mientras intenta situarse en medio de solicitudes sensibles y llamadas a herramientas, la adopción se inclinará hacia cargas de trabajo de menor sensibilidad y experimentación.
Si Ramp endurece los controles de retención y establece un modelo de precios creíble para 2027, Router comienza a parecerse a una capa de peaje duradera para la inferencia en lugar de una característica promocional añadida a la gestión del gasto.