
Ramp lance Router, une API LLM gratuite jusqu'en 2026
Le service achemine les demandes à travers plusieurs fournisseurs de modèles et par défaut, la conservation des données est de un an avec option de désinscription.
Ramp a lancé Router, une API qui permet aux entreprises de diriger les demandes d'IA à travers plusieurs fournisseurs de modèles de langage de grande taille avec des stratégies de routage intégrées et un tableau de bord des dépenses et de latence.
Le service est uniquement disponible aux États-Unis au lancement, gratuit à utiliser jusqu'à la fin de 2026, à l'exception des coûts d'inférence, et est livré avec une politique de conservation par défaut d'un an, avec option de désinscription, pour les invites et les sorties.
Points clés
- Ramp a lancé Router, un API qui permet aux équipes de passer d'un fournisseur de modèle de langage de grande taille à un autre avec des stratégies de routage et un tableau de bord des dépenses/performance.
- Router est limité aux utilisateurs américains au lancement et est gratuit à utiliser jusqu'à la fin de 2026, à l'exception des coûts d'inférence du modèle sous-jacent, avec un crédit de lancement de 26 $.
- Ramp affirme que le routeur fonctionne en interne depuis trois ans, positionnant la sortie comme un outil de production externalisé plutôt qu'une nouvelle expérience.
- La politique par défaut conserve les entrées, sorties et appels d'outils du modèle pendant un an sur une base de désinscription, et Ramp dit qu'elle supprime les informations personnellement identifiables avant d'utiliser le contenu pour améliorer le produit.
Ramp lance Router : une API de routage LLM uniquement pour les États-Unis, gratuite jusqu'en 2026
Ramp, mieux connu pour la gestion des dépenses d'entreprise, s'est davantage engagé dans l'infrastructure IA avec Router, un service de routage de modèles qui se situe entre une application et plusieurs fournisseurs de modèles de langage de grande taille. Mécaniquement, il s'agit d'une intégration API unique qui peut envoyer chaque demande à un fournisseur de modèle choisi en fonction de règles.
La conséquence est moins de verrouillage fournisseur pour les équipes exécutant des flux de travail lourds en IA, et un chemin plus clair pour Ramp pour facturer la "direction du trafic" dans l'inférence.
Router n'est disponible qu'aux États-Unis lors de son lancement. Ramp rend également le service gratuit jusqu'à la fin de 2026, tout en exigeant que les clients paient les coûts d'inférence du modèle sous-jacent. Un crédit de lancement de 26 $ est inclus, et Ramp n'a pas divulgué le coût de Router en 2027.
Ramp présente Router comme une externalisation de la productisation des outils internes, affirmant qu'elle a utilisé son routeur pour ses propres besoins en matière d'IA au cours des trois dernières années. Cela est important car les couches de routage ont tendance à échouer de manière ennuyeuse en premier, comme les pics de latence dans des cas particuliers, les pannes de fournisseur et les incohérences de facturation. "Nous avons déjà vécu cela en production" est l'argument de crédibilité.
Comment fonctionne Router : Une intégration à travers OpenAI, Anthropic, DeepSeek, xAI et plus encore
Un routeur de modèle est un agent de circulation pour l'inférence d'IA, pas un nouveau modèle. Les développeurs s'intègrent une fois, puis choisissent quel fournisseur gère chaque demande sans réécrire leur application pour l'API de chaque fournisseur. L'argument de Router est que les coûts de changement passent de "projet d'ingénierie" à "changement de configuration", ce qui rend l'option de fournisseur réelle.
Au lancement, Router donne accès à des modèles d'OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI et Z.ai. Ramp n'essaie pas encore de gagner sur la largeur du catalogue. Le produit est positionné comme similaire à OpenRouter, mais avec moins d'options de modèles que la gamme d'OpenRouter.
Router est également livré avec des "stratégies" de routage, qui sont des règles préétablies pour déterminer où vont les demandes. Une stratégie permet aux utilisateurs de définir une préférence pour les niveaux d'utilisation flexibles des fournisseurs de modèles. Une autre permet à Router de choisir quel modèle acheminer les requêtes en fonction de jusqu'à trois critères spécifiés par l'utilisateur.
Ramp dit également que les clients peuvent acheminer uniquement des problèmes difficiles vers des modèles plus coûteux, ou tester des modèles sans changer manuellement d'intégrations.
Le détail de blocage pour certaines équipes est la gestion des données. Router a une politique de conservation avec option de désinscription qui enregistre les entrées, sorties et appels d'outils du modèle pendant un an par défaut.
Ramp dit qu'elle supprimera les informations personnellement identifiables avant d'utiliser ce contenu pour améliorer le produit, mais elle n'a pas précisé comment cette suppression de PII est mise en œuvre ni quels contrôles les entreprises obtiennent au-delà de l'option de désinscription.
Coût, latence et solutions de secours : Le tableau de bord des dépenses sur lequel parie Ramp
La deuxième surface de produit de Router est l'observabilité : un tableau de bord qui rapporte les dépenses en jetons, le coût, la latence, les tentatives de secours et d'autres détails. Les jetons sont l'unité de facturation pour la plupart des modèles de texte, la latence est le temps de réponse, et les tentatives de secours sont des réessais ou des changements de fournisseur lorsque le premier choix échoue ou ne peut pas traiter la demande. Mis ensemble, c'est une vue à la fois de la facture et des modes de défaillance.
Ce tableau de bord est le pont vers le cœur de métier de Ramp. Si une équipe routage à travers plusieurs fournisseurs, la partie délicate n'est pas seulement de choisir le modèle le moins cher. Il s'agit de comprendre quand "pas cher" devient "lent", quand les contraintes de capacité d'un fournisseur déclenchent des solutions de secours, et quand une règle de routage déplace discrètement les dépenses d'un fournisseur à un autre.
Ramp parie que la couche de dépenses est collante, et qu'une fois qu'une entreprise fait confiance à la mesure, elle tolérera que Ramp soit dans le chemin de la demande.
La structure gratuite jusqu'en 2026 renforce cette stratégie d'adoption. Ramp ne renonce pas à la facture d'inférence réelle, qui continue de s'accumuler chez les fournisseurs de modèles. Pour l'instant, elle renonce à ses propres frais de routage, réduisant ainsi la friction pour essayer Router en tant que plan de contrôle pendant que Ramp apprend ce que les clients optimisent en pratique.
Le prix est la question ouverte après 2026 - et Ramp ne dit pas encore.
La courbe à terme sur Router concerne principalement ce que Ramp choisit de facturer une fois la période gratuite terminée. Ramp n'a pas indiqué combien le service coûtera en 2027, laissant ouverte la question de savoir si le prix sera un taux de prise sur l'inférence, un abonnement, des frais par demande, ou des niveaux d'entreprise liés aux contrôles et aux rapports.
La géographie est un autre indicateur. Router est uniquement disponible aux États-Unis aujourd'hui, et une expansion au-delà des États-Unis signalerait une préparation et une ambition de distribution plus larges pour les entreprises, en particulier pour les équipes qui ont besoin d'une politique cohérente et d'un traitement des données à travers les régions.
La posture des données est le troisième levier. Une politique de conservation par défaut d'un an, avec option de désinscription, est un défaut à forte friction pour certains opérateurs, même avec des revendications de suppression de PII. Une conservation plus courte, un stockage opt-in, ou des contrôles d'entreprise plus clairs seraient un signal concret que Ramp optimise pour des charges de travail réglementées et sensibles à la sécurité.
Enfin, la liste des fournisseurs est susceptible d'évoluer. Router prend actuellement en charge OpenAI, Anthropic, DeepSeek, Moonshot, Minimax, Nvidia, xAI, et Z.ai. Des ajouts au-delà de cet ensemble clarifieraient si Ramp construit une passerelle large ou un ensemble de relations soigneusement sélectionnées avec des laboratoires spécifiques et des fournisseurs d'inférence.
Mon avis : Ramp essaie de posséder la couche de dépenses en IA au-delà des cartes d'entreprise.
Le mécanisme ici est simple : mettre un plan de mesure et de contrôle devant l'inférence, puis rendre le changement suffisamment bon marché pour que les équipes cessent de considérer le choix du modèle comme une porte à sens unique. L'accès gratuit à Router jusqu'en 2026 fait cela, car le seul coût immédiat est la facture d'inférence sous-jacente, et le tableau de bord rend les compromis lisibles en tokens, latence et solutions de secours.
Le seuil qui compte est de savoir si Ramp peut transformer ce plan de contrôle en un défaut d'entreprise sans être bloqué par sa propre posture de conservation. Si le produit maintient sa journalisation d'un an avec option de désinscription tout en essayant de se situer au milieu des invites sensibles et des appels d'outils, l'adoption sera biaisée vers des charges de travail moins sensibles et l'expérimentation.
Si Ramp resserre les contrôles de conservation et met en place un modèle de tarification crédible pour 2027, Router commence à ressembler à une couche de péage durable pour l'inférence plutôt qu'à une fonctionnalité promotionnelle ajoutée à la gestion des dépenses.