Exclusif à l'offre Entreprise

Tunnel de modèle

Vos modèles, sur vos serveurs, dans le même catalogue que la frontière. Une connexion sortante transforme n'importe quel moteur compatible OpenAI en private/votre-org/votre-modèle, gouverné comme tout le reste, facturé à zéro.

Fonctionnement

Une connexion sortante, rien d'entrant

Le tunnel est un petit binaire installé à côté de vLLM, Ollama ou TGI. Il ouvre une connexion mTLS sortante vers la passerelle : aucun port entrant, aucune règle de pare-feu à changer, rien à balayer.

  • Le contenu reste chez vous : les requêtes aux modèles privés sont répondues dans votre réseau; le plan de contrôle ne reçoit que des métadonnées de routage.
  • Identité mTLS épinglée par tunnel : rotation et révocation individuelles, coupure en secondes.
  • Gouverné comme le nuage : budgets, verrous, limites par clé et journaux d'audit s'appliquent aux modèles privés exactement comme aux autres.
  • Zéro crédit : vous avez déjà payé les GPU. Le grand livre montre l'utilisation, facturée 0.
  • Haute disponibilité : plusieurs répliques par moteur; la passerelle équilibre la charge et contourne une connexion perdue en secondes.

Schéma d'architecture, commandes d'installation et FAQ complète sur la page anglaise.

Vos GPU méritent une place au catalogue

Le Tunnel de modèle est livré avec l'offre Entreprise, ingénieur attitré compris.