GPUcloud

Machine prête en un clic

Serveur vLLM compatible OpenAI

Un serveur vLLM avec une API compatible OpenAI, protégé par une clé générée.

Servez un modèle de langage ouvert derrière une API compatible OpenAI (/v1). Vos applications existantes s’y connectent en changeant simplement l’adresse et la clé.

Ce que vous obtenez

  • Une API compatible OpenAI (/v1) servie en HTTPS
  • Le modèle de votre choix parmi Qwen2.5 7B Instruct, Llama 3.1 8B Instruct et Mistral 7B Instruct v0.3
  • Une clé d’API générée pour vous, affichée dans la console
  • Un accès SSH complet au serveur

Pour quoi faire

  • Brancher une application existante sur un modèle ouvert hébergé au Canada
  • Offrir un point d’accès d’inférence privé à votre équipe
  • Tester un modèle ouvert en conditions réelles avant la production

Inclus avec le modèle

  • Prêt en quelques minutes

    L’installation démarre toute seule au premier démarrage du serveur. La console affiche l’avancement et l’adresse d’accès dès que l’application répond.

  • HTTPS inclus

    L’application est servie en HTTPS avec un certificat public obtenu automatiquement, derrière une authentification. Rien n’est exposé sans protection.

  • Données hébergées au Canada

    Le serveur, vos modèles et vos fichiers sont hébergés au Canada. La facturation se fait en dollars canadiens.

GPU recommandés

Prix par serveur en dollars canadiens, taxes en sus. Facturation à l’heure sans engagement, le modèle est inclus.

GPUMémoire par GPUPrix horaireCommander
1 × NVIDIA L4048 Go GDDR61,34 $/hDéployer avec ce GPU
1 × NVIDIA A100 PCIe80 Go HBM2e1,81 $/hDéployer avec ce GPU
1 × NVIDIA RTX PRO 600096 Go GDDR72,48 $/hDéployer avec ce GPU
1 × NVIDIA H100 PCIe80 Go HBM2e3,35 $/hDéployer avec ce GPU

Voir tous les serveurs GPU

Lancez votre machine maintenant

Le modèle est déjà sélectionné dans la console. Choisissez votre clé SSH, confirmez le prix et le serveur démarre.

Déployer ce modèle

Questions fréquentes

Serveur vLLM compatible OpenAI : combien de temps avant de pouvoir l’utiliser ?

Habituellement quelques minutes après le démarrage du serveur. La durée varie selon le GPU et le volume à télécharger ; la console vous montre l’avancement.

Serveur vLLM compatible OpenAI : combien ça coûte ?

Le modèle est inclus. Vous payez seulement le serveur GPU, à partir de 1,34 $/h en dollars canadiens, taxes en sus, sans engagement.

Serveur vLLM compatible OpenAI : comment y accéder de façon sécurisée ?

La console vous donne une adresse HTTPS avec un certificat public et les identifiants générés pour votre serveur. L’application n’écoute jamais directement sur Internet : seul un proxy HTTPS authentifié y donne accès.

Où sont hébergées mes données ?

Au Canada. Le serveur et ses disques sont hébergés au Canada et la facturation se fait en dollars canadiens.

Quels modèles sont proposés ?

Vous choisissez parmi Qwen2.5 7B Instruct, Llama 3.1 8B Instruct et Mistral 7B Instruct v0.3. Certains modèles demandent d’accepter leur licence sur le dépôt de modèles et d’ajouter un jeton d’accès sur le serveur.

Autres modèles en un clic