Machine prête en un clic
Serveur vLLM compatible OpenAI
Un serveur vLLM avec une API compatible OpenAI, protégé par une clé générée.
Servez un modèle de langage ouvert derrière une API compatible OpenAI (/v1). Vos applications existantes s’y connectent en changeant simplement l’adresse et la clé.
Ce que vous obtenez
- Une API compatible OpenAI (/v1) servie en HTTPS
- Le modèle de votre choix parmi Qwen2.5 7B Instruct, Llama 3.1 8B Instruct et Mistral 7B Instruct v0.3
- Une clé d’API générée pour vous, affichée dans la console
- Un accès SSH complet au serveur
Pour quoi faire
- Brancher une application existante sur un modèle ouvert hébergé au Canada
- Offrir un point d’accès d’inférence privé à votre équipe
- Tester un modèle ouvert en conditions réelles avant la production
Inclus avec le modèle
Prêt en quelques minutes
L’installation démarre toute seule au premier démarrage du serveur. La console affiche l’avancement et l’adresse d’accès dès que l’application répond.
HTTPS inclus
L’application est servie en HTTPS avec un certificat public obtenu automatiquement, derrière une authentification. Rien n’est exposé sans protection.
Données hébergées au Canada
Le serveur, vos modèles et vos fichiers sont hébergés au Canada. La facturation se fait en dollars canadiens.
GPU recommandés
Prix par serveur en dollars canadiens, taxes en sus. Facturation à l’heure sans engagement, le modèle est inclus.
| GPU | Mémoire par GPU | Prix horaire | Commander |
|---|---|---|---|
| 1 × NVIDIA L40 | 48 Go GDDR6 | 1,34 $/h | Déployer avec ce GPU |
| 1 × NVIDIA A100 PCIe | 80 Go HBM2e | 1,81 $/h | Déployer avec ce GPU |
| 1 × NVIDIA RTX PRO 6000 | 96 Go GDDR7 | 2,48 $/h | Déployer avec ce GPU |
| 1 × NVIDIA H100 PCIe | 80 Go HBM2e | 3,35 $/h | Déployer avec ce GPU |
Lancez votre machine maintenant
Le modèle est déjà sélectionné dans la console. Choisissez votre clé SSH, confirmez le prix et le serveur démarre.
Déployer ce modèleQuestions fréquentes
Serveur vLLM compatible OpenAI : combien de temps avant de pouvoir l’utiliser ?
Habituellement quelques minutes après le démarrage du serveur. La durée varie selon le GPU et le volume à télécharger ; la console vous montre l’avancement.
Serveur vLLM compatible OpenAI : combien ça coûte ?
Le modèle est inclus. Vous payez seulement le serveur GPU, à partir de 1,34 $/h en dollars canadiens, taxes en sus, sans engagement.
Serveur vLLM compatible OpenAI : comment y accéder de façon sécurisée ?
La console vous donne une adresse HTTPS avec un certificat public et les identifiants générés pour votre serveur. L’application n’écoute jamais directement sur Internet : seul un proxy HTTPS authentifié y donne accès.
Où sont hébergées mes données ?
Au Canada. Le serveur et ses disques sont hébergés au Canada et la facturation se fait en dollars canadiens.
Quels modèles sont proposés ?
Vous choisissez parmi Qwen2.5 7B Instruct, Llama 3.1 8B Instruct et Mistral 7B Instruct v0.3. Certains modèles demandent d’accepter leur licence sur le dépôt de modèles et d’ajouter un jeton d’accès sur le serveur.