Trois clics, et votre modèle tourne en France.
N'importe quel modèle open source, sur des GPU hébergés dans l'Hexagone, avec une API compatible OpenAI. Vos poids, vos données, votre juridiction.
Sans carte bancaire · 20 € de crédits offerts · Facturation à la seconde
214 modèles prêts à l'emploi, mis à jour chaque semaine
Le modèle, la région, le bouton.
Quel modèle voulez-vous faire tourner ?
Les six plus demandés. Le catalogue en compte 214, plus tout Hugging Face.
Où voulez-vous qu'il tourne ?
Trois régions, trois datacenters, un seul droit applicable : le français.
Tout est prêt. Il ne reste qu'un clic.
Le conteneur est provisionné, chiffré et supervisé. Vous n'écrivez pas une ligne de YAML.
L'Hexagone. Au sens propre.
Trois datacenters, une seule frontière — celle qu'on ne franchit pas. Le matériel est français, l'exploitant est français, et le juge compétent aussi.
Aucune donnée ne sort du territoire
Prompts, réponses, fichiers, journaux : tout reste sur les serveurs français. Pas de réplication hors zone, pas de sous-traitant extra-européen.
Hors de portée du Cloud Act
LanneCloud est une société de droit français, sans capital ni maison mère américaine. Aucune administration étrangère ne peut réquisitionner vos données.
RGPD par construction, SecNumCloud en cours
Chiffrement AES-256 au repos, TLS 1.3 en transit, clés gérées par vous si vous le souhaitez. Qualification engagée avec l'ANSSI.
Zéro entraînement sur vos requêtes
Vos appels API ne servent jamais à entraîner quoi que ce soit. Rétention à zéro activable en une case à cocher.
3 régions · 0 frontière franchie · 100 % énergie décarbonée
| LanneCloud | Hyperscaler américain | Serveur sur site | |
|---|---|---|---|
| Localisation des données | France, région au choix | Souvent multi-régions | Vos locaux |
| Droit applicable | Français uniquement | Cloud Act, FISA 702 | Français |
| Délai de mise en service | 14 secondes | Quelques minutes | 3 à 9 mois |
| Investissement de départ | 0 € | 0 € | 60 000 € et plus par GPU |
| Facturation | À la seconde, zéro à l'arrêt | À l'heure, minimum facturé | Amortissement fixe |
| Frais de sortie des données | 0 € | 0,08 à 0,12 € / Go | — |
| Choix des modèles | 214 modèles + import libre | Catalogue restreint | Libre, à votre charge |
| Maintenance matérielle | Incluse | Incluse | Votre équipe |
Une API que vous connaissez déjà.
Changez l'URL de base, gardez votre code. Nos endpoints sont compatibles avec le SDK OpenAI : migration en une ligne, retour arrière tout aussi simple.
# Un modèle déployé, une clé, c'est tout. curl https://api.lannecloud.fr/v1/chat/completions \ -H "Authorization: Bearer $LANNE_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "mistral-small-3.2-24b", "messages": [ {"role": "user", "content": "Résume ce contrat en 5 points."} ], "stream": true }'
from openai import OpenAI client = OpenAI( base_url="https://api.lannecloud.fr/v1", api_key=os.environ["LANNE_KEY"], ) flux = client.chat.completions.create( model="mistral-small-3.2-24b", messages=[{"role": "user", "content": "Résume ce contrat."}], stream=True, ) for bloc in flux: print(bloc.choices[0].delta.content or "", end="")
import OpenAI from "openai"; const client = new OpenAI({ baseURL: "https://api.lannecloud.fr/v1", apiKey: process.env.LANNE_KEY, }); const flux = await client.chat.completions.create({ model: "mistral-small-3.2-24b", messages: [{ role: "user", content: "Résume ce contrat." }], stream: true, }); for await (const bloc of flux) process.stdout.write(bloc.choices[0].delta.content ?? "");
# Les trois clics, en trois lignes. resource "lannecloud_deployment" "assistant" { model = "mistral-small-3.2-24b" region = "fr-par-1" gpu = "h100-80" autoscale { min_replicas = 0 max_replicas = 12 } privacy { retention_seconds = 0 egress_allowed = false } }
Les modèles, au prix du GPU.
Pas de marge cachée sur les jetons, pas de tarif « entreprise » qui double en silence. Vous payez le calcul consommé, à la seconde.
Llama 3.3
TexteQwen3
MultilingueDeepSeek-R1 Distill
RaisonnementMagistral
RaisonnementWhisper Large v3
AudioKokoro TTS
Synthèse vocaleFLUX.1 [dev]
ImageVotre modèle n'est pas dans la liste ? Collez une adresse Hugging Face ou téléversez vos poids : LanneCloud construit le conteneur, choisit le GPU et expose l'API.
Importer un modèleVotre facture, avant de signer.
Déplacez le curseur. Le calcul est le même que celui de votre relevé mensuel — sans frais de sortie, sans minimum, sans surprise.
Estimation : tarif LanneCloud public + 49 € d'abonnement Studio. Référence marché calculée sur une moyenne des grilles publiques d'inférence gérée (≈ 2,3×) et 0,09 € / Go de frais de sortie. Les prix réels dépendent de votre profil de charge.
Trois clics, puis plus jamais la question.
« On a basculé 40 millions de jetons par mois en une après-midi. La direction juridique a validé en lisant une seule ligne : droit français. »
« Notre marché public exigeait un hébergement qualifié. LanneCloud a été le seul à répondre sans clause d'extraterritorialité. »
« Facture divisée par deux, latence divisée par trois, et je peux enfin tester un modèle sans ouvrir un ticket. »
Trois formules. Aucune surprise.
Le calcul est facturé à la seconde d'utilisation réelle. Un modèle inactif ne coûte rien.
Open source hébergé en France, face aux API des laboratoires.
Échelle en euros par million de jetons, entrée et sortie confondues. LanneCloud : Llama 3.3 70B, open source, GPU français. Laboratoires : grilles publiques converties en euros, hors cache et contrats volume.
Pour tester, prototyper et se faire une idée.
- 20 € de crédits offerts à l'inscription
- 1 modèle déployé simultanément
- 60 requêtes / minute
- Support communautaire
Pour les équipes qui mettent en production.
- Déploiements illimités et mise à l'échelle automatique
- Endpoints privés et clés à portée limitée
- Import de modèles et affinage LoRA
- Journal d'audit et métriques exportables
- Réponse support sous 4 heures
Pour le secteur public, la santé, la défense et la finance.
- GPU dédiés et réseau isolé (VPC)
- Chiffrement à clés client (BYOK)
- Parcours SecNumCloud et HDS
- Engagement de réversibilité écrit
- Ingénieur référent et support 1 heure
Prix HT, en euros, facturés depuis la France. Résiliable à tout moment, sans frais de sortie.
Ce qu'on nous demande le plus.
Où sont physiquement mes données ?
Dans l'un des trois datacenters que nous opérons à Paris, Lyon ou Lannion — celui que vous choisissez au déploiement. Les sauvegardes restent dans la même région. Aucune réplication, aucun transit et aucun sous-traitant hors du territoire français.
Puis-je déployer un modèle qui n'est pas au catalogue ?
Oui. Collez l'adresse d'un dépôt Hugging Face ou téléversez vos poids : nous détectons l'architecture, construisons l'image, sélectionnons le GPU adapté et exposons l'API. Les formats GGUF, safetensors et les adaptateurs LoRA sont pris en charge.
Qu'est-ce que ça change par rapport à un hyperscaler américain ?
Le droit applicable. Un fournisseur soumis au Cloud Act peut être contraint de communiquer vos données à une autorité étrangère, où qu'elles soient stockées. LanneCloud est une société française détenue par des capitaux français : seule la justice française peut nous solliciter, et vous en êtes informé.
Comment le GPU est-il facturé ?
À la seconde d'inférence réelle, sans minimum de facturation. Un modèle sans trafic redescend à zéro et ne coûte rien. Vous pouvez aussi réserver un GPU dédié au mois, avec une remise d'environ 40 % sur le tarif à la demande.
Puis-je affiner un modèle sur mes propres données ?
Oui, en LoRA ou en affinage complet, sur la même infrastructure. Le jeu de données reste dans votre espace chiffré, il n'est jamais mutualisé et les poids produits vous appartiennent — vous pouvez les télécharger à tout moment.
Que se passe-t-il en cas de pic de trafic ?
L'autoscaling ajoute des répliques en quelques secondes, dans la limite que vous fixez. Au-delà, les requêtes sont mises en file plutôt que rejetées, et vous recevez une alerte. Aucune facturation ne peut dépasser le plafond mensuel que vous définissez.
Et si je veux partir ?
Vous exportez vos poids, vos configurations et vos journaux en une commande CLI, puis vous supprimez votre espace. Aucun frais de sortie, aucun format propriétaire, aucune période d'engagement sur les formules Atelier et Studio.
Votre premier modèle tourne dans 90 secondes.
Créez un compte, choisissez un modèle, cliquez trois fois. Les 20 € de crédits couvrent largement les premiers millions de jetons.