Cradle en service datacenter
Ne louez pas des GPU — vendez du travail terminé. Le client confie une tâche et des données ; les agents Cradle travaillent sous un système de risque à deux niveaux, un opérateur approuve, et le client reçoit une réponse avec citations et piste d'audit complète.
Trois modes de livraison
Choisissez celui qui correspond au périmètre du client — la même séquence d'amorçage sert les trois.
Installateur curl
Pour les cas ouverts et auto-hébergés disposant d'un accès internet. Un install.sh d'une ligne récupère le bundle depuis S3 et recompile les modules natifs sur l'hôte.
Archive autonome
Pour les réseaux fermés sans registre. Une archive prête à l'emploi embarque le serveur packagé et les modules natifs compilés pour l'OS et le GPU cibles — entièrement hors ligne une fois livrée.
Image de VM
Le datacenter conserve une image de référence avec Cradle Server préinstallé. Le client ne télécharge que le client et colle ses identifiants — aucune étape d'installation côté serveur.
Progression des topologies
Commencez simple, ne grandissez que lorsque c'est nécessaire.
Tout sur un seul serveur
cradle-server et un runner CUDA local sur un nœud GPU. Le client est une console légère au-dessus de l'API. Cerveau et inférence cohabitent — le minimum de code nouveau. Point de départ recommandé.
Séparation control plane / data plane
Cradle pilote un démon d'inférence sur une machine GPU distincte : cycle de vie et choix du modèle via un canal de contrôle, trafic d'inférence en HTTP via un fournisseur remote-gpu.
Pool de GPU partagé et file d'attente
Mise à l'échelle, instances spot et répartition automatique des tâches sur un pool. L'extrémité avancée du spectre — à ne pas construire tant que T0 ne tourne pas.
Isolation stricte des locataires
Chaque locataire dispose de sa propre infrastructure et de sa propre base de données — les locataires ne partagent jamais un périmètre. L'isolation se fait par instance : un cradle-server distinct, avec son répertoire de données, sa base et son périmètre. Une instance partagée où « projet = locataire » est explicitement exclue.
- projectId cloisonne agents, bases de connaissances, tickets et budgets à l'intérieur d'un locataire — jamais entre locataires.
- SQLite embarqué signifie que les données tiennent littéralement dans un fichier du répertoire du locataire ; rien ne sort du périmètre.
- Choisissez votre niveau d'isolation : un processus par locataire, un conteneur par locataire, ou une VM complète par locataire.
- Un orchestrateur côté datacenter provisionne, démarre, arrête et détruit les instances des locataires, et transmet les identifiants au portail client.
Proposez Cradle à vos clients
Parlons d'un déploiement infogéré, ou lisez la documentation de déploiement pour en voir la mécanique.