Pour datacenters et hébergeurs

Cradle en service datacenter

Ne louez pas des GPU — vendez du travail terminé. Le client confie une tâche et des données ; les agents Cradle travaillent sous un système de risque à deux niveaux, un opérateur approuve, et le client reçoit une réponse avec citations et piste d'audit complète.

Trois modes de livraison

Choisissez celui qui correspond au périmètre du client — la même séquence d'amorçage sert les trois.

Réseau ouvert

Installateur curl

Pour les cas ouverts et auto-hébergés disposant d'un accès internet. Un install.sh d'une ligne récupère le bundle depuis S3 et recompile les modules natifs sur l'hôte.

Réseau fermé

Archive autonome

Pour les réseaux fermés sans registre. Une archive prête à l'emploi embarque le serveur packagé et les modules natifs compilés pour l'OS et le GPU cibles — entièrement hors ligne une fois livrée.

Infogéré

Image de VM

Le datacenter conserve une image de référence avec Cradle Server préinstallé. Le client ne télécharge que le client et colle ses identifiants — aucune étape d'installation côté serveur.

Progression des topologies

Commencez simple, ne grandissez que lorsque c'est nécessaire.

T0

Tout sur un seul serveur

cradle-server et un runner CUDA local sur un nœud GPU. Le client est une console légère au-dessus de l'API. Cerveau et inférence cohabitent — le minimum de code nouveau. Point de départ recommandé.

T1

Séparation control plane / data plane

Cradle pilote un démon d'inférence sur une machine GPU distincte : cycle de vie et choix du modèle via un canal de contrôle, trafic d'inférence en HTTP via un fournisseur remote-gpu.

T2

Pool de GPU partagé et file d'attente

Mise à l'échelle, instances spot et répartition automatique des tâches sur un pool. L'extrémité avancée du spectre — à ne pas construire tant que T0 ne tourne pas.

Isolation stricte des locataires

Chaque locataire dispose de sa propre infrastructure et de sa propre base de données — les locataires ne partagent jamais un périmètre. L'isolation se fait par instance : un cradle-server distinct, avec son répertoire de données, sa base et son périmètre. Une instance partagée où « projet = locataire » est explicitement exclue.

  • projectId cloisonne agents, bases de connaissances, tickets et budgets à l'intérieur d'un locataire — jamais entre locataires.
  • SQLite embarqué signifie que les données tiennent littéralement dans un fichier du répertoire du locataire ; rien ne sort du périmètre.
  • Choisissez votre niveau d'isolation : un processus par locataire, un conteneur par locataire, ou une VM complète par locataire.
  • Un orchestrateur côté datacenter provisionne, démarre, arrête et détruit les instances des locataires, et transmet les identifiants au portail client.

Proposez Cradle à vos clients

Parlons d'un déploiement infogéré, ou lisez la documentation de déploiement pour en voir la mécanique.