Faire tourner vos modèles d’IA chez vous, sans envoyer vos données ailleurs
NeoEdge est partenaire Gold Dell Technologies et opère quatre datacenters en France. Nous déployons des plateformes d’intelligence artificielle sur site ou hébergées chez nous, depuis la station de développement jusqu’au serveur d’inférence en production.
La plupart des entreprises que nous rencontrons ont le même blocage : les cas d’usage sont identifiés, mais les données concernées ne peuvent pas partir chez un fournisseur américain. Le sujet n’est pas technique, il est juridique et contractuel, et il a une réponse matérielle.
Commencer petit coûte moins cher qu’on ne le croit
L’erreur la plus fréquente consiste à dimensionner une plateforme de production avant d’avoir prouvé le moindre cas d’usage. Le budget effraie, le projet s’arrête.
La Dell Pro Max avec GB10 change cet arbitrage. C’est une station de travail équipée de la superpuce NVIDIA GB10, avec 128 Go de mémoire unifiée partagée entre le processeur et la partie graphique — de quoi charger et faire tourner localement des modèles jusqu’à deux cents milliards de paramètres, ce qu’une carte graphique classique ne permet pas. Deux unités chaînées montent à quatre cent cinq milliards.
Une équipe peut prototyper un assistant documentaire, un moteur de recherche interne ou une chaîne d’extraction sur ses propres données, à son bureau, sans qu’un octet ne sorte. Et sans facturation à l’usage : le coût est connu d’avance, ce qui supprime la surprise de fin de mois qui tue beaucoup d’expérimentations.
Industrialiser quand le cas d’usage est prouvé
Quand l’expérimentation tient, elle change de nature : il faut de la disponibilité, de la supervision, des sauvegardes, des droits d’accès et de la traçabilité. C’est le passage aux serveurs PowerEdge XE, conçus pour accueillir plusieurs accélérateurs, avec le refroidissement et l’alimentation qui vont avec.
La Dell AI Factory fournit le cadre : calcul, stockage — souvent PowerScale pour les corpus d’apprentissage —, réseau et pile logicielle validés ensemble, plutôt qu’un assemblage à valider soi-même. Cela raccourcit la mise en service et, surtout, cela rend l’ensemble supportable dans la durée.
Nous traitons ce passage comme un projet d’infrastructure classique, parce que c’en est un : dimensionnement électrique et thermique, intégration réseau, sauvegarde, supervision, gestion des accès. C’est là que les projets d’IA échouent, pas sur le modèle.
Sur site, chez nous, ou les deux
Toutes les entreprises n’ont pas de salle machine capable d’accueillir ce type de matériel. Nous hébergeons ces plateformes dans nos quatre datacenters français, avec l’alimentation et le refroidissement adaptés, une supervision par notre SOC, et une réversibilité contractuelle.
Le choix entre acquisition et hébergement se tranche sur deux chiffres : le coût mensuel complet — matériel amorti, électricité, place en baie, exploitation — et le taux d’utilisation réel des accélérateurs. Un serveur d’inférence utilisé à quinze pour cent coûte beaucoup plus cher par requête qu’un service facturé à l’usage. À l’inverse, une charge continue s’amortit vite. Nous posons le calcul avant de vous vendre quoi que ce soit, y compris quand il conclut qu’il ne faut pas acheter.
Souveraineté : ce que cela veut dire concrètement
Héberger en France ne suffit pas à répondre à la question. Ce qui compte, c’est où résident les données d’entraînement et les journaux, qui peut y accéder techniquement, sous quel droit se trouve l’exploitant, et ce qu’il advient des contenus produits. Nous documentons ces quatre points dans chaque projet, parce que c’est ce qu’un délégué à la protection des données et un comité de direction demandent, et ce à quoi une offre en ligne ne répond pas toujours clairement.
Une couverture nationale depuis quatre agences
Marseille, notre siège, couvre le bassin méditerranéen d’Aix-en-Provence et Toulon à Nice, Montpellier et Nîmes, et remonte jusqu’à Valence. Lyon couvre l’Auvergne-Rhône-Alpes, de Grenoble à Clermont-Ferrand, Saint-Étienne, Annecy et Dijon. Amiens couvre les Hauts-de-France avec Lille, la Normandie avec Rouen et Le Havre, ainsi que Reims et le nord de l’Île-de-France. Paris couvre l’Île-de-France et les grands comptes nationaux.
Questions fréquentes
Peut-on vraiment faire tourner un modèle utile sur une machine locale ?
Est-ce moins cher que d'utiliser un service en ligne ?
Faut-il une salle machine spécifique ?
Comment garantir que nos données ne servent pas à entraîner un modèle tiers ?
Quel stockage prévoir pour un projet d'intelligence artificielle ?
NeoEdge peut-il nous accompagner avant l'achat de matériel ?
Votre cas d’usage IA tient-il la route ?
Nous qualifions le besoin réel en mémoire et en calcul avant tout investissement, et nous disons quand il ne faut pas acheter.
