Développement et automatisations IA locales sur GB10 et DGX Spark
Share
La machine, c'est 20 %.
Ce qu'on construit dessus, c'est 80 %.
Nous ne vendons pas seulement des stations IA. Nous développons les automatisations qui les rendent utiles.
Un serveur GB10 posé sur un bureau ne produit rien tout seul. Il devient utile quand on branche dessus vos documents, vos processus et vos outils quotidiens.
C'est notre second métier : concevoir et développer ces automatisations, entièrement en local, sur la machine que nous vous livrons.
Les trois étages de l'automatisation IA
Toutes les entreprises ne partent pas du même point. Voici les trois niveaux que nous rencontrons le plus souvent, du plus simple au plus abouti.
L'assistant conversationnel
Le point de départ. Une interface web accessible depuis n'importe quel poste, avec vos modèles installés et vos documents indexés.
Vos équipes posent des questions, rédigent, synthétisent, interrogent la base documentaire. C'est l'équivalent d'un outil grand public, mais hébergé chez vous.
Ce niveau est livré configuré avec la machine. Il ne demande aucun développement spécifique.
Les workflows automatisés
Ici, l'IA cesse d'attendre qu'on lui pose une question. Elle se déclenche seule sur un événement.
Un document arrive, un formulaire est rempli, une heure sonne : une chaîne de traitement démarre, appelle le modèle local, produit un résultat et le distribue là où il faut.
Nous construisons ces chaînes avec n8n, un orchestrateur que nous hébergeons sur votre machine. Tout reste local, y compris les données qui transitent entre les étapes.
L'application métier sur mesure
Le niveau le plus abouti. Quand aucun outil du marché ne correspond à votre processus, nous développons une application dédiée.
Interface adaptée à votre métier, calculs déterministes là où ils sont nécessaires, appel au modèle local uniquement là où il apporte de la valeur. Le tout installé sur votre machine, sans dépendance externe.
Développement en Python, avec l'interface qui convient à votre usage : application de bureau, interface web interne, ou intégration dans un outil existant.
La pile technique que nous installons
Voici les couches que nous déployons sur une station GB10 ou DGX Spark, de la machine jusqu'à votre usage quotidien.
Chaque couche est conteneurisée avec Docker. Cela permet de mettre à jour un composant sans casser les autres, et de reproduire l'installation à l'identique sur une seconde machine.
Des exemples de ce que nous construisons
Voici quelques types de réalisations, présentés sans identifier les clients.
Chaîne de facturation automatisée
Une commande est validée sur une boutique en ligne. Un webhook déclenche la génération du document, sa mise en forme, puis son envoi automatique au client par courriel.
n8n, service de génération de documents, serveur de messagerie, le tout en conteneurs Docker.
Application métier avec transcription et rédaction
Un professionnel enregistre une séance. L'application transcrit l'audio en local, saisit des données chiffrées dans un formulaire structuré, calcule les indicateurs par du code déterministe, puis fait rédiger les parties narratives par le modèle local. Le document final est généré prêt à relire.
Python, Whisper local, calculs vérifiables, modèle de langage local, génération de document.
Base documentaire interrogeable
Des centaines de documents internes sont découpés, vectorisés et indexés sur la machine. Les équipes interrogent l'ensemble en langage naturel et obtiennent des réponses avec renvoi aux documents sources.
Pipeline d'ingestion, base vectorielle, modèle d'embeddings local, interface de discussion.
Veille et relances automatisées
Un script consulte une boîte de messagerie, identifie les dossiers sans réponse depuis un délai défini, prépare des relances et envoie une notification récapitulative sur la messagerie interne de l'équipe.
Python, accès messagerie, planification, notification vers Telegram ou messagerie d'entreprise.
Pourquoi le GB10 est une base idéale
La plateforme NVIDIA GB10, déclinée sous le nom DGX Spark ou ASUS Ascent GX10, a une caractéristique décisive pour ce type de projets : 128 Go de mémoire unifiée.
Concrètement, cela permet de faire tourner simultanément plusieurs composants qui, sur une carte graphique classique, se disputeraient la mémoire vidéo : un grand modèle de langage, un modèle d'embeddings pour la recherche documentaire, un moteur de transcription, et les conteneurs applicatifs.
Deux autres atouts comptent pour une machine qui tourne en continu : une consommation d'environ 240 W et un format compact et silencieux, qui lui permet de rester dans un bureau plutôt que dans un local technique.
Mini serveur IA NVIDIA GB10
- Puce NVIDIA GB10 Grace Blackwell
- Mémoire 128 Go LPDDR5X unifiée
- Puissance 1 pétaFLOP en FP4
- Système DGX OS, Docker prêt à l'emploi
- Consommation environ 240 W
- Format 150 × 150 × 51 mm
Comment se déroule une mission
- Échange initial. Nous identifions le processus à automatiser, le volume concerné et les contraintes de confidentialité. Sans engagement.
- Cadrage et devis. Nous décrivons précisément ce qui sera livré, la base matérielle nécessaire et le coût. Vous validez avant que nous commencions.
- Développement. Nous construisons la solution et la testons sur une machine identique à la vôtre.
- Installation. Sur site ou à distance, selon votre préférence, avec l'ensemble de l'environnement préconfiguré.
- Formation. Prise en main pour les personnes qui utiliseront l'outil au quotidien.
- Suivi. Ajustements, ajout de documents à l'index, mise à jour des modèles et évolutions ultérieures.
Autres machines adaptées à ces développements
CoreAI 32 — RTX 5070 Ti 16 GoAutomatisations simples et base documentaire de taille modérée.
2 442 €
CoreAI 64 — RTX 5090 32 GoDébit élevé pour les traitements lourds et la transcription en masse.
6 042 €
CoreAI Rack — 2 × RTX 5090 (64 Go)Automatisations à l'échelle d'une équipe, traitements en parallèle.
11 221 €
CoreAI 128 Rack — 2 × RTX 6000 (192 Go ECC)Production continue, nombreux utilisateurs, fiabilité ECC.
27 980 €
Pour discuter d'un projet d'automatisation, écrivez-nous à contact@radiancesystems.eu. Nous répondons sous 3 heures ouvrées, en français, en anglais ou en néerlandais.
Questions fréquentes
Que fait Radiance Systems au-delà de la vente de matériel ?
Nous développons les automatisations qui tournent sur les machines : workflows n8n, applications Python sur mesure, bases documentaires interrogeables, chaînes de transcription et de rédaction. Le tout fonctionne en local, sans transmission de données à un service externe.
Qu'est-ce que le GB10 et le DGX Spark ?
Il s'agit de la même plateforme matérielle NVIDIA, fondée sur la puce GB10 Grace Blackwell, avec 128 Go de mémoire unifiée. DGX Spark est le nom de la conception de référence NVIDIA ; ASUS Ascent GX10 en est une déclinaison. Cette mémoire unifiée permet de faire tourner plusieurs composants d'IA simultanément sur une seule machine compacte.
Pourquoi utiliser n8n plutôt qu'un service d'automatisation en ligne ?
Parce que n8n peut être hébergé sur votre propre machine. Les services d'automatisation en ligne font transiter vos données par leurs serveurs. Avec n8n installé en local, les documents, les messages et les résultats restent dans votre infrastructure.
Peut-on connecter l'IA locale à nos outils existants ?
Oui, dans la plupart des cas. Messagerie, stockage de fichiers, boutique en ligne, outils internes disposant d'une interface de programmation : ce sont les points de connexion habituels d'un workflow. Nous vérifions la faisabilité lors du cadrage.
Combien coûte un développement sur mesure ?
Cela dépend entièrement du périmètre. Une automatisation simple représente quelques jours de travail ; une application métier complète demande davantage. Nous établissons un devis précis après l'échange de cadrage, avant tout engagement de votre part.
Faut-il acheter la machine chez vous pour bénéficier du développement ?
Ce n'est pas obligatoire, mais c'est plus simple. Quand nous fournissons la machine, nous maîtrisons l'environnement complet et pouvons tester la solution sur une configuration identique avant livraison. Nous étudions toutefois les demandes portant sur une infrastructure existante.
Que se passe-t-il si nos besoins évoluent ?
Les solutions sont conçues pour évoluer. Ajouter des documents à l'index, modifier une étape d'un workflow ou remplacer un modèle par une version plus récente fait partie du suivi que nous proposons.
Les exemples présentés décrivent des types de réalisations et sont volontairement anonymisés. Le périmètre, la durée et le coût d'un projet dépendent de vos processus et de vos contraintes ; ils sont définis lors du cadrage et formalisés dans un devis avant tout démarrage.




