Lokale KI-Entwicklung und -Automatisierung auf GB10 und DGX Spark
Aktie
Die Hardware macht 20 % aus.
Was man darauf aufbaut, sind 80 %.
Wir verkaufen nicht nur KI-Stationen. Wir entwickeln die Automatisierungen, die sie nützlich machen.
Ein GB10-Server auf einem Schreibtisch produziert allein nichts. Er wird nützlich, wenn Ihre Dokumente, Prozesse und täglichen Tools daran angeschlossen werden.
Das ist unser zweites Geschäftsfeld: die Konzeption und Entwicklung dieser Automatisierungen, vollständig lokal, auf dem Gerät, das wir Ihnen liefern.
Die drei Stufen der KI-Automatisierung
Nicht alle Unternehmen starten vom selben Punkt. Hier sind die drei häufigsten Niveaus, vom einfachsten bis zum ausgereiftesten.
Der Konversationsassistent
Der Ausgangspunkt. Eine Weboberfläche, die von jedem Arbeitsplatz aus zugänglich ist, mit Ihren installierten Modellen und indizierten Dokumenten.
Ihre Teams stellen Fragen, verfassen Texte, fassen zusammen, durchsuchen die Dokumentenbasis. Es ist das Äquivalent eines Verbraucher-Tools, aber bei Ihnen gehostet.
Dieses Niveau wird mit der Maschine konfiguriert geliefert. Es erfordert keine spezifische Entwicklung.
Automatisierte Workflows
Hier wartet die KI nicht mehr darauf, dass ihr eine Frage gestellt wird. Sie wird automatisch durch ein Ereignis ausgelöst.
Ein Dokument kommt an, ein Formular wird ausgefüllt, eine Uhrzeit schlägt: Eine Verarbeitungskette startet, ruft das lokale Modell auf, erzeugt ein Ergebnis und verteilt es dorthin, wo es benötigt wird.
Wir bauen diese Ketten mit n8n, einem Orchestrator, den wir auf Ihrer Maschine hosten. Alles bleibt lokal, einschließlich der Daten, die zwischen den Schritten übertragen werden.
Die maßgeschneiderte Geschäftsanwendung
Das ausgereifteste Niveau. Wenn kein Tool auf dem Markt zu Ihrem Prozess passt, entwickeln wir eine spezielle Anwendung.
Eine an Ihr Geschäft angepasste Oberfläche, deterministische Berechnungen dort, wo sie erforderlich sind, Aufruf des lokalen Modells nur dort, wo es einen Mehrwert bietet. Alles auf Ihrer Maschine installiert, ohne externe Abhängigkeiten.
Entwicklung in Python, mit der für Ihre Nutzung passenden Oberfläche: Desktop-Anwendung, interne Weboberfläche oder Integration in ein bestehendes Tool.
Der technische Stack, den wir installieren
Hier sind die Schichten, die wir auf einer GB10- oder DGX Spark-Station bereitstellen, von der Maschine bis zu Ihrer täglichen Nutzung.
Jede Schicht ist mit Docker containerisiert. Dies ermöglicht es, eine Komponente zu aktualisieren, ohne die anderen zu beeinträchtigen, und die Installation identisch auf einer zweiten Maschine zu reproduzieren.
Beispiele, was wir entwickeln
Hier sind einige Arten von Umsetzungen, anonymisiert präsentiert.
Automatisierte Abrechnungskette
Eine Bestellung wird in einem Online-Shop bestätigt. Ein Webhook löst die Generierung des Dokuments, dessen Formatierung und den automatischen Versand an den Kunden per E-Mail aus.
n8n, Dokumentengenerierungsdienst, Mailserver, alles in Docker-Containern.
Geschäftsanwendung mit Transkription und Textgenerierung
Ein Fachmann zeichnet eine Sitzung auf. Die Anwendung transkribiert den Ton lokal, erfasst numerische Daten in einem strukturierten Formular, berechnet Indikatoren mit deterministischem Code und lässt die narrativen Teile vom lokalen Modell erstellen. Das endgültige Dokument wird zur Überprüfung bereit generiert.
Python, lokales Whisper, überprüfbare Berechnungen, lokales Sprachmodell, Dokumentengenerierung.
Abfragbare Dokumentenbasis
Hunderte interne Dokumente werden auf der Maschine segmentiert, vektorisiert und indiziert. Die Teams können die gesamte Sammlung in natürlicher Sprache abfragen und erhalten Antworten mit Verweisen auf die Quelldokumente.
Ingestions-Pipeline, Vektorbasis, lokales Embedding-Modell, Diskussionsschnittstelle.
Automatisierte Überwachung und Mahnungen
Ein Skript überprüft ein Postfach, identifiziert Fälle ohne Antwort nach einer bestimmten Frist, bereitet Mahnungen vor und sendet eine zusammenfassende Benachrichtigung an den internen Messaging-Dienst des Teams.
Python, E-Mail-Zugriff, Planung, Benachrichtigung an Telegram oder Unternehmens-Messaging.
Warum der GB10 eine ideale Basis ist
Die NVIDIA GB10-Plattform, auch als DGX Spark oder ASUS Ascent GX10 bekannt, hat eine entscheidende Eigenschaft für diese Art von Projekten: 128 GB Unified Memory.
Konkret ermöglicht dies die gleichzeitige Ausführung mehrerer Komponenten, die sich auf einer klassischen Grafikkarte den Videospeicher streiten würden: ein großes Sprachmodell, ein Embedding-Modell für die Dokumentensuche, eine Transkriptions-Engine und die Anwendungscontainer.
Zwei weitere Vorteile sind für eine Maschine, die kontinuierlich läuft, wichtig: ein Verbrauch von etwa 240 W und ein kompaktes und leises Format, das es ermöglicht, sie in einem Büro statt in einem Technikraum aufzustellen.
Mini IA-Server NVIDIA GB10
- Chip NVIDIA GB10 Grace Blackwell
- Speicher 128 GB LPDDR5X Unified
- Leistung 1 PetaFLOP in FP4
- System DGX OS, Docker sofort einsatzbereit
- Verbrauch ca. 240 W
- Format 150 × 150 × 51 mm
Wie ein Projekt abläuft
- Erstes Gespräch. Wir identifizieren den zu automatisierenden Prozess, das betreffende Volumen und die Vertraulichkeitsanforderungen. Unverbindlich.
- Rahmenbedingungen und Angebot. Wir beschreiben genau, was geliefert wird, die benötigte Hardwarebasis und die Kosten. Sie genehmigen, bevor wir beginnen.
- Entwicklung. Wir entwickeln die Lösung und testen sie auf einer identischen Maschine wie Ihrer.
- Installation. Vor Ort oder remote, je nach Präferenz, mit der gesamten vorkonfigurierten Umgebung.
- Schulung. Einarbeitung für die Personen, die das Tool täglich nutzen werden.
- Follow-up. Anpassungen, Hinzufügen von Dokumenten zum Index, Aktualisierung von Modellen und zukünftige Entwicklungen.
Andere Maschinen, die für diese Entwicklungen geeignet sind
CoreAI 32 — RTX 5070 Ti 16 GBEinfache Automatisierungen und moderate Dokumentenbasis.
2.442 €
CoreAI 64 — RTX 5090 32 GBHoher Durchsatz für aufwendige Verarbeitungen und Massentranskription.
6.042 €
CoreAI Rack — 2 × RTX 5090 (64 GB)Automatisierungen auf Teamebene, parallele Verarbeitungen.
11.221 €
CoreAI 128 Rack — 2 × RTX 6000 (192 GB ECC)Kontinuierliche Produktion, viele Benutzer, ECC-Zuverlässigkeit.
27.980 €
Um ein Automatisierungsprojekt zu besprechen, schreiben Sie uns an contact@radiancesystems.eu. Wir antworten innerhalb von 3 Werktagen, auf Französisch, Englisch oder Niederländisch.
Häufig gestellte Fragen
Was leistet Radiance Systems über den Hardware-Verkauf hinaus?
Wir entwickeln die Automatisierungen, die auf den Maschinen laufen: n8n-Workflows, kundenspezifische Python-Anwendungen, abfragbare Dokumentenbasen, Transkriptions- und Schreibketten. Alles läuft lokal, ohne Datenübertragung an externe Dienste.
Was sind GB10 und DGX Spark?
Es handelt sich um dieselbe NVIDIA-Hardwareplattform, die auf dem GB10 Grace Blackwell-Chip basiert und 128 GB Unified Memory bietet. DGX Spark ist der Name des NVIDIA-Referenzdesigns; ASUS Ascent GX10 ist eine Variante davon. Dieser Unified Memory ermöglicht die gleichzeitige Ausführung mehrerer KI-Komponenten auf einer einzigen kompakten Maschine.
Warum n8n statt eines Online-Automatisierungsdienstes verwenden?
Weil n8n auf Ihrer eigenen Maschine gehostet werden kann. Online-Automatisierungsdienste leiten Ihre Daten über ihre Server. Mit lokal installiertem n8n bleiben Dokumente, Nachrichten und Ergebnisse in Ihrer Infrastruktur.
Können wir die lokale KI mit unseren bestehenden Tools verbinden?
Ja, in den meisten Fällen. E-Mail, Dateispeicher, Online-Shop, interne Tools mit einer Programmierschnittstelle: Das sind die üblichen Verbindungspunkte eines Workflows. Wir prüfen die Machbarkeit während der Rahmenplanung.
Wie viel kostet eine maßgeschneiderte Entwicklung?
Das hängt vollständig vom Umfang ab. Eine einfache Automatisierung erfordert einige Tage Arbeit; eine vollständige Geschäftsanwendung benötigt mehr. Wir erstellen ein präzises Angebot nach dem Rahmenplanungsgespräch, bevor Sie eine Verpflichtung eingehen.
Müssen wir die Maschine bei Ihnen kaufen, um von der Entwicklung zu profitieren?
Das ist nicht zwingend, aber einfacher. Wenn wir die Maschine liefern, beherrschen wir die gesamte Umgebung und können die Lösung vor der Auslieferung auf einer identischen Konfiguration testen. Wir prüfen jedoch auch Anfragen für eine bestehende Infrastruktur.
Was passiert, wenn sich unsere Anforderungen ändern?
Die Lösungen sind auf Weiterentwicklung ausgelegt. Das Hinzufügen von Dokumenten zum Index, das Ändern eines Workflow-Schritts oder das Ersetzen eines Modells durch eine neuere Version gehört zu den von uns angebotenen Dienstleistungen.
Die dargestellten Beispiele beschreiben Arten von Umsetzungen und sind bewusst anonymisiert. Umfang, Dauer und Kosten eines Projekts hängen von Ihren Prozessen und Einschränkungen ab; sie werden während der Rahmenplanung definiert und in einem Angebot vor dem Start formalisiert.




