Lokale KI-Entwicklung und -Automatisierung auf GB10 und DGX Spark

Die Hardware macht 20 % aus.
Was man darauf aufbaut, sind 80 %.

Wir verkaufen nicht nur KI-Stationen. Wir entwickeln die Automatisierungen, die sie nützlich machen.

n8n WorkflowsGeschäftsautomatisierungen
Python-Anwendungenmaßgeschneiderte Tools
100 % lokalauf GB10 oder DGX Spark

Ein GB10-Server auf einem Schreibtisch produziert allein nichts. Er wird nützlich, wenn Ihre Dokumente, Prozesse und täglichen Tools daran angeschlossen werden.

Das ist unser zweites Geschäftsfeld: die Konzeption und Entwicklung dieser Automatisierungen, vollständig lokal, auf dem Gerät, das wir Ihnen liefern.


Die drei Stufen der KI-Automatisierung

Nicht alle Unternehmen starten vom selben Punkt. Hier sind die drei häufigsten Niveaus, vom einfachsten bis zum ausgereiftesten.

1

Der Konversationsassistent

Bei Lieferung enthalten

Der Ausgangspunkt. Eine Weboberfläche, die von jedem Arbeitsplatz aus zugänglich ist, mit Ihren installierten Modellen und indizierten Dokumenten.

Ihre Teams stellen Fragen, verfassen Texte, fassen zusammen, durchsuchen die Dokumentenbasis. Es ist das Äquivalent eines Verbraucher-Tools, aber bei Ihnen gehostet.

Dieses Niveau wird mit der Maschine konfiguriert geliefert. Es erfordert keine spezifische Entwicklung.

2

Automatisierte Workflows

Standardleistung

Hier wartet die KI nicht mehr darauf, dass ihr eine Frage gestellt wird. Sie wird automatisch durch ein Ereignis ausgelöst.

Ein Dokument kommt an, ein Formular wird ausgefüllt, eine Uhrzeit schlägt: Eine Verarbeitungskette startet, ruft das lokale Modell auf, erzeugt ein Ergebnis und verteilt es dorthin, wo es benötigt wird.

Wir bauen diese Ketten mit n8n, einem Orchestrator, den wir auf Ihrer Maschine hosten. Alles bleibt lokal, einschließlich der Daten, die zwischen den Schritten übertragen werden.

3

Die maßgeschneiderte Geschäftsanwendung

Spezielle Entwicklung

Das ausgereifteste Niveau. Wenn kein Tool auf dem Markt zu Ihrem Prozess passt, entwickeln wir eine spezielle Anwendung.

Eine an Ihr Geschäft angepasste Oberfläche, deterministische Berechnungen dort, wo sie erforderlich sind, Aufruf des lokalen Modells nur dort, wo es einen Mehrwert bietet. Alles auf Ihrer Maschine installiert, ohne externe Abhängigkeiten.

Entwicklung in Python, mit der für Ihre Nutzung passenden Oberfläche: Desktop-Anwendung, interne Weboberfläche oder Integration in ein bestehendes Tool.

Eine Regel, die wir systematisch anwenden. Ein Sprachmodell sollte niemals das tun, was eine deterministische Berechnung besser kann. In unseren Anwendungen werden Scores, Summen und Konvertierungen durch überprüfbaren Code berechnet. Das Modell ist für die Redaktion, Zusammenfassung und Umformulierung zuständig. Diese Trennung ist der Unterschied zwischen einem zuverlässigen Tool und einem beeindruckenden, aber in der Produktion fehlerhaften Demonstrationstool.


Der technische Stack, den wir installieren

Hier sind die Schichten, die wir auf einer GB10- oder DGX Spark-Station bereitstellen, von der Maschine bis zu Ihrer täglichen Nutzung.

Ihre Anwendungen Weboberfläche, Geschäftsanwendung, Messaging
Automatisierung n8n, geplante Skripte, Konnektoren
Maßgeschneiderte Anwendungen Python, FastAPI, Gradio, ReportLab
KI-Schicht Ollama, Open WebUI, RAG, Vektorbasis, Whisper
Hardware und System GB10 / DGX Spark, DGX OS, Docker

Jede Schicht ist mit Docker containerisiert. Dies ermöglicht es, eine Komponente zu aktualisieren, ohne die anderen zu beeinträchtigen, und die Installation identisch auf einer zweiten Maschine zu reproduzieren.


Beispiele, was wir entwickeln

Hier sind einige Arten von Umsetzungen, anonymisiert präsentiert.

Automatisierte Abrechnungskette

Eine Bestellung wird in einem Online-Shop bestätigt. Ein Webhook löst die Generierung des Dokuments, dessen Formatierung und den automatischen Versand an den Kunden per E-Mail aus.

n8n, Dokumentengenerierungsdienst, Mailserver, alles in Docker-Containern.

Geschäftsanwendung mit Transkription und Textgenerierung

Ein Fachmann zeichnet eine Sitzung auf. Die Anwendung transkribiert den Ton lokal, erfasst numerische Daten in einem strukturierten Formular, berechnet Indikatoren mit deterministischem Code und lässt die narrativen Teile vom lokalen Modell erstellen. Das endgültige Dokument wird zur Überprüfung bereit generiert.

Python, lokales Whisper, überprüfbare Berechnungen, lokales Sprachmodell, Dokumentengenerierung.

Abfragbare Dokumentenbasis

Hunderte interne Dokumente werden auf der Maschine segmentiert, vektorisiert und indiziert. Die Teams können die gesamte Sammlung in natürlicher Sprache abfragen und erhalten Antworten mit Verweisen auf die Quelldokumente.

Ingestions-Pipeline, Vektorbasis, lokales Embedding-Modell, Diskussionsschnittstelle.

Automatisierte Überwachung und Mahnungen

Ein Skript überprüft ein Postfach, identifiziert Fälle ohne Antwort nach einer bestimmten Frist, bereitet Mahnungen vor und sendet eine zusammenfassende Benachrichtigung an den internen Messaging-Dienst des Teams.

Python, E-Mail-Zugriff, Planung, Benachrichtigung an Telegram oder Unternehmens-Messaging.

Der gemeinsame Nenner all dieser Projekte: Es verlassen keine Daten die Maschine des Kunden. Die Modelle, der Orchestrator, die Dokumentenbasis und die Anwendungen laufen alle lokal. Das macht diese Automatisierungen in Sektoren nutzbar, in denen die Auslagerung von Daten unmöglich ist.


Warum der GB10 eine ideale Basis ist

Die NVIDIA GB10-Plattform, auch als DGX Spark oder ASUS Ascent GX10 bekannt, hat eine entscheidende Eigenschaft für diese Art von Projekten: 128 GB Unified Memory.

Konkret ermöglicht dies die gleichzeitige Ausführung mehrerer Komponenten, die sich auf einer klassischen Grafikkarte den Videospeicher streiten würden: ein großes Sprachmodell, ein Embedding-Modell für die Dokumentensuche, eine Transkriptions-Engine und die Anwendungscontainer.

Zwei weitere Vorteile sind für eine Maschine, die kontinuierlich läuft, wichtig: ein Verbrauch von etwa 240 W und ein kompaktes und leises Format, das es ermöglicht, sie in einem Büro statt in einem Technikraum aufzustellen.

Die Basis unserer Entwicklungen

Mini IA-Server NVIDIA GB10

  • Chip NVIDIA GB10 Grace Blackwell
  • Speicher 128 GB LPDDR5X Unified
  • Leistung 1 PetaFLOP in FP4
  • System DGX OS, Docker sofort einsatzbereit
  • Verbrauch ca. 240 W
  • Format 150 × 150 × 51 mm
3.999 € ab, konfigurierbar
Maschine entdecken
Der GB10 ist nicht die einzige Option. Für einen bescheideneren Bedarf genügt eine CoreAI-Station. Für eine unternehmensweite Bereitstellung bieten unsere Multi-GPU-Rack-Konfigurationen mehr Durchsatz und Multi-User-Kapazität. Wir passen die Hardware-Basis an das Projekt an, niemals umgekehrt.


Wie ein Projekt abläuft

  • Erstes Gespräch. Wir identifizieren den zu automatisierenden Prozess, das betreffende Volumen und die Vertraulichkeitsanforderungen. Unverbindlich.
  • Rahmenbedingungen und Angebot. Wir beschreiben genau, was geliefert wird, die benötigte Hardwarebasis und die Kosten. Sie genehmigen, bevor wir beginnen.
  • Entwicklung. Wir entwickeln die Lösung und testen sie auf einer identischen Maschine wie Ihrer.
  • Installation. Vor Ort oder remote, je nach Präferenz, mit der gesamten vorkonfigurierten Umgebung.
  • Schulung. Einarbeitung für die Personen, die das Tool täglich nutzen werden.
  • Follow-up. Anpassungen, Hinzufügen von Dokumenten zum Index, Aktualisierung von Modellen und zukünftige Entwicklungen.
Wir bleiben nach der Lieferung erreichbar. Eine Automatisierung lebt mit dem Unternehmen: Neue Dokumente kommen hinzu, ein Prozess ändert sich, ein leistungsfähigeres Modell erscheint. Wir bieten Nachbetreuung und Weiterentwicklungen auf Anfrage an, anstatt ein Projekt abzuliefern und dann aufzugeben.


Andere Maschinen, die für diese Entwicklungen geeignet sind

Radiance CoreAI 32 CoreAI 32 — RTX 5070 Ti 16 GBEinfache Automatisierungen und moderate Dokumentenbasis. 2.442 € Radiance CoreAI 64 RTX 5090 CoreAI 64 — RTX 5090 32 GBHoher Durchsatz für aufwendige Verarbeitungen und Massentranskription. 6.042 € Radiance Rack 2x RTX 5090 CoreAI Rack — 2 × RTX 5090 (64 GB)Automatisierungen auf Teamebene, parallele Verarbeitungen. 11.221 € Radiance Rack 2x RTX 6000 Blackwell ECC CoreAI 128 Rack — 2 × RTX 6000 (192 GB ECC)Kontinuierliche Produktion, viele Benutzer, ECC-Zuverlässigkeit. 27.980 €

Um ein Automatisierungsprojekt zu besprechen, schreiben Sie uns an contact@radiancesystems.eu. Wir antworten innerhalb von 3 Werktagen, auf Französisch, Englisch oder Niederländisch.


Häufig gestellte Fragen


Was leistet Radiance Systems über den Hardware-Verkauf hinaus?

Wir entwickeln die Automatisierungen, die auf den Maschinen laufen: n8n-Workflows, kundenspezifische Python-Anwendungen, abfragbare Dokumentenbasen, Transkriptions- und Schreibketten. Alles läuft lokal, ohne Datenübertragung an externe Dienste.


Was sind GB10 und DGX Spark?

Es handelt sich um dieselbe NVIDIA-Hardwareplattform, die auf dem GB10 Grace Blackwell-Chip basiert und 128 GB Unified Memory bietet. DGX Spark ist der Name des NVIDIA-Referenzdesigns; ASUS Ascent GX10 ist eine Variante davon. Dieser Unified Memory ermöglicht die gleichzeitige Ausführung mehrerer KI-Komponenten auf einer einzigen kompakten Maschine.


Warum n8n statt eines Online-Automatisierungsdienstes verwenden?

Weil n8n auf Ihrer eigenen Maschine gehostet werden kann. Online-Automatisierungsdienste leiten Ihre Daten über ihre Server. Mit lokal installiertem n8n bleiben Dokumente, Nachrichten und Ergebnisse in Ihrer Infrastruktur.


Können wir die lokale KI mit unseren bestehenden Tools verbinden?

Ja, in den meisten Fällen. E-Mail, Dateispeicher, Online-Shop, interne Tools mit einer Programmierschnittstelle: Das sind die üblichen Verbindungspunkte eines Workflows. Wir prüfen die Machbarkeit während der Rahmenplanung.


Wie viel kostet eine maßgeschneiderte Entwicklung?

Das hängt vollständig vom Umfang ab. Eine einfache Automatisierung erfordert einige Tage Arbeit; eine vollständige Geschäftsanwendung benötigt mehr. Wir erstellen ein präzises Angebot nach dem Rahmenplanungsgespräch, bevor Sie eine Verpflichtung eingehen.


Müssen wir die Maschine bei Ihnen kaufen, um von der Entwicklung zu profitieren?

Das ist nicht zwingend, aber einfacher. Wenn wir die Maschine liefern, beherrschen wir die gesamte Umgebung und können die Lösung vor der Auslieferung auf einer identischen Konfiguration testen. Wir prüfen jedoch auch Anfragen für eine bestehende Infrastruktur.


Was passiert, wenn sich unsere Anforderungen ändern?

Die Lösungen sind auf Weiterentwicklung ausgelegt. Das Hinzufügen von Dokumenten zum Index, das Ändern eines Workflow-Schritts oder das Ersetzen eines Modells durch eine neuere Version gehört zu den von uns angebotenen Dienstleistungen.

Die dargestellten Beispiele beschreiben Arten von Umsetzungen und sind bewusst anonymisiert. Umfang, Dauer und Kosten eines Projekts hängen von Ihren Prozessen und Einschränkungen ab; sie werden während der Rahmenplanung definiert und in einem Angebot vor dem Start formalisiert.

Zurück zum Blog

Ihr Angebot für eine maßgeschneiderte KI-Lösung innerhalb von 24–48 Stunden

Jedes Radiance-Projekt beginnt mit einem Gespräch. Füllen Sie dieses Formular aus und ein Experte wird sich umgehend mit einer auf Ihr Unternehmen und Ihr Budget zugeschnittenen Lösung bei Ihnen melden.

Antwort innerhalb von 24–48 Arbeitsstunden
Lieferung innerhalb Europas (EU)
2 Jahre Garantie inklusive
Installation vor Ort möglich
Keine Verpflichtung auf Abruf
Dedizierter Support vor und nach dem Kauf
01 Was ist Ihr Hauptverwendungszweck für KI?
Multiple Choice.
02 In welchem Kontext wird das System verwendet?
Nur eine Wahlmöglichkeit.
03 Welche Art von System suchen Sie?
Nur eine Wahlmöglichkeit.
04 Welches Betriebssystem bevorzugen Sie?
Nur eine Wahlmöglichkeit.
05 Welche Erwartungen haben Sie an die Software?
Multiple Choice.
06 Was ist Ihr Richtbudget?
Nur eine Wahlmöglichkeit.
07 Wann möchten Sie Ihr System erhalten?
Nur eine Wahlmöglichkeit.
08 Wünschen Sie eine Begleitung bei der Umsetzung?
Einzelne Auswahl. Ein Radiance-Techniker kann Sie vor Ort oder per Fernzugriff unterstützen.
09 Lieferland (nur EU) *
Wir liefern ausschließlich innerhalb der Europäischen Union (EU).
10 Zusätzliche Informationen (optional, aber sehr nützlich)
Beschreiben Sie kurz Ihr Projekt, etwaige spezifische Einschränkungen oder sonstige relevante Informationen.
11 Möchten Sie kontaktiert werden, um Ihr Projekt zu besprechen?
Wenn Sie „Nur Kostenvoranschlag“ auswählen, können Sie auf unsere E-Mail antworten, um Ihre Fragen zu stellen und den Kostenvoranschlag zu verfeinern.
12 E-Mail *
Wir senden Ihnen das Angebot an diese Adresse.

Weitere Fragen?

Senden Sie uns eine E-Mail an contact@radiancesystems,eu oder kontaktieren Sie uns über das Kontaktformular. Wir beantworten alle Anfragen während der Arbeitszeiten (Montag bis Freitag von 9 bis 17 Uhr) innerhalb von 3 Stunden.

📞 +33 4 65 84 48 21