Region Stuttgart · Baden-Württemberg

KI-Server in Stuttgart.
Ihre Daten bleiben im Haus.

sinlu liefert, integriert und betreibt KI-Anlagen auf eigener Hardware: Chat über Unternehmenswissen, Dokumentenverarbeitung und Workflows, mit projektspezifisch dokumentierten Daten- und Wartungswegen.

Unverbindlich · Terminvorschlag nach Eingang

sinlu · lokaler Kern Eigene KI-Anlage Hardware · Modelle · Plattform · Integration
0 Externe Modell-APIs im Regelbetrieb Die Modellverarbeitung läuft im Regelbetrieb ohne externe Modell-API. Daten- und Wartungswege werden separat dokumentiert.
Plan Vor der Bestellung Nach der Bestandsaufnahme entsteht ein schriftlicher Vorschlag für Hardware, Modelle, Integrationen und Betrieb.
BW Einsatzgebiet Stuttgart und der Großraum, darüber hinaus ganz Baden-Württemberg. Remote oder vor Ort.

Warum lokale Verarbeitung für sensible Unternehmensdaten relevant ist.

Bei externen KI-Diensten können Prompts, Dokumente oder Embeddings die Unternehmensgrenze überschreiten. Ob das zulässig und sinnvoll ist, hängt vom konkreten Dienst, Vertrag und Datenfluss ab.

Eine lokale Anlage kann die Modellverarbeitung im Firmennetz halten. Ob und welche Daten die Unternehmensgrenze verlassen, wird im projektspezifischen Datenfluss dokumentiert; Wartungs- und Betriebswege werden separat benannt, freigegeben und protokolliert.

Rechte kommen aus Ihrem Identitätsmanagement (Entra ID oder LDAP). sinlu kann sie nur weiter einschränken, nie erweitern.

Damit Datenschutz, Revision und, wo ein Betriebsrat besteht, die Mitbestimmung mit der Anlage arbeiten können, liegen dieselben Unterlagen jedem Projekt bei: Rollenmatrix, Datenflussdiagramm, Protokollumfang und der freigegebene Wartungsweg. Sie sind so angelegt, dass Sie sie in Ihr eigenes Managementsystem übernehmen können.

So ist die Anlage aufgebaut →

Für wen das in der Region zählt.

Der Mittelstand in der Region Stuttgart arbeitet mit Daten, deren Schutzbedarf und zulässige Betriebswege vor jeder Einführung geprüft werden. In fünf Gruppen fällt diese Prüfung besonders oft an:

Automotive & Maschinenbau

Entwicklungsdaten, Zeichnungen und Lieferantenverträge werden auf Ihrer Hardware verarbeitet, weil die Anlage in Ihrem Netz steht. Der Datenfluss benennt dazu jede Quelle und jedes Ziel, bevor die erste Abfrage läuft.

Kanzleien & Steuerberatung

Mandatsdaten liegen in freigegebenen Datenräumen. Wer welchen Raum sieht, steuert Ihr Identitätsmanagement. Rollen, Zugriffe und Wartungswege liegen projektspezifisch als Dokument im Prüfpaket.

Gesundheitswesen & Pflege

Personenbezogene Daten bleiben auf Ihrer Hardware, jeder Betriebs- und Wartungsweg ist einzeln benannt und jeder Zugriff protokolliert.

Öffentliche Auftraggeber

Die Anlage steht in Ihrem Netz und läuft im Regelbetrieb ohne externen Dienst. Sicherheits- und Datenschutzvorgaben prüfen Sie am dokumentierten Datenfluss; die Unterlagen dafür liegen vor der Bestellung vor.

Zulieferer mit NDA- und Cloud-Ausschlussklauseln

Rahmen- und Entwicklungsverträge großer Auftraggeber schließen externe Cloud-KI oft ausdrücklich aus. Ob eine Anlage im eigenen Netz solche Klauseln erfüllt, prüfen Sie am projektspezifisch dokumentierten Datenfluss: dem Nachweis gegenüber Auftraggeber und Audit.

Ob das für den konkreten Fall genügt, prüft Ihr Datenschutz. Die Unterlagen dafür entstehen im Projekt: Datenfluss, Rollenmatrix und Wartungsweg.

Vier Anlagenklassen als Rahmen fürs Erstgespräch.

Die Klasse ergibt sich im Gespräch: Aufgaben, Gleichzeitigkeit, Datenräume und vorhandene Infrastruktur bestimmen, wie groß die Anlage ausfällt. Die vier Klassen unten zeigen die Größenordnungen lokaler KI-Infrastruktur, mit denen sinlu plant, und ordnen ein Vorhaben ein, bevor Hardware ausgewählt wird.

Team

Parameterklasse
8–14B
Speicher
ab 32 GB VRAM
Hardware
ein kompakter GPU-Knoten

Ein Team oder eine Abteilung arbeitet mit Wissen aus den eigenen Ablagen. Eine Anlage dieser Größe passt in einen vorhandenen Serverraum und braucht selten neue Elektrik.

Business

Parameterklasse
24–35B
Speicher
ab 96 GB VRAM
Hardware
ein leistungsfähiger Knoten oder zwei GPUs

Mehrere Abteilungen arbeiten gleichzeitig, dazu kommen Besprechungsprotokolle und Agentenaufgaben. Den Bedarf treibt hier die Reserve für parallele Vorgänge stärker als die Modellgröße.

Scale

Parameterklasse
große MoE-Modelle
Speicher
ab 384 GB VRAM
Hardware
mehrere gekoppelte GPUs

Hohe Parallelität oder spezialisierte Arbeitslasten. Diese Klasse wird erst nach einem bezahlten Piloten mit reproduzierbarem Lasttest verbindlich ausgelegt.

Pilot erforderlich

Frontier

Parameterklasse
Frontier-Größe
Speicher
ab 1.680 GB VRAM
Hardware
Rechenzentrums-Cluster mit mehreren GPU-Knoten

Frontier-Größe ist ein Rechenzentrumsprojekt mit eigener Planung für Stellfläche, Strom und Kühlung. Auch hier steht der Lasttest vor der Auslegung.

Pilot erforderlich

Die Werte sind Planungsgrößen für das Erstgespräch; verbindlich wird die Auslegung mit dem Systemplan und, in den beiden oberen Klassen, mit dem Lasttest. Annahme: 16-Bit-Gewichte und KV-Cache an der Obergrenze der Klasse; die Reserve wächst mit gleichzeitigen Vorgängen und Kontextlänge.

Modellklassen mit Quellen im Detail →

Was den Aufwand treibt.

Auf dieser Seite steht kein Betrag. Was ihn treibt, lässt sich trotzdem vorher benennen: fünf Größen, von denen jede die nächste bestimmt.

  1. Anlagenklasse

    Am Anfang steht die Klasse. Sie folgt aus dem Erstgespräch und legt fest, in welcher Größenordnung sich alles Weitere bewegt.

  2. Speicherbedarf

    Aus der Klasse folgt der Speicherbedarf: die Gewichte des Modells plus eine Reserve für den Zwischenspeicher laufender Anfragen. Diese Reserve wächst mit gleichzeitigen Vorgängen und mit der Kontextlänge.

  3. GPU-Knoten

    Der Speicherbedarf entscheidet, ob ein kompakter Knoten genügt oder ob mehrere GPUs gekoppelt werden. Mit diesem Sprung ändern sich auch Stellfläche, Verkabelung und Gewicht im Rack.

  4. Elektrische Anschlussleistung

    Mehr GPUs ziehen mehr Strom und erzeugen mehr Abwärme. Der Systemplan weist die elektrische Anschlussleistung und den erwarteten Verbrauch je Lastprofil aus; Aufstellort, Kühlung und Netzwerk werden in der Bestandsaufnahme daraufhin geprüft.

  5. Wartung und Service

    Zuletzt der Betrieb. sinlu überwacht die Anlage, hält Modelle und Sicherheitsstand aktuell und nimmt Störungen über einen benannten Meldeweg an. Wie weit das reicht, entscheidet die Betriebsstufe: Grundbetrieb, Betrieb mit Pflege oder Betrieb mit Bereitschaft.

Warum hier trotzdem kein Betrag steht: Ein finanzieller Korridor wird erst mit vollständiger Lieferanten-BOM sowie freigegebenen Annahmen für Installation, Service, Strom, Finanzierung, Ersatzteile und SLA veröffentlicht. Bis dahin bekommen Sie die Aufschlüsselung im Systemplan: Hardware, Installation, Service, Strom und Servicegrad je Position.

Kauf und Miete sind beide möglich. Laufzeit, Service, Übernahme und Rückgabe stehen im individuellen Angebot, nachdem die Anlage dimensioniert ist.

Projektablauf vom Erstgespräch zum Systemplan →

Ein Standort, die ganze Region.

Der Sitz von sinlu liegt in Filderstadt auf den Fildern, unmittelbar an der Stuttgarter Stadtgrenze und zehn Minuten vom Flughafen. Ein Vor-Ort-Termin in Stuttgart oder Esslingen ist damit eine Anfahrt von rund einer halben Stunde.

Nürtingen liegt über die B 312 in derselben Richtung, Böblingen und Sindelfingen über die A 81. In diesem Ring sitzt ein großer Teil der Automotive- und Maschinenbau-Zulieferer der Region: Betriebe, deren Entwicklungsdaten und Lieferantenunterlagen der eigentliche Anlass für eine lokale Anlage sind. Wer die Hardware im eigenen Haus stehen hat, will die Menschen dazu in vertretbarer Entfernung wissen.

Das übrige Baden-Württemberg gehört zum selben Einsatzgebiet: Ludwigsburg, Waiblingen, Reutlingen, Tübingen, Heilbronn, Karlsruhe und Pforzheim liegen innerhalb eines Arbeitstages, weiter entfernte Standorte werden nach Absprache angefahren.

Der laufende Betrieb erfolgt remote. Die Wartung läuft über den freigegebenen und protokollierten Fernzugriff aus Ihrem Firmennetz heraus oder nach Absprache vor Ort.

So starten Sie in Stuttgart.

  1. Erstgespräch.

    30 Minuten zu Aufgaben, Datenräumen und vorhandener Hardware. Danach wissen Sie, ob Ihre Server reichen, auch dann, wenn es den Auftrag kleiner macht.

  2. Systemvorschlag.

    Nach der Bestandsaufnahme folgt ein schriftlicher Vorschlag für Hardware, Modelle, Integrationen und Betrieb, als Grundlage für ein Kauf- oder Mietangebot.

  3. Aufbau und Betrieb.

    Wir richten die Anlage in Ihrem Netzwerk ein, integrieren SharePoint, DMS, ERP oder Datenbanken und bleiben für Betrieb und Ausbau zuständig.

Häufige Fragen

Was ist ein KI-Server (AI-Server)?

Ein Server im Firmennetzwerk, der Sprachmodelle mit offenen Gewichten auf eigener GPU-Hardware ausführt. Chat, Dokumentensuche und Workflows laufen darauf. Der Server kann technisch vom Internet getrennt bleiben und ist an Ihre Systeme wie SharePoint, DMS oder SAP angebunden.

Wann ist lokale Verarbeitung gegenüber einem Cloud-Dienst sinnvoll?

Bei externen KI-Diensten können Daten die Unternehmensgrenze überschreiten. Eine lokale Anlage kann die Modellverarbeitung im eigenen Netzwerk halten; der konkrete Datenfluss, Wartungsweg und Geltungsbereich werden im Projekt dokumentiert.

Reicht unsere vorhandene Hardware für eine lokale KI?

Oft ja. Die Bestandsaufnahme prüft GPU, Speicher und Netzwerk gegen Ihre konkreten Aufgaben. Fehlt etwas, benennt der Vorschlag das fehlende Teil zusammen mit der Aufgabe, die es tragen soll.

Welche Anlagenklasse passt zu einem mittelständischen Betrieb?

Das hängt an gleichzeitigen Anfragen, Kontextlänge, Antwortgeschwindigkeit und Arbeitsprofil. Registrierte Nutzer allein reichen für eine belastbare Angabe nicht. Für begrenzte Wissensarbeit in einem Team genügt oft ein kompakter GPU-Knoten; sobald mehrere Abteilungen parallel arbeiten oder Agenten dazukommen, wächst der Speicherbedarf schneller als die Nutzerzahl.

Welche laufenden Kosten entstehen im Betrieb?

Der Verbrauch folgt der Anlagenklasse: Mehr GPUs ziehen mehr Strom und erzeugen mehr Abwärme. Im Systemplan stehen die elektrische Anschlussleistung und der erwartete Verbrauch je Lastprofil. Dazu kommen Wartung und, je nach Betriebsform, Miete oder Servicevertrag. Beträge nennt sinlu, sobald Lieferantenstückliste und Annahmen für Installation, Service, Strom und Servicegrad freigegeben sind.

Der Betrieb läuft remote. Kann sinlu jederzeit auf die Anlage zugreifen?

Nein. Der Fernzugriff ist ein eigener Weg, den Sie freigeben, jederzeit widerrufen und mitlesen können; jede Sitzung wird protokolliert. Für diesen Weg schließt sinlu eine Auftragsverarbeitungsvereinbarung ab, weil dabei personenbezogene Daten sichtbar werden können. Wer den Fernzugriff gar nicht öffnen möchte, kann die Wartung ausschließlich vor Ort vereinbaren.

Bedient sinlu auch Standorte außerhalb Stuttgarts?

Ja. Der Sitz liegt in Filderstadt, unmittelbar an Stuttgart. Vor Ort tätig ist sinlu im ganzen Großraum; darüber hinaus in ganz Baden-Württemberg. Der laufende Betrieb erfolgt remote über gesicherten Zugriff.

Wie lange dauert es bis zum laufenden System?

Das Erstgespräch dauert 30 Minuten. Danach wird der Systemvorschlag terminiert. Wie lang der Aufbau dauert, hängt von Hardware, Lieferzeit und Integrationen ab. Der Plan dazu steht, bevor das erste Gerät bestellt wird.

Weitere Fragen zu Hardware, Modellwahl und Kauf oder Miete beantworten die Fragen und Antworten zu lokalen KI-Anlagen.

Planen Sie Ihre KI-Anlage für die Region Stuttgart.

Wir prüfen gemeinsam Aufgaben, Gleichzeitigkeit, Datenräume und vorhandene Infrastruktur und schlagen ein passendes System vor – Hardware, Modelle, Integrationen und Betrieb in einem Plan.