RB2SHosting · IT · Beratung

Scherwiller bei Sélestat — das Modell läuft dort, wo Sie sind

Elsässische KI: Das Modell läuft in den Weinbergen, nicht jenseits des Atlantiks.

Für viele Organisationen lautet die Frage nicht, welches Modell das klügste ist, sondern wohin die Sätze gehen, die man ihm anvertraut. Eine Prozessakte, ein Operationsbericht, ein industrieller Fertigungsplan, ein Gemeinderatsbeschluss — solche Texte haben bei Dritten nichts verloren. Wir richten ein offenes Sprachmodell auf einer Maschine ein, die Ihnen allein gehört, in unserem Technikraum im Centre Alsace, und wir betreiben sie.

Beginnen wir mit Offenheit

Der Assistent dieser Website läuft noch nicht im Elsass. Er wird es selbst sagen, sobald es so weit ist.

Wir würden souveräne KI schlecht verkaufen, wenn wir über unsere eigene die Unwahrheit sagten. Der Assistent, den Sie etwas weiter unten auf dieser Seite ausprobieren können, nutzt derzeit die Programmierschnittstelle eines Modellanbieters: Ihre Fragen werden dorthin übermittelt. Die Schnittstelle ist bereits so geschrieben, dass sie zuerst unsere eigene Maschine anspricht und nur bei deren Ausfall auf die API zurückfällt — es fehlt allein die Maschine, erwartet zur Inbetriebnahme des Hostings.

Heute
Der Assistent von rb2s.com spricht eine externe Programmierschnittstelle an. Keine Frage wird auf unseren Servern gespeichert; geführt werden ausschließlich aggregierte Zähler.
Zur Inbetriebnahme
Ein dedizierter Mac in unserem Technikraum führt ein offenes Modell aus. Die API dient dann nur noch als Auffangnetz, wenn die Maschine steht.
Was Sie sehen
Jede von unserer Maschine erzeugte Antwort trägt den Hinweis „Antwort von einem Modell in unserem eigenen Technikraum“. Fehlt er, stammt die Antwort aus der API. Sie müssen uns nicht glauben.
Für Ihre Maschinen
Was hier beschrieben ist, wartet auf nichts: Eine dedizierte Maschine, die wir für Sie einrichten, führt Ihr Modell vom Tag der Inbetriebnahme an vor Ort aus.

Probieren Sie es gleich aus

Sprechen Sie mit ihm. Derselbe Assistent, dieselben Vorgaben.

Er antwortet anhand der auf dieser Website veröffentlichten Angaben, geht keinerlei Verpflichtung im Namen von RB2S ein und sagt, wenn er etwas nicht weiß — auch über die Maschine, auf der er gerade läuft. Keine Anmeldung, nichts wird gespeichert.

Was „elsässisch“ tatsächlich heißt

Drei verschiedene Dinge, die regelmäßig vermengt werden.

Viele Angebote nennen sich souverän, weil das Unternehmen französisch ist — während die Inferenz bei einem amerikanischen Hyperscaler läuft. Die drei Fragen stellen sich getrennt, und wir beantworten sie getrennt.

Die Maschine

Gerechnet wird hier

Das Modell wird auf physischer Hardware in der 6 rue du Sommerberg in den Speicher geladen und ausgeführt. Ihre Anfragen überqueren keine Grenze, weil sie das Gebäude nicht verlassen.

Der Betreiber

Die Hände sind hier

Wir racken, versorgen, überwachen und starten neu. Nichts ist an einen Betreiber vergeben, dessen Namen Sie nicht kennen, und Ihr Ansprechpartner ist keine Autostunde entfernt.

Das Recht

Der Vertrag ist europäisch

Auftragsverarbeitungsvertrag nach DSGVO, französisches Recht, französischer Gerichtsstand. Kein extraterritoriales Recht wie der Cloud Act legt sich darüber.

Für wen das gedacht ist

Wenn der Text selbst das Geheimnis ist.

Für eine Stellenanzeige lohnt lokale KI nicht. Sie lohnt sehr wohl, sobald der bearbeitete Stoff seiner Natur nach vertraulich ist oder seine Weitergabe an Dritte berufsrechtliche, vertragliche oder regulatorische Fragen aufwirft.

Rechts- und Steuerberufe

Berufsgeheimnis lässt sich nicht delegieren

Eine Akte zusammenfassen, Vertragsfassungen vergleichen, eine Chronologie erstellen: unmittelbar nützliche Arbeit an Unterlagen, die ein Anwalt oder Steuerberater nicht ohne Weiteres an einen Drittdienst gibt.

Gesundheit und Pflege

Gesundheitsdaten, also ein eigenes Regime

Berichte, Arztbriefe, Transkriptionen. Sobald Gesundheitsdaten im Spiel sind, gelten für Hosting und Übermittlung strenge Regeln: Eine dedizierte Maschine vor Ort erleichtert den Nachweis erheblich.

Industrie und Ingenieurbüros

Know-how verschickt man nicht

Fertigungsanweisungen, Prüfberichte, technische Dokumentation, interner Code. Genau diese Texte machen den Wettbewerbsvorsprung aus — und genau bei ihnen zögert man am meisten, sie in ein öffentliches Chatfenster zu kopieren.

Öffentliche Hand

Ein Anspruch auf gutes Beispiel

Beschlüsse, Bürgerschreiben, Vergabeunterlagen. Öffentliche Auftraggeber prüfen den Ort der Verarbeitung genau, und eine regionale Infrastruktur lässt sich im Gremium leichter begründen als ein fernes Rahmenabkommen.

Softwarehäuser und Studios

Kosten, die aufhören zu schwanken

Bei hohem Volumen wird die Abrechnung nach Token unberechenbar. Eine dedizierte Maschine hat einen festen Monatspreis, ob Sie sie zehnmal oder zehntausendmal am Tag befragen.

Wen das nicht weiterbringt

Und wir sagen es Ihnen

Wenn Sie die stärksten Modelle des Marktes brauchen, sehr langes Schlussfolgern oder eine massive, unregelmäßige Last, bleibt eine öffentliche API das richtige Werkzeug. Lieber verlieren wir eine Vermietung, als Ihnen eine Maschine hinzustellen, die enttäuscht.

Wie das eingerichtet wird

Vier Schritte, ohne Hardware auf gut Glück zu kaufen.

01

Der Anwendungsfall

Was Sie tun wollen, auf welchen Dokumenten, für wie viele Personen gleichzeitig. Dieses Gespräch bestimmt die Größe des Modells und damit die Maschine — nie umgekehrt.

Erstes Gespräch, unverbindlich
02

Der Test

Wir lassen das vorgesehene Modell auf Ihren eigenen Dokumenten laufen, und Sie urteilen anhand Ihrer Texte statt anhand einer von uns gewählten Vorführung. Dabei zeigt sich auch, ob ein kleineres Modell genügt.

Über einige Tage
03

Die Maschine

Dedizierter Mac, GPU-Server oder Jetson-Modul, je nach Ergebnis des Tests. Sie wird bestellt, im Technikraum eingebaut, und Sie erhalten Root-Zugang und eine feste IP-Adresse.

Innerhalb von sieben bis fünfzehn Tagen
04

Die Anbindung

Das Modell wird Ihren Anwendungen über eine marktübliche Schnittstelle bereitgestellt: Was bereits mit einer öffentlichen API spricht, spricht mit Ihrer Maschine, sobald eine Adresse geändert ist. Überwachung und Sicherungen inbegriffen.

Danach monatlich, 30 Tage Kündigungsfrist

Worauf das läuft

Der Speicher entscheidet über alles.

Welche Modellgröße möglich ist, hängt zuerst vom verfügbaren Speicher ab, die Geschwindigkeit von dessen Bandbreite. Dies sind die Größenordnungen, mit denen wir beraten — und wir rechnen mit Ihren Zahlen nach.

Mac mini 16 GB
Ein quantisiertes Modell von rund 8 Milliarden Parametern. Interner Assistent für ein kleines Team, einige gleichzeitige Anfragen, etwa zehn Watt im Leerlauf.
Mac mini 32 GB
Bis zu rund fünfzehn Milliarden Parameter, oder dasselbe Modell mit deutlich mehr Kontext: ganze Dokumente statt Auszüge.
Mac Studio 64 bis 256 GB
Die großen offenen Modelle, ohne Grafikkarten zu vervielfachen. Apples vereinheitlichter Speicher ist hier ein entscheidender Vorteil, bei einer Leistungsaufnahme weit unter der eines GPU-Servers.
NVIDIA-RTX-GPU-Server
Wenn mehrere Dutzend Personen das Modell gleichzeitig befragen oder es auf Ihren Daten nachtrainiert werden muss. Vollständiges CUDA-Ökosystem: vLLM, Ollama, Bildgenerierung, Transkription.
NVIDIA-Jetson-Modul
Inferenz im Dauerbetrieb bei einigen Dutzend Watt: Stromanalyse, Sensorik, kleine Spezialmodelle. Die sparsamste Lösung, wenn Durchsatz nicht der Punkt ist.
Modelle
Offene Modelle, auf der Maschine ausgeführt: die Familien Qwen, Gemma, Mistral und Llama. Wir trainieren nichts auf Ihren Daten, und niemand sieht sie.

Die Preise der dedizierten Macs stehen auf der Hosting-Seite. Preise für GPU-Server und Jetson-Module nennen wir innerhalb von 48 Stunden: Sie hängen vom Anschaffungspreis der Hardware zum Bestellzeitpunkt und vom tatsächlichen Stromverbrauch ab.

Was wir Ihnen nicht erzählen werden

Drei verbreitete Annahmen, die vor der Unterschrift geklärt gehören.

Zum Preis

Es ist keine Ersparnis

Bei geringem Volumen kostet eine dauerhaft eingeschaltete Maschine mehr Strom, als eine maßvolle API-Nutzung an Token kostet. Der Nutzen liegt anderswo: in der Vertraulichkeit und in Kosten, die bei wachsendem Volumen aufhören zu schwanken.

Zur Leistung

Es ist nicht das beste Modell der Welt

Die offenen Modelle, die auf eine Unternehmensmaschine passen, sind gut, bei klar umrissenen Aufgaben teils ausgezeichnet — zusammenfassen, extrahieren, umformulieren, klassifizieren. Beim langen, schweren Schlussfolgern behalten die großen proprietären Modelle einen Vorsprung.

Zur Solarenergie

Es ist nur ein Anteil

Die Photovoltaikanlage auf dem Dach deckt einen Teil des Tagesverbrauchs. Eine Maschine, die Tag und Nacht läuft, verbraucht deutlich mehr. Den tatsächlichen Deckungsgrad nennen wir jedem, der danach fragt.

Häufige Fragen

Stellen Sie sie auch dem Assistenten — er hat dieselben Vorgaben.

Läuft der Assistent dieser Website bereits auf einer Maschine im Elsass?
Noch nicht, und es steht oben ohne Umschweife. Er nutzt derzeit die Programmierschnittstelle eines Modellanbieters; der Wechsel ist zur Inbetriebnahme des Hostings im November 2026 vorgesehen. Die Schnittstelle spricht bereits zuerst unsere Maschine an, sobald sie hinterlegt ist, und jede von dort stammende Antwort wird auf dem Bildschirm gekennzeichnet. Sie werden den Wechsel selbst bemerken, ganz ohne Ankündigung von uns.
Ist ein lokal gehostetes Modell günstiger als eine API?
Nein, bei geringem Volumen nicht, und das sagen wir lieber gleich. Eine dauerhaft laufende Maschine zieht jeden Tag Strom, ob man sie befragt oder nicht; einige hundert Fragen im Monat über eine öffentliche API kosten weniger als ein Kaffee. Bei hohem Volumen dreht sich die Rechnung um — oder dann, wenn sich der Preis dafür, dass Ihre Daten zu Dritten gehen, gar nicht beziffern lässt: dort fällt die Entscheidung meistens.
Welche Modelle lassen sich betreiben?
Offene Modelle, auf der Maschine heruntergeladen und ausgeführt: die Familien Qwen, Gemma, Mistral und Llama, quantisiert, damit sie in den Speicher passen. Die Wahl trifft man während des Tests anhand Ihrer Dokumente. Wir schreiben kein Modell vor: Es ist Ihre Maschine, und Sie können wechseln.
Werden meine Daten zum Training verwendet?
Nein. Ein Modell, das auf Ihrer Maschine läuft, sendet nichts an seinen Herausgeber zurück: Die Gewichte werden einmal heruntergeladen, danach arbeitet die Maschine, ohne etwas abzugeben. Wir trainieren und optimieren kein Modell auf Ihren Daten, es sei denn, Sie beauftragen uns ausdrücklich damit.
Wie sprechen meine Anwendungen mit dem Modell?
Über eine Schnittstelle, die dem Marktstandard entspricht. Praktisch heißt das: Ein Werkzeug, das bereits eine öffentliche API ansprechen kann, spricht Ihre Maschine an, sobald Adresse und Schlüssel geändert sind. Wir stellen den Dienst verschlüsselt, gefiltert und mit eigener Authentifizierung bereit — niemals die Verwaltungsschnittstelle der Laufzeitumgebung, die im Internet nichts zu suchen hat.
Und wenn die Maschine ausfällt?
Wie bei jedem Hosting bei uns: Eingriff innerhalb von vier Arbeitsstunden, Wiederinbetriebnahme noch am selben Tag bei einem Hardwaredefekt, mit Ersatzmaterial vor Ort. Muss Ihre Anwendung unter allen Umständen antworten, richten wir ihr für die Dauer der Störung einen Rückfall auf eine externe API ein — genau das tut der Assistent dieser Website.
Kann man die Maschine besichtigen?
Der Raum ist für die Öffentlichkeit geschlossen, und wir führen keine Besichtigungen durch. Arbeiten an Ihrer Hardware führen unsere Techniker auf Ihre schriftliche Anforderung hin aus. Alles zu Gebäude, Stromversorgung und Anbindung ist auf der Hosting-Seite ausführlich beschrieben.
Braucht es vorher eine Beratung, oder kann man direkt mieten?
Sie können direkt mieten, wenn Sie wissen, was Sie betreiben wollen. Ist der Anwendungsfall noch zu bestimmen — was häufig vorkommt — ist das die Aufgabe von RB2S Beratung: Rahmensetzung, Modellwahl, Governance und KI-Verordnung. Beides wird getrennt beauftragt, und die Beratung ist keine Bedingung für die Miete.

Erstes Gespräch

Sagen Sie uns, was die Maschine lesen soll.

Wir sagen Ihnen, welches Modell dafür genügt, welche Maschine es braucht, und ob eine öffentliche API Ihnen besser dient. Antwort binnen vierundzwanzig Arbeitsstunden, erstes Gespräch unverbindlich.

contact@rb2s.com Antwort binnen 24 Arbeitsstunden