Scherwiller bei Sélestat — das Modell läuft dort, wo Sie sind
Für viele Organisationen lautet die Frage nicht, welches Modell das klügste ist, sondern wohin die Sätze gehen, die man ihm anvertraut. Eine Prozessakte, ein Operationsbericht, ein industrieller Fertigungsplan, ein Gemeinderatsbeschluss — solche Texte haben bei Dritten nichts verloren. Wir richten ein offenes Sprachmodell auf einer Maschine ein, die Ihnen allein gehört, in unserem Technikraum im Centre Alsace, und wir betreiben sie.
Beginnen wir mit Offenheit
Wir würden souveräne KI schlecht verkaufen, wenn wir über unsere eigene die Unwahrheit sagten. Der Assistent, den Sie etwas weiter unten auf dieser Seite ausprobieren können, nutzt derzeit die Programmierschnittstelle eines Modellanbieters: Ihre Fragen werden dorthin übermittelt. Die Schnittstelle ist bereits so geschrieben, dass sie zuerst unsere eigene Maschine anspricht und nur bei deren Ausfall auf die API zurückfällt — es fehlt allein die Maschine, erwartet zur Inbetriebnahme des Hostings.
Probieren Sie es gleich aus
Er antwortet anhand der auf dieser Website veröffentlichten Angaben, geht keinerlei Verpflichtung im Namen von RB2S ein und sagt, wenn er etwas nicht weiß — auch über die Maschine, auf der er gerade läuft. Keine Anmeldung, nichts wird gespeichert.
Was „elsässisch“ tatsächlich heißt
Viele Angebote nennen sich souverän, weil das Unternehmen französisch ist — während die Inferenz bei einem amerikanischen Hyperscaler läuft. Die drei Fragen stellen sich getrennt, und wir beantworten sie getrennt.
Das Modell wird auf physischer Hardware in der 6 rue du Sommerberg in den Speicher geladen und ausgeführt. Ihre Anfragen überqueren keine Grenze, weil sie das Gebäude nicht verlassen.
Wir racken, versorgen, überwachen und starten neu. Nichts ist an einen Betreiber vergeben, dessen Namen Sie nicht kennen, und Ihr Ansprechpartner ist keine Autostunde entfernt.
Auftragsverarbeitungsvertrag nach DSGVO, französisches Recht, französischer Gerichtsstand. Kein extraterritoriales Recht wie der Cloud Act legt sich darüber.
Für wen das gedacht ist
Für eine Stellenanzeige lohnt lokale KI nicht. Sie lohnt sehr wohl, sobald der bearbeitete Stoff seiner Natur nach vertraulich ist oder seine Weitergabe an Dritte berufsrechtliche, vertragliche oder regulatorische Fragen aufwirft.
Eine Akte zusammenfassen, Vertragsfassungen vergleichen, eine Chronologie erstellen: unmittelbar nützliche Arbeit an Unterlagen, die ein Anwalt oder Steuerberater nicht ohne Weiteres an einen Drittdienst gibt.
Berichte, Arztbriefe, Transkriptionen. Sobald Gesundheitsdaten im Spiel sind, gelten für Hosting und Übermittlung strenge Regeln: Eine dedizierte Maschine vor Ort erleichtert den Nachweis erheblich.
Fertigungsanweisungen, Prüfberichte, technische Dokumentation, interner Code. Genau diese Texte machen den Wettbewerbsvorsprung aus — und genau bei ihnen zögert man am meisten, sie in ein öffentliches Chatfenster zu kopieren.
Beschlüsse, Bürgerschreiben, Vergabeunterlagen. Öffentliche Auftraggeber prüfen den Ort der Verarbeitung genau, und eine regionale Infrastruktur lässt sich im Gremium leichter begründen als ein fernes Rahmenabkommen.
Bei hohem Volumen wird die Abrechnung nach Token unberechenbar. Eine dedizierte Maschine hat einen festen Monatspreis, ob Sie sie zehnmal oder zehntausendmal am Tag befragen.
Wenn Sie die stärksten Modelle des Marktes brauchen, sehr langes Schlussfolgern oder eine massive, unregelmäßige Last, bleibt eine öffentliche API das richtige Werkzeug. Lieber verlieren wir eine Vermietung, als Ihnen eine Maschine hinzustellen, die enttäuscht.
Wie das eingerichtet wird
Was Sie tun wollen, auf welchen Dokumenten, für wie viele Personen gleichzeitig. Dieses Gespräch bestimmt die Größe des Modells und damit die Maschine — nie umgekehrt.
Erstes Gespräch, unverbindlichWir lassen das vorgesehene Modell auf Ihren eigenen Dokumenten laufen, und Sie urteilen anhand Ihrer Texte statt anhand einer von uns gewählten Vorführung. Dabei zeigt sich auch, ob ein kleineres Modell genügt.
Über einige TageDedizierter Mac, GPU-Server oder Jetson-Modul, je nach Ergebnis des Tests. Sie wird bestellt, im Technikraum eingebaut, und Sie erhalten Root-Zugang und eine feste IP-Adresse.
Innerhalb von sieben bis fünfzehn TagenDas Modell wird Ihren Anwendungen über eine marktübliche Schnittstelle bereitgestellt: Was bereits mit einer öffentlichen API spricht, spricht mit Ihrer Maschine, sobald eine Adresse geändert ist. Überwachung und Sicherungen inbegriffen.
Danach monatlich, 30 Tage KündigungsfristWorauf das läuft
Welche Modellgröße möglich ist, hängt zuerst vom verfügbaren Speicher ab, die Geschwindigkeit von dessen Bandbreite. Dies sind die Größenordnungen, mit denen wir beraten — und wir rechnen mit Ihren Zahlen nach.
Die Preise der dedizierten Macs stehen auf der Hosting-Seite. Preise für GPU-Server und Jetson-Module nennen wir innerhalb von 48 Stunden: Sie hängen vom Anschaffungspreis der Hardware zum Bestellzeitpunkt und vom tatsächlichen Stromverbrauch ab.
Was wir Ihnen nicht erzählen werden
Bei geringem Volumen kostet eine dauerhaft eingeschaltete Maschine mehr Strom, als eine maßvolle API-Nutzung an Token kostet. Der Nutzen liegt anderswo: in der Vertraulichkeit und in Kosten, die bei wachsendem Volumen aufhören zu schwanken.
Die offenen Modelle, die auf eine Unternehmensmaschine passen, sind gut, bei klar umrissenen Aufgaben teils ausgezeichnet — zusammenfassen, extrahieren, umformulieren, klassifizieren. Beim langen, schweren Schlussfolgern behalten die großen proprietären Modelle einen Vorsprung.
Die Photovoltaikanlage auf dem Dach deckt einen Teil des Tagesverbrauchs. Eine Maschine, die Tag und Nacht läuft, verbraucht deutlich mehr. Den tatsächlichen Deckungsgrad nennen wir jedem, der danach fragt.
Häufige Fragen
Erstes Gespräch
Wir sagen Ihnen, welches Modell dafür genügt, welche Maschine es braucht, und ob eine öffentliche API Ihnen besser dient. Antwort binnen vierundzwanzig Arbeitsstunden, erstes Gespräch unverbindlich.