RB2SHébergement · IT · Conseil

Scherwiller, près de Sélestat — le modèle tourne où vous êtes

Une IA alsacienne : le modèle tourne dans le vignoble, pas de l'autre côté de l'Atlantique.

Pour beaucoup d'organisations, la question n'est pas de savoir quel modèle est le plus brillant, mais où passent les phrases qu'on lui confie. Un dossier de plaidoirie, un compte rendu opératoire, un plan de charge industriel, une délibération : ces textes-là n'ont rien à faire chez un tiers. Nous installons un modèle de langage ouvert sur une machine qui vous est dédiée, dans notre salle technique du Centre Alsace, et nous l'exploitons.

Commençons par la franchise

L'assistant de ce site ne tourne pas encore en Alsace. Il le dira lui-même le jour où ce sera le cas.

Nous vendrions mal une IA souveraine en mentant sur la nôtre. L'assistant que vous pouvez essayer un peu plus bas sur cette page passe aujourd'hui par l'interface de programmation d'un fournisseur de modèle : vos questions lui sont transmises. La passerelle est déjà écrite pour interroger d'abord notre propre machine et ne retomber sur l'API qu'en cas d'indisponibilité — il ne manque que la machine, attendue pour la mise en service de l'hébergement.

Aujourd'hui
L'assistant de rb2s.com interroge une interface de programmation externe. Aucune question n'est conservée sur nos serveurs ; seuls des compteurs agrégés sont tenus.
À la mise en service
Un Mac dédié de notre salle technique exécute un modèle ouvert. L'API ne sert plus que de filet si la machine est arrêtée.
Ce que vous voyez
Chaque réponse produite par notre machine porte la mention « Réponse produite par un modèle hébergé dans notre salle technique ». Son absence signifie qu'elle vient de l'API. Vous n'avez pas à nous croire sur parole.
Pour vos machines
Ce que nous décrivons ici n'attend rien : une machine dédiée que nous installons pour vous exécute votre modèle sur place, dès sa mise en service.

Essayez, maintenant

Parlez-lui. C'est le même assistant, avec les mêmes consignes.

Il répond à partir des informations publiées sur ce site, il ne prend aucun engagement au nom de RB2S, et il vous dit quand il ne sait pas — y compris sur la machine qui le fait tourner en ce moment. Aucune inscription, rien n'est conservé.

Ce que veut dire « alsacienne »

Trois choses différentes, souvent confondues.

Beaucoup d'offres se disent souveraines parce que leur société est française, tout en faisant tourner l'inférence chez un hyperscaler américain. Les trois questions se posent séparément, et nous y répondons séparément.

La machine

Le calcul a lieu ici

Le modèle est chargé en mémoire et exécuté sur une machine physique installée au 6 rue du Sommerberg. Vos requêtes ne franchissent aucune frontière, parce qu'elles ne quittent pas le bâtiment.

L'exploitant

Les mains sont ici

C'est nous qui rackons, alimentons, surveillons et redémarrons. Rien n'est sous-traité à un opérateur dont vous ne connaîtriez pas le nom, et vous avez un interlocuteur à moins d'une heure de route.

Le droit

Le contrat est européen

Contrat de sous-traitance conforme au RGPD, droit français, juridiction française. Aucune loi extraterritoriale de type Cloud Act ne vient s'appliquer par-dessus.

À qui cela s'adresse

Quand le texte lui-même est le secret.

L'IA locale n'a pas d'intérêt pour rédiger une annonce d'emploi. Elle en a beaucoup dès lors que la matière traitée est confidentielle par nature, ou que son départ chez un tiers pose un problème déontologique, contractuel ou réglementaire.

Professions du droit et du chiffre

Le secret professionnel ne se délègue pas

Résumer un dossier, comparer des versions de contrat, préparer une chronologie : des usages immédiatement utiles, sur des pièces qu'un avocat ou un expert-comptable ne peut pas transmettre à un service tiers sans y regarder à deux fois.

Santé et médico-social

Des données de santé, donc un régime à part

Comptes rendus, courriers, transcriptions. Dès qu'il s'agit de données de santé, l'hébergement et les transferts obéissent à des règles strictes : une machine dédiée sur place simplifie considérablement la démonstration.

Industrie et bureaux d'études

Le savoir-faire ne s'envoie pas

Gammes de fabrication, rapports d'essais, documentation technique, code interne. Ce sont précisément les textes qui constituent l'avantage concurrentiel — et ceux qu'on hésite le plus à coller dans une fenêtre de discussion publique.

Collectivités et associations

Une exigence de bon exemple

Délibérations, courriers d'administrés, marchés publics. La commande publique regarde de près la localisation des traitements, et une infrastructure régionale est plus simple à justifier devant un conseil qu'un contrat cadre lointain.

Éditeurs et studios

Un coût qui cesse de varier

À fort volume, la facturation au jeton devient imprévisible. Une machine dédiée a un prix mensuel fixe, que vous l'interrogiez dix fois ou dix mille fois par jour.

Ceux pour qui ce n'est pas la réponse

Et nous vous le dirons

Si vous avez besoin des meilleurs modèles du marché, d'un raisonnement très long ou d'une charge massive et irrégulière, une API publique reste le bon outil. Nous préférons perdre une location que de vous installer une machine qui vous décevra.

Comment cela se met en place

Quatre étapes, sans matériel acheté à l'aveugle.

01

Le cas d'usage

Ce que vous voulez faire, sur quels documents, pour combien de personnes à la fois. C'est cette conversation qui détermine la taille du modèle, et donc la machine — jamais l'inverse.

Premier échange sans engagement
02

L'essai

Nous faisons tourner le modèle pressenti sur vos propres documents, et vous jugez sur vos textes, pas sur une démonstration choisie par nous. C'est aussi là qu'on découvre si un modèle plus petit suffit.

Sur quelques jours
03

La machine

Mac dédié, serveur GPU ou module Jetson selon le verdict de l'essai. Elle est commandée, installée dans la salle technique, et vous en avez l'accès root et l'adresse IP fixe.

Sous sept à quinze jours
04

Le raccordement

Le modèle est exposé à vos applications par une interface compatible avec celles du marché : ce qui parle déjà à une API publique parle à votre machine en changeant une adresse. Supervision et sauvegardes comprises.

Puis mensuel, préavis 30 jours

Sur quoi cela tourne

La mémoire décide de tout.

La taille du modèle que vous pouvez faire tourner dépend d'abord de la mémoire disponible, et sa vitesse de la bande passante de cette mémoire. Voici les ordres de grandeur que nous utilisons pour conseiller — et nous refaisons le calcul avec vos chiffres.

Mac mini 16 Go
Un modèle d'environ 8 milliards de paramètres quantifié. Assistant interne d'une petite équipe, quelques requêtes à la fois, une dizaine de watts au repos.
Mac mini 32 Go
Jusqu'à une quinzaine de milliards de paramètres, ou le même modèle avec beaucoup plus de contexte : des documents entiers plutôt que des extraits.
Mac Studio 64 à 256 Go
Les grands modèles ouverts, sans multiplier les cartes graphiques. La mémoire unifiée d'Apple est ici un avantage décisif, pour une consommation sans commune mesure avec un serveur GPU.
Serveur GPU NVIDIA RTX
Quand plusieurs dizaines de personnes interrogent le modèle en même temps, ou qu'il faut l'affiner sur vos données. Écosystème CUDA complet : vLLM, Ollama, génération d'images, transcription.
Module NVIDIA Jetson
L'inférence qui tourne en permanence à quelques dizaines de watts : analyse de flux, capteurs, petits modèles spécialisés. Le plus sobre quand le débit n'est pas l'enjeu.
Modèles
Des modèles ouverts, exécutés sur la machine : familles Qwen, Gemma, Mistral, Llama. Nous n'entraînons rien sur vos données et personne ne les voit.

Les tarifs des Mac dédiés figurent sur la page hébergement. Ceux des serveurs GPU et des modules Jetson sont communiqués sous 48 h : ils dépendent du prix d'acquisition du matériel au moment de la commande et de la consommation électrique réelle.

Ce que nous ne vous dirons pas

Trois idées reçues qu'il vaut mieux lever avant de signer.

Sur le prix

Ce n'est pas une économie

À faible volume, une machine allumée en permanence coûte plus cher en électricité qu'un usage modéré d'API ne coûte en jetons. L'intérêt est ailleurs : la confidentialité, et un coût qui cesse de varier quand le volume monte.

Sur la performance

Ce n'est pas le meilleur modèle du monde

Les modèles ouverts qu'on fait tenir sur une machine d'entreprise sont bons, parfois excellents sur des tâches cadrées — résumer, extraire, reformuler, classer. Sur le raisonnement long et difficile, les grands modèles propriétaires gardent une avance.

Sur le solaire

Ce n'est qu'une part

La toiture photovoltaïque couvre une part de la consommation en journée. Une machine qui tourne nuit et jour consomme bien au-delà. Nous communiquons le taux de couverture réel à qui le demande.

Questions fréquentes

Posez-les aussi à l'assistant, il a les mêmes consignes.

L'assistant de ce site tourne-t-il déjà sur une machine alsacienne ?
Pas encore, et c'est écrit plus haut sans détour. Il passe aujourd'hui par l'interface de programmation d'un fournisseur de modèle ; la bascule est prévue pour la mise en service de l'hébergement, en novembre 2026. La passerelle interroge déjà notre machine en premier lorsqu'elle est déclarée, et chaque réponse qui en vient est signalée à l'écran. Vous pourrez constater le changement vous-même, sans annonce de notre part.
Un modèle hébergé localement coûte-t-il moins cher qu'une API ?
Non, pas à faible volume, et nous préférons le dire tout de suite. Une machine qui tourne en continu consomme de l'électricité tous les jours, qu'on l'interroge ou non ; quelques centaines de questions par mois sur une API publique coûtent moins qu'un café. Le calcul s'inverse à fort volume, ou quand le coût du départ des données chez un tiers n'est pas chiffrable : c'est souvent là que se prend la décision.
Quels modèles peut-on faire tourner ?
Des modèles ouverts, téléchargés et exécutés sur la machine : les familles Qwen, Gemma, Mistral et Llama, en versions quantifiées pour tenir en mémoire. Le choix se fait sur vos documents pendant l'essai. Nous n'imposons pas un modèle : c'est une machine à vous, et vous pouvez en changer.
Mes données servent-elles à entraîner quoi que ce soit ?
Non. Un modèle exécuté sur votre machine ne renvoie rien à son éditeur : les poids sont téléchargés une fois, puis la machine fonctionne sans rien réémettre. Nous n'entraînons ni n'affinons aucun modèle sur vos données, sauf si vous nous le demandez explicitement dans le cadre d'une prestation.
Comment mes applications parlent-elles au modèle ?
Par une interface compatible avec celle qui s'est imposée sur le marché. Concrètement, un outil qui sait déjà interroger une API publique sait interroger votre machine en changeant l'adresse et la clé. Nous exposons le service en chiffré, filtré, avec une authentification dédiée — jamais l'interface d'administration du moteur, qui n'a rien à faire sur Internet.
Et si la machine tombe en panne ?
Comme pour tout hébergement chez nous : intervention en quatre heures ouvrées, remise en service le jour même en cas de panne matérielle, avec du matériel de remplacement disponible sur place. Si votre application doit répondre en toutes circonstances, nous pouvons la configurer pour basculer sur une API externe pendant l'incident — c'est exactement ce que fait l'assistant de ce site.
Peut-on venir voir la machine ?
La salle est fermée au public, et nous ne faisons pas de visite. Les interventions sur votre matériel sont réalisées par nos techniciens sur demande écrite de votre part. En revanche, tout ce qui concerne le bâtiment, l'alimentation et la connectivité est décrit en détail sur la page hébergement.
Faut-il un conseil avant, ou peut-on louer directement ?
Vous pouvez louer directement si vous savez ce que vous voulez faire tourner. Si le cas d'usage reste à définir — ce qui est fréquent — c'est le métier de RB2S Conseil : cadrage, choix des modèles, gouvernance et AI Act. Les deux se commandent séparément, et le conseil ne conditionne pas la location.

Premier échange

Dites-nous ce que vous voulez faire lire à la machine.

Nous vous dirons quel modèle y suffit, quelle machine il lui faut, et si une API publique ferait mieux l'affaire. Réponse sous vingt-quatre heures ouvrées, premier rendez-vous sans engagement.

contact@rb2s.com Réponse sous 24 heures ouvrées