Serveur d'intelligence artificielle locale installé dans les bureaux d'une entreprise

Votre IA locale.
Vos données.
Votre infrastructure.

Vos équipes utilisent déjà l'IA. Mais savez-vous où partent vos données ? Nous installons votre assistant IA directement dans vos locaux : zéro cloud, zéro donnée qui sort, zéro verrou éditeur.

Parlons de votre projet

Vous utilisez l'IA. Mais à quel prix ?

Vos équipes s'y sont mises d'elles-mêmes, souvent sans que personne ne l'ait décidé. Le coût réel ne tient pas sur la facture.

Vos données partent à l'étranger

Chaque question posée à ChatGPT transite sur des serveurs hors de France. Contrats, données clients, stratégie interne : tout y passe, sans que vous le contrôliez.

Des coûts qui s'envolent

Abonnements mensuels, quotas dépassés, fonctionnalités bridées. La facture grossit sans visibilité sur ce que vous paierez demain.

Une dépendance qui vous fragilise

Un changement de tarif, une panne, une décision unilatérale : l'outil sur lequel vos équipes comptent disparaît du jour au lendemain.

L'IA qui reste chez vous.

Nous installons des assistants IA directement dans vos locaux. Vos données ne quittent jamais vos murs : aucun transfert hors UE à justifier, aucun sous-traitant cloud à encadrer, aucune dépendance à un grand fournisseur.

Le matériel est le vôtre. Vous le commandez directement auprès du constructeur, vous l'achetez une fois, il vous appartient.

Nous gérons tout, de l'installation à la maintenance. Vous vous concentrez sur votre métier.

  • Aucune donnée hors de vos locaux
  • Aucun transfert hors UE à documenter
  • Le serveur vous appartient, aucun abonnement par utilisateur
  • Disponible 24/7, même sans internet
Technicien déployant une infrastructure IA locale dans les locaux d'une entreprise

Ce que vos équipes en font

Quatre façons dont l'IA se glisse dans une journée de travail. Tout tourne sur votre serveur, dans vos locaux : ni la question, ni le document, ni la réponse ne partent chez un éditeur.

Interroger vos propres documents

Une question posée, une réponse construite sur vos contrats, vos procédures et vos comptes rendus, avec la source citée sous chaque affirmation. Ce qui dormait dans un dossier partagé redevient consultable par tout le monde.

Open WebUI
Un assistant IA répondant à une question de dimensionnement, chaque affirmation renvoyant au document interne qui la justifie

Automatiser ce que personne n'aime faire

Trier des courriels, extraire les lignes d'une facture, préremplir une fiche, prévenir la bonne personne. Les enchaînements se dessinent à la souris et se branchent sur ce que vous utilisez déjà, messagerie, ERP ou logiciel de gestion.

n8n
Un enchaînement d'automatisation reliant un dossier de fichiers, une base de données et les collections documentaires de l'assistant

Travailler directement dans vos fichiers

Résumer un document, en tirer un compte rendu, le traduire, sans quitter l'endroit où il est rangé. L'assistant vient au fichier plutôt que l'inverse, et le fichier ne bouge pas de votre serveur.

Nextcloud
Un espace de fichiers où l'assistant résume un document sans que celui-ci quitte le serveur

Épauler vos développeurs

Lire un dépôt, proposer un correctif, écrire la documentation. Pour les équipes qui produisent du code, l'assistant se pilote depuis le terminal et s'appuie sur le même serveur que le reste. Le code source ne sort jamais du réseau.

Opencode
Un assistant de code en terminal travaillant sur un fichier source, servi par le modèle local

Ce qu'il y a dans la boîte

Aucune boîte noire, aucun logiciel maison. Votre serveur tourne sur des composants open source standards. Vous possédez le matériel, et vous n'êtes verrouillé à aucun éditeur, pas même à nous.

Le moteur

N'importe quel modèle open-weight (Gemma, Qwen, Llama, Mistral, DeepSeek...), servi par vLLM et exécuté entièrement sur votre matériel. Rien ne sort de chez vous.

Vos documents, vos outils

Une interface de discussion (Open WebUI), la recherche dans vos propres documents (RAG) et l'automatisation de vos tâches (n8n), connectées à votre système.

Un socle robuste

Ubuntu et Kubernetes pour la fiabilité, la supervision et les mises à jour. Le même socle éprouvé, du plus petit au plus grand serveur.

vLLM, Open WebUI, LMCache, n8n et Kubernetes sont les standards du marché pour l'IA locale et le RAG. Nous les assemblons et les maintenons pour vous.

  • NVIDIA
  • Ubuntu
  • Kubernetes
  • vLLM
  • LMCache
  • Open WebUI
  • n8n
  • Opencode

Une configuration pour chaque taille

Même stack, mêmes fonctionnalités, même niveau de service sur les quatre configurations. Le serveur est dimensionné à vos usages lors de l'audit, puis commandé et payé directement par vous auprès du constructeur : nous facturons la prestation, jamais le matériel.

Jusqu'à 10 utilisateurs

TPE

Déploiement
2 000 € HT
Maintenance
250 € HT/mois
Budget matériel
environ 8 000 € HT
Amorti en
environ 16 mois*
Jusqu'à 20 utilisateurs

PME

Déploiement
2 500 € HT
Maintenance
350 € HT/mois
Budget matériel
environ 14 500 € HT
Amorti en
environ 12 mois*
Jusqu'à 50 utilisateurs

PME+

Déploiement
3 500 € HT
Maintenance
450 € HT/mois
Budget matériel
environ 19 000 € HT
Amorti en
environ 6 mois*
Plus de 50 utilisateurs

ETI

Déploiement
5 000 € HT
Maintenance
750 € HT/mois
Budget matériel
environ 27 200 € HT
Amorti en
environ 4 mois*

Ce sont des forfaits par entreprise, jamais des prix par utilisateur. Dix personnes ou cent, la mensualité ne change pas.

Au-delà de 100 utilisateurs, on reste en ETI : l'infrastructure passe alors en baie, et la machine comme son budget se précisent à l'audit.

* Comment l'amortissement est calculé. On compare au coût d'un abonnement IA haut de gamme à 85,83 € HT par utilisateur et par mois, pour le même nombre d'utilisateurs, puis on divise l'investissement de départ, matériel et déploiement, par l'économie mensuelle une fois la maintenance déduite. Hors taxes des deux côtés. Un abonnement d'entrée de gamme allongerait ce délai, un parc plus large le raccourcirait. Ensuite, un utilisateur de plus ne change rien à votre facture mensuelle. Voir le calcul détaillé par taille d'entreprise

Inclus dans les quatre configurations

  • Assistant IA configuré sur vos propres documents
  • Stack open source complète : vLLM, Open WebUI, n8n, Kubernetes
  • Installation sur site, comptes et groupes, import initial de vos documents
  • Formation de vos utilisateurs à la prise en main
  • Mises à jour de la stack et des modèles, supervision, sauvegarde, rapport mensuel
  • Garantie constructeur 3, 4 ou 5 ans à votre choix, intervention sur site à J+1

Rien n'est figé. À partir de la configuration PME, le châssis accepte plusieurs cartes graphiques et se monte en baie. Si vos usages le demandent, nous doublons la carte dès l'installation ; le processeur, la mémoire, le stockage et le réseau se dimensionnent de la même façon. Vous pouvez aussi ajouter la carte plus tard, dans le serveur que vous avez déjà, sans changer de machine.

La maintenance est engagée sur 12 mois. Les frais de déplacement sont facturés en sus.

Notre premier client, c'est nous

Nous ne déployons pas une technologie que nous ne pratiquons pas. Toute l'activité de Sover.tech tourne sur l'infrastructure d'IA locale que nous installons chez vous : ni nos questions, ni nos fichiers, ni les réponses ne quittent notre réseau.

Grafana
Tableau de bord de supervision de notre serveur d'IA : requêtes en cours et en attente, cache, délai avant le premier mot, préemptions, réponses tronquées, et courbes de latence
Notre propre serveur, vu depuis sa supervision : requêtes en cours, cache, délai avant le premier mot, attente en file et latence de bout en bout. C'est ce même relevé qui nourrit le rapport mensuel que reçoivent nos clients.

Notre R&D technique

Développement, débogage, documentation de nos infrastructures : nous nous appuyons chaque jour sur notre IA locale, sans dépendre d'un service tiers.

Notre gestion commerciale

Devis, fiches clients, suivi d'activité : notre IA traite nos documents internes en local. Aucune donnée ne quitte nos serveurs.

Nos analyses juridiques

Lecture de contrats et de documents réglementaires sur des données confidentielles, entièrement en local, comme nous le proposons à nos clients.

Le tout supervisé en production, 24 h/24, sur l'infrastructure que nous installons et maintenons chez vous. Lucie, l'assistante en bas à droite, tourne elle aussi sur notre serveur d'IA local : en lui écrivant, vous testez directement la technologie que nous déployons.

Son périmètre est volontairement limité à Sover.tech. Une IA installée chez vous est bien plus étendue, calibrée pour vos données, vos outils et vos usages métier.

Derrière Sover.tech

Damien Dagorn, fondateur de Sover.tech, ingénieur infrastructure

Je suis Damien, ingénieur infrastructure depuis 15 ans. J'ai déployé et opéré des plateformes cloud et on-premise à haute disponibilité pour B&B Hotels, BigMat et Evaneos : serveurs, réseaux, stockage, sécurité.

Déployer une infrastructure robuste chez un client, l'intégrer à ses outils, la monitorer et la maintenir dans le temps : c'est mon quotidien depuis 15 ans. Pas de la théorie. Des systèmes en production, en conditions réelles.

Au contact direct des dernières avancées en IA, j'ai mesuré les limites des grands providers : des pannes qui paralysent des équipes entières, des données confidentielles qui transitent sur des serveurs tiers, et des coûts d'abonnement qui s'envolent sans contrôle.

Une infrastructure IA locale règle tout ça. C'est ce que je construis pour vous.

Questions fréquentes

Tout ce qu'il faut savoir avant de se lancer.

L'IA locale est-elle aussi performante que ChatGPT ?

Oui, pour les usages du quotidien. Rédaction, résumé, analyse de documents, aide à la préparation de réunions : les modèles que nous déployons donnent d'excellents résultats, confirmés par nos tests sur des cas PME réels. Et si vos besoins évoluent vers des tâches plus complexes, notre solution n'est pas figée : vous pouvez choisir et changer de modèle à tout moment parmi les modèles open-source disponibles, selon les capacités de votre matériel. Contrairement à un abonnement cloud, vous n'êtes pas limités à l'offre d'un seul fournisseur.

Combien ça coûte ?

Nous facturons uniquement la prestation. Le déploiement va de 2 000 € HT pour la configuration TPE à 5 000 € HT pour la configuration ETI. La maintenance mensuelle va de 250 à 750 € HT par mois selon la configuration, avec un engagement de 12 mois. Le serveur, lui, vous le commandez et le payez directement auprès du constructeur : nous ne le facturons pas. Comptez un budget matériel indicatif de 8 000 € HT pour la configuration TPE à 27 200 € HT pour la configuration ETI. L'audit préalable est gratuit, et c'est lui qui fixe le chiffrage exact.

Combien de temps prend l'installation ?

Une installation standard se déroule sur site en quelques jours (à partir de 3 jours), selon la configuration retenue et votre infrastructure existante. Pour les intégrations métier plus complexes (connexion à votre ERP, automatisation de tâches récurrentes), comptez des jours supplémentaires selon la portée du projet.

Peut-on connecter l'IA à nos outils existants ?

Oui. Notre solution inclut un outil d'automatisation compatible avec plusieurs centaines d'applications : messagerie (Teams, Gmail), CRM, ERP, stockage de fichiers, Nextcloud que nous utilisons nous-mêmes. La mise en place de ces intégrations fait l'objet d'une prestation dédiée selon votre périmètre. L'IA expose également une API compatible avec le standard OpenAI, ce qui permet une intégration directe avec la majorité des outils qui utilisent ce standard.

Qu'est-ce que ça change pour notre conformité RGPD ?

Avec une IA cloud comme ChatGPT, vos données transitent sur des serveurs étrangers, ce qui implique des transferts hors UE à justifier et à documenter. Avec une IA locale, aucune donnée ne quitte votre infrastructure. Vous réduisez votre dépendance aux sous-traitants cloud situés hors UE. Sover.tech intervient en qualité de sous-traitant RGPD dans un cadre contractualisé, sans accès aux contenus de vos traitements dans le cadre normal de la maintenance.

Que se passe-t-il en cas de panne ?

Notre contrat de maintenance inclut la supervision des services, les mises à jour préventives des modèles et des logiciels, la sauvegarde et le traitement des incidents. Le délai de prise en charge dépend de la configuration : 4 h ouvrées en PME+, 2 h ouvrées en ETI, support en jours ouvrés sur les configurations TPE et PME. Le matériel est couvert par la garantie constructeur, sur 3, 4 ou 5 ans selon la durée que vous retenez à la commande, avec intervention sur site à J+1.

Votre infrastructure est-elle prête pour l'IA locale ?

On fait le point ensemble sur vos usages IA actuels, vos contraintes techniques et ce qu'une solution locale changerait concrètement pour votre équipe.

  • Sur site ou en visio, partout en France
  • Gratuit, sans engagement, sans jargon technique
Demander un audit gratuit

Vous êtes prestataire informatique ?

Vos clients vous demandent de l'IA. Vous gardez la relation, le contrat et la marge, nous prenons le dimensionnement et le déploiement. Nous ne contactons jamais votre client : c'est écrit au contrat cadre.

Voir le programme partenaire

Vous avez un projet ?

On vous répond sous 48 h, sans engagement.

contact@sover.tech 06 46 61 69 58