Aller au contenu principal
INFRASOFT

Services

IA privée sur site

Nous installons et exploitons une IA générative directement dans vos locaux : des modèles open-weight qui tournent sur des serveurs GPU et des postes de travail IA que nous vous fournissons en location, connectés à vos documents et à vos systèmes métier. Vos données ne quittent jamais votre réseau, et une seule équipe responsable exploite l’ensemble.

01

Ce que nous prenons en charge

Faire tourner une IA entre vos murs est un travail d’infrastructure et d’intégration, pas un abonnement. Voici le terrain que nous couvrons.

  • 01

    Matériel en location

    Serveurs GPU d’inférence et postes de travail IA fournis en location (Hardware-as-a-Service) : dimensionnés pour vos cas d’usage, installés dans vos locaux, maintenus, remplacés et renouvelés par nos soins. Aucun investissement matériel initial.

  • 02

    Déploiement de modèles privés

    Nous sélectionnons, déployons et servons des grands modèles de langage (LLM) open-weight sur votre propre matériel, derrière votre pare-feu. Les modèles sont versionnés, évalués sur vos tâches et mis à jour selon un calendrier maîtrisé.

  • 03

    Assistants sur vos documents (RAG)

    Des assistants internes qui répondent à partir de vos propres documents grâce à la génération augmentée par récupération (RAG), avec citation des sources et respect des droits d’accès, document par document.

  • 04

    Intégration métier

    Connecteurs vers votre ERP, votre CRM et votre GED, et des étapes d’IA intégrées à vos processus existants : extraction de documents, classification, aide à la rédaction et synthèse.

  • 05

    Équipe technique sur site

    Des ingénieurs IA et MLOps interviennent dans vos locaux pour l’installation, l’intégration et la formation des utilisateurs, puis reviennent lors d’interventions sur site planifiées. Entre deux visites, la plateforme est exploitée à distance sous SLA.

  • 06

    Sécurité & contrôle d’accès

    Segment réseau isolé, authentification unique et accès par rôles, chiffrement au repos et journalisation des usages. Personne en dehors de votre organisation ne peut interroger les modèles ni lire les requêtes.

  • 07

    Documentation RGPD & AI Act

    Nous documentons les flux de données, les modèles utilisés et leurs finalités, pour vous fournir la matière nécessaire à vos obligations au titre du RGPD et du règlement européen sur l’intelligence artificielle (AI Act).

02

Déroulement d’une mission

Chaque mission d’IA sur site suit les quatre mêmes phases, du premier cas d’usage à une plateforme utilisée au quotidien.

  1. 01

    Cadrage & audit

    Nous recensons les cas d’usage possibles, les sources de données, les volumes, les contraintes réseau et l’espace disponible dans vos locaux. Vous recevez un état des lieux écrit, avec un cas d’usage prioritaire et un dimensionnement du matériel.

  2. 02

    Proposition & conception des SLA

    Nous proposons la configuration matérielle, les modèles, les intégrations et un pilote doté d’un objectif mesurable, avec le loyer mensuel et les niveaux de service P1–P4 de l’exploitation. Le périmètre et les responsabilités sont contractuels, pas implicites.

  3. 03

    Construction / Transition

    Nos ingénieurs installent les serveurs et les postes de travail sur site, déploient les modèles, connectent vos sources de données et forment vos utilisateurs. Le pilote est mesuré au regard de son objectif avant tout déploiement à plus grande échelle.

  4. 04

    Exploitation & amélioration continue

    Nous exploitons la plateforme sous SLA : supervision, mises à jour des modèles et correctifs de sécurité, maintenance du matériel et rapport mensuel d’usage. Les nouveaux cas d’usage sont ajoutés à partir d’un backlog partagé.

03

Technologies que nous maîtrisons

Nous nous appuyons sur des composants ouverts et éprouvés, qui fonctionnent entièrement sur votre matériel — sans dépendance à un service d’IA externe.

Modèles & inférence

  • vLLM
  • Ollama
  • Llama
  • Mistral
  • Qwen

Recherche & intégration

  • LangChain
  • LlamaIndex
  • Open WebUI
  • n8n
  • Docker
  • Kubernetes

Données & matériel

  • Qdrant
  • pgvector
  • NVIDIA CUDA
  • Proxmox
  • Grafana / Prometheus
  • Ubuntu LTS
04

Ce que vous obtenez

Le résultat : une IA que vos équipes utilisent au quotidien, sur une infrastructure que vous maîtrisez, pour un coût mensuel prévisible.

01

Un loyer mensuel prévisible

Matériel, logiciels, intégration et exploitation réunis dans un seul loyer mensuel — sans investissement initial ni facturation à la requête qui augmente avec l’usage.

02

Des données qui restent chez vous

Documents, requêtes et réponses restent sur votre réseau. Vos fichiers confidentiels peuvent être utilisés avec l’IA sans être envoyés à un prestataire externe.

03

Du temps gagné sur le travail documentaire

Recherche, synthèse, extraction et rédaction passent de plusieurs heures à quelques minutes, sur les cas d’usage mesurés pendant le pilote.

04

Une conformité documentée

Modèles, flux de données, droits d’accès et finalités sont documentés et tenus à jour : les questions liées au RGPD et à l’AI Act reçoivent des réponses étayées.

05

Questions fréquentes

01Nos données quittent-elles nos locaux ?

Non. Les modèles tournent sur des serveurs installés dans vos locaux, et documents, requêtes et réponses restent sur votre réseau. Notre accès à distance pour l’exploitation se limite à la supervision et à la maintenance ; il est défini au contrat et journalisé.

02Devons-nous acheter les serveurs ?

Non. Serveurs et postes de travail IA sont fournis en location, dans un loyer mensuel qui couvre aussi la maintenance, le remplacement et le renouvellement. Le prix est établi sur devis après l’audit de cadrage, une fois le matériel dimensionné.

03Quels modèles utilisez-vous ?

Des modèles open-weight dont la licence permet un usage sur site, choisis et évalués sur vos propres tâches et dans vos langues. Nous n’avons aucun intérêt de revendeur : la recommandation découle de votre cas d’usage, de votre budget matériel et de vos exigences de qualité.

04Qui exploite la plateforme une fois installée ?

Nous-mêmes, dans le cadre de notre offre Infogérance & maintenance (SLA) : supervision, quatre niveaux de sévérité contractuels (P1–P4) avec délais de réponse définis, mises à jour des modèles et correctifs de sécurité, maintenance du matériel et interventions sur site planifiées. Matériel, modèles et exploitation relèvent d’un seul partenaire responsable.

contact@infrasoftdev.com

Parlons de vos opérations techniques

Un appel d’introduction de 30 minutes avec un ingénieur senior — sans script commercial, sans engagement. Nous écoutons, nous posons des questions, et nous vous disons honnêtement si nous pouvons vous aider.