Mistral installé chez vous. DulcAI on-prem complet.
Vos transcriptions, résumés et données ne quittent jamais votre réseau.
Vos transcriptions, vos résumés, vos données : tout reste sur votre infrastructure. Rien ne part vers un cloud externe.
Le modĂšle Mixtral 8x7B (ou Mistral Large sur demande) tourne sur votre serveur. Pas d'API tierce, pas de transit Internet.
RGPD, secret professionnel, secret défense : la donnée ne quitte pas votre réseau. Audit et certifications facilités.
Dimensionnée pour 400 utilisateurs B2B (20 à 40 sessions simultanées en pic). Configurations 50 / 100 / 200 utilisateurs sur devis.
Ce qui est inclus
Ordre de grandeur
Investissement initial
â 60 000 âŹHT
Matériel + installation + formation
Maintenance annuelle
â 9 000 âŹHT/an
SLA 8Ă5 jours ouvrĂ©s. 24Ă7 en option.
Tarif indicatif pour la configuration ci-contre. Devis personnalisé aprÚs analyse.
Aux organisations dont les donnĂ©es ne peuvent pas â ou ne doivent pas â passer par un cloud public.
Volume de réunions, nombre d'utilisateurs, contraintes réseau, exigences réglementaires.
Configuration matérielle dimensionnée, SLA, planning de déploiement.
Rack, mise en service, déploiement Mistral + DulcAI, intégration AD/SSO.
Une journée admin technique, une journée prise en main utilisateurs.
Monitoring distant, mises Ă jour modĂšles, support technique au contrat.
Oui. Le serveur n'effectue aucun appel sortant vers OpenAI, Anthropic ou un quelconque cloud public. Les seuls flux Internet sont les mises à jour Mistral et les notifications de monitoring (que vous pouvez désactiver).
La configuration 2Ă L40S supporte 20 Ă 40 sessions actives en pic, ce qui correspond Ă environ 400 utilisateurs nominaux (5 Ă 10 % de concurrence). Au-delĂ , on ajoute des GPU ou un second nĆud.
Mixtral 8x7B en quantization 4-bit pour la plupart des tĂąches (rapide, qualitĂ© Ă©levĂ©e). Mistral Large en mode full-precision est disponible sur demande pour les besoins de raisonnement avancĂ© â il demande plus de VRAM.
Les requĂȘtes sont mises en file d'attente automatiquement (vLLM gĂšre le batching). Au-delĂ d'un certain seuil sur la durĂ©e, l'extension consiste Ă ajouter un GPU L40S supplĂ©mentaire ou un nĆud, sans coupure.
Whisper large-v3 tourne sur les mĂȘmes GPU pendant les pĂ©riodes creuses. Aucune rĂ©union ne transite par un service externe. Pour les volumes trĂšs Ă©levĂ©s, on dĂ©die un GPU sĂ©parĂ©.
On échange 30 minutes pour comprendre votre contexte, puis on vous envoie un devis détaillé.
Demander un devis personnalisé