Prix & Coûts

Une orientation transparente pour votre projet d’IA

Les projets d’IA se prêtent rarement à une tarification forfaitaire, car l’ampleur, les exigences techniques et la base de données varient fortement d’une entreprise à l’autre. Notre aperçu des prix vous montre donc quels éléments de coût vous pouvez généralement prévoir et de quoi se compose typiquement un projet.

Le coût total résulte de la licence logicielle adaptée, d’éventuelles prestations pour l’installation, l’adaptation ou la préparation des données, ainsi que de frais liés à l’utilisation des modèles d’IA, du stockage ou des accès aux données.

Quels éléments sont réellement pertinents dépend de votre cas d’utilisation concret.

Vous obtenez ainsi dès le départ une orientation claire, sans que votre projet soit enfermé dans un forfait rigide. Nous établissons une offre ferme après un premier entretien, dès que les exigences, la situation des données, les fonctions souhaitées et l’effort technique peuvent être évalués de manière réaliste.

N’hésitez pas à nous contacter à tout moment si vous avez des questions sur nos prix.

Notre offre s’adresse aux clients professionnels ; nos prix s’entendent donc en euros (€), hors taxes et hors impôts légaux applicables.

Licences logicielles

Quelle licence logicielle convient à votre entreprise dépend avant tout de la manière dont vous souhaitez utiliser l’IA.

Pour une prise en main rapide, les petites équipes et les applications clairement délimitées, Vimmera Now est généralement le bon choix. Si vous souhaitez intégrer durablement l’IA dans les processus de l’entreprise, utiliser plusieurs assistants, bases de connaissances, modèles de rôles, statistiques d’utilisation ou des extensions évolutives, Vimmera Studio est plus adapté. Lors d’un échange commun, nous clarifions quelle plateforme correspond à vos objectifs, à votre nombre d’utilisateurs, à vos données et à vos exigences de sécurité.

Vimmera Now

L’entrée dans l’IA d’entreprise en toute sécurité.

Vimmera Now convient aux entreprises qui souhaitent démarrer rapidement avec des assistants IA, des bases de connaissances et des outils IA simples. La plateforme contient les principales fonctions de base de Vimmera Studio, mais avec un périmètre de prestations réduit.

39,00 € / mois

Inclus :

  • 1 utilisateur inclus
  • Jusqu’à 10 utilisateurs par compte d’entreprise
  • Mises à jour, exploitation des serveurs et maintenance logicielle
  • Historique de chat jusqu’à 50 fils par utilisateur
  • Durée de conservation maximale de 30 jours de l’historique de chat (les obligations légales de conservation en arrière-plan, sans visibilité pour l’utilisateur, en sont exclues)
  • Jusqu’à 5 Go d’espace de stockage pour l’historique de chat
  • GPT d’entreprise inclus (plus frais liés à l’utilisation)
  • Hébergement en Europe ou selon accord individuel

Extensions optionnelles :

  • Utilisateur supplémentaire : 39,00 € / mois
  • Configuration par utilisateur : 99,00 € une seule fois
  • Vimmera Cortex : 39,00 € / mois par Cortex
  • Vimmera Assist : 39,00 € / mois par Assist
  • Vimmera Tool : 39,00 € / mois par Tool
  • Vimmera Webchat (chatbot pour intranet ou internet) : 69,00 € / mois par Webchat
  • Stockage supplémentaire pour l’historique de chat : 9,00 € / mois par 10 Go
  • Stockage supplémentaire pour Cortex : 9,00 € / mois par tranche entamée de 1 Go

Remarque : lors de l’utilisation de systèmes d’IA (p. ex. Assist, Tools, Webchats,…) des frais liés à l’utilisation sont facturés (voir plus bas) et ne sont pas inclus dans les coûts de licence.

Vimmera Studio

La plateforme évolutive pour des systèmes d’IA individuels, la connaissance d’entreprise et des processus d’IA évolutifs.

Vimmera Studio est la plateforme logicielle centrale pour les systèmes d’IA, les assistants, les bases de connaissances et les outils de Vimmera AI. La plateforme convient aux entreprises qui ont besoin de plusieurs utilisateurs, d’un travail de connaissance structuré, d’assistants IA individuels, de statistiques d’utilisation, de modèles de rôles et de processus d’IA extensibles.

499,00 € / mois

Inclus :

  • 5 utilisateurs inclus
  • Nombre maximal d’utilisateurs illimité
  • Mises à jour, exploitation des serveurs et maintenance logicielle
  • 1 Vimmera Cortex inclus (plus, le cas échéant, coûts d’individualisation et de préparation des données)
  • 3 Vimmera Assist individuels inclus (plus, le cas échéant, coûts d’individualisation)
  • 3 Vimmera Tool individuels inclus (plus, le cas échéant, coûts d’individualisation)
  • Statistiques d’utilisation incluses
  • Durée de conservation maximale et minimale de l’historique de chat configurable selon les exigences légales ou individuellement
  • 10 Go d’espace de stockage pour l’historique de chat inclus
  • Nombre illimité de Vimmera Assist, Vimmera Cortex et Vimmera Tools possible
  • GPT d’entreprise inclus (plus frais liés à l’utilisation)
  • Assistant de réunion (outil Vimmera Meeting) inclus (plus frais liés à l’utilisation)
  • Translation Studio (traductions par IA) inclus (plus frais liés à l’utilisation)
  • Transcribe (outil de transcription) inclus (plus frais liés à l’utilisation)
  • Hébergement en Europe ou selon accord individuel

Extensions optionnelles :

  • Utilisateur supplémentaire : 29,00 € / mois
  • Chaque Vimmera Cortex supplémentaire : 39,00 € / mois
  • Chaque Vimmera Assist supplémentaire : 39,00 € / mois
  • Chaque Vimmera Tool supplémentaire : 39,00 € / mois
  • Vimmera Webchat (chatbot pour intranet ou internet) : 69,00 € / mois par Webchat
  • Stockage supplémentaire pour l’historique de chat : 9,00 € / mois par 10 Go
  • Stockage supplémentaire pour Cortex : 9,00 € / mois par tranche entamée de 1 Go

Tarifs dégressifs :

Pour les entreprises comptant de nombreux utilisateurs, assistants, outils ou Cortex, nous proposons des tarifs dégressifs. Nous serons ravis d’échanger avec vous sur les possibilités et les paliers de prix exacts.

Remarque : les licences logicielles n’incluent pas d’individualisations ni d’adaptations dans le prix. Les adaptations, individualisations, préparations de données ou autres prestations sont facturées séparément.

La licence pour Vimmera Webchat (chatbot pour intranet ou internet) comprend également la mise à disposition du code JavaScript pour une interface de chatbot. L’intégration technique dans le site web, les adaptations aux systèmes CMS, de consentement ou de suivi, ainsi que les ajustements de design ne sont pas inclus et sont proposés séparément.

Remarque : lors de l’utilisation de systèmes d’IA (p. ex. Assist, Tools, Webchats,…) des frais liés à l’utilisation sont facturés (voir plus bas) et ne sont pas inclus dans les coûts de licence.

Comparaison : Vimmera Now et Vimmera Studio

FonctionVimmera NowVimmera Studio
Prix mensuel39,00 €499,00 €
Utilisateurs inclus15
Nombre maximal d’utilisateurs10illimité
Utilisateurs supplémentaires39,00 € / mois29,00 € / mois
Statistiques d’utilisationnon inclusinclus
Mode privénon inclusdisponible en option
Vimmera Cortexen option1 inclus
Vimmera Assisten option3 inclus
Webchat (chatbot pour intranet ou internet)en optionen option
Outilsen option3 inclus
Historique de chatlimitéétendu selon les spécifications

Remarque : lors de l’utilisation de systèmes d’IA (p. ex. Assist, Tools, Webchats,…) des frais liés à l’utilisation sont facturés (voir plus bas) et ne sont pas inclus dans les coûts de licence.

Prestations

Pour les adaptations individuelles, les extensions techniques, les interfaces, la préparation des données et les mises en œuvre liées au projet, nous facturons au temps passé.

PrestationFacturationPrix net
Adaptations UI, adaptations dans Vimmera Studio et Vimmera Now, personnalisations généralespar heure149,00 €
Préparation des données, vérification des données, programmation d’interfaces, numérisation des données, programmation de structures de vector store, prompt engineering, personnalisation de Vimmera Assist, Vimmera Webchat, Vimmera Tools et maintenance des donnéespar heure189,00 €

Ateliers & formations

Pour une utilisation réussie de l’IA, une préparation soignée est décisive. Lors d’ateliers, nous analysons les processus, identifions des cas d’usage pertinents, examinons les données existantes et préparons la mise en œuvre.

En outre, nous proposons des formations et des ateliers sur les conditions-cadres et possibilités d’utilisation pertinentes, en particulier sur le RGPD, l’EU AI Act ainsi que sur l’utilisation responsable et sûre de l’IA dans les entreprises.

ContenuDuréePrix net
Entretiens d’analyse, formations, compilation des données et préparation du projet1 jour / 8 heures1.650,00 €
Entretiens d’analyse, formations, compilation des données et préparation du projet1/2 jour / 4 heures950,00 €

Le prix comprend la préparation et le suivi nécessaires ainsi que la documentation et les supports, par exemple des supports de formation ou des listes de contrôle.

Les frais de déplacement sont facturés selon accord individuel.

Frais d’utilisation pour les modèles d’IA, les outils, les accès aux données et au web

Outre les coûts de licence et de projet, des coûts liés à l’utilisation peuvent survenir. Ils dépendent notamment du modèle d’IA utilisé, du nombre de requêtes, du volume de données, du traitement d’images ou d’audio ainsi que de l’infrastructure choisie.

Coûts typiques liés à l’utilisation :

  • Traitement de texte selon les jetons d’entrée, de sortie et de stockage (jetons mis en cache)
  • Accès à Vimmera Cortex ou aux vector stores
  • Recherches web (y compris sur les sites web d’entreprise)
  • Sessions de code interpreter
  • Analyse d’images et génération d’images
  • Génération de vidéos
  • Transcriptions audio
  • Saisies vocales en temps réel
  • Mise en cache d’informations de thread ou de contexte

À titre indicatif, les coûts de jetons et d’utilisation se situent, selon le modèle, dans les fourchettes suivantes :

UtilisationIndication nette
Jetons d’entréeà partir de 0,36 € par 1 million de jetons
Jetons d’entrée mis en cacheà partir de 0,10 € par 1 million de jetons
Jetons de sortieà partir de 2,45 € par 1 million de jetons
Code interpreter (exécution du code en arrière-plan)à partir de 0,05 € par session
Recherche web17,45 € par 1000 recherches web
Accès au vector store (ou autres appels d’outils)3,80 € par 1.000 accès (appels)
Téléversement audio / transcription0,02 € par minute audio
Entrée audio en temps réel0,04 € par minute audio
Génération d’imagesà partir de 0,10 € jusqu’à env. 0,50 € par image, selon le modèle et la résolution

Nous convenons avec vous du choix concret du modèle et de l’infrastructure. Il en résulte de manière individuelle quels coûts sont engagés. Les coûts de jetons dépendent à la fois du modèle d’IA choisi/utilisé (p. ex. LLM) et du lieu d’hébergement, de l’infrastructure et d’autres facteurs.

Exemple de prix pour des LLM plus onéreux : les LLM très performants avec algorithmes de raisonnement et très grande longueur de contexte sont facturés pour les jetons d’entrée à partir d’env. 1,82 € par 1 million de jetons, les jetons d’entrée mis en cache à partir d’env. 0,40 € par 1 million de jetons, et les jetons de sortie à partir d’env. 13,30 € par 1 million de jetons.

Les frais liés à l’utilisation sont facturés mensuellement sur la base de l’utilisation déterminée via Vimmera Now ou Vimmera Studio.

Explications des termes techniques

Afin que vous puissiez mieux situer l’aperçu des prix, nous expliquons brièvement les principaux composants de nos plateformes d’IA.

Le Code Interpreter est un environnement d’exécution pour les applications d’IA dans lequel des calculs, des analyses de données et des tâches basées sur des fichiers peuvent être exécutés directement par l’IA. Il permet à un assistant IA non seulement de formuler des réponses, mais aussi de travailler activement avec des données, par exemple analyser des tableaux, traiter des fichiers, effectuer des calculs, générer des graphiques ou exécuter de manière compréhensible des étapes techniques intermédiaires. Ainsi, l’assistant IA peut traiter des tâches plus complexes de manière plus fiable et fournir des résultats fondés sur de véritables calculs ou sur le contenu des fichiers.

Une session est un environnement de travail limité dans le temps, dans lequel une application d’IA peut conserver des informations, des résultats intermédiaires et l’état actuel du traitement pendant une utilisation. Au sein d’une session, l’assistant IA peut travailler de manière continue, se référer aux saisies précédentes dans le déroulement actuel et poursuivre les tâches étape par étape. Ainsi, les informations n’ont pas besoin d’être transmises à nouveau à chaque requête, mais restent disponibles pendant la session en cours. Une session aide donc à regrouper de manière cohérente les conversations, calculs, traitements de fichiers ou autres étapes de travail et à les poursuivre de façon consistante.

Les jetons d’entrée sont les unités d’information transmises à un modèle d’IA afin qu’il puisse comprendre et traiter une requête. Cela inclut par exemple la saisie de l’utilisateur, les instructions système, l’historique de la conversation, les textes insérés, le contenu de fichiers ou des informations contextuelles supplémentaires provenant de sources de connaissances connectées. L’IA ne traite pas ces contenus comme des mots entiers, mais en unités de texte plus petites, appelées jetons. Plus il y a d’informations transmises au modèle, plus le nombre de jetons d’entrée utilisés est élevé. Les jetons d’entrée déterminent ainsi la quantité de contexte qu’un assistant IA peut prendre en compte lors du traitement d’une requête et constituent en même temps une base importante pour le traitement technique et la facturation des requêtes d’IA.

Les jetons d’entrée mis en cache sont des jetons d’entrée qu’un modèle d’IA peut réutiliser lors d’une requête, parce que des éléments de contexte identiques ou très similaires ont déjà été traités auparavant. Cela concerne par exemple des instructions système récurrentes, de longs prompts inchangés, des blocs de contexte fixes ou des contenus envoyés de manière identique dans plusieurs requêtes. Au lieu de retraiter entièrement ces contenus à chaque fois, ils peuvent être mis en cache techniquement et pris en compte comme « cached ». Ainsi, les requêtes répétées peuvent être traitées plus efficacement et, en règle générale, à moindre coût que des jetons d’entrée entièrement nouveaux. Les jetons d’entrée mis en cache sont donc particulièrement pertinents pour les applications d’IA qui travaillent fréquemment avec les mêmes instructions de base, extraits de documents ou informations contextuelles récurrentes.

Les jetons de sortie sont les unités d’information qu’un modèle d’IA génère en réponse. Cela inclut par exemple des textes rédigés, des résumés, des explications, des contenus de tableaux, du code, des données structurées ou d’autres contenus produits par le modèle. Alors que les jetons d’entrée décrivent les informations transmises au modèle, les jetons de sortie décrivent le résultat renvoyé par le modèle. Plus une réponse est longue ou détaillée, plus le nombre de jetons de sortie générés est élevé. Les jetons de sortie sont donc importants pour le traitement technique, la longueur possible des réponses et la facturation des requêtes d’IA.

Les accès au vector store sont des requêtes adressées à une base de connaissances ou de documents dans laquelle les contenus sont stockés non seulement comme texte normal, mais sous forme de vecteurs. Un système d’IA utilise de tels accès pour trouver, à partir d’une question d’utilisateur, des informations pertinentes dans des documents, articles de connaissances, données produit ou autres sources enregistrées. La recherche ne se fait pas uniquement par mots-clés exacts, mais par similarité de contenu. Ainsi, un assistant IA peut récupérer des passages de texte ou des ensembles de données pertinents, même si la question est formulée différemment des contenus stockés. Les accès au vector store sont donc particulièrement importants lorsqu’une application d’IA doit travailler avec des connaissances spécifiques à l’entreprise et générer des réponses sur la base de sources ou d’extraits de documents pertinents.

Les recherches web sont des requêtes effectuées par un système d’IA (p. ex. déclenchées par un LLM) sur des pages web (p. ex. sur Internet ou dans un intranet d’entreprise). Des agents ou outils disposant de la fonctionnalité correspondante peuvent « googler » et effectuer des recherches Internet de manière autonome. Il est par exemple possible de rechercher en temps réel des pages web, les informations et/ou documents qui y sont déposés, ou même de déclencher des fonctions de recherche sur des pages web, voire d’effectuer de petites interactions avec des pages web (p. ex. lors de connexions, etc.). Les recherches web peuvent être déclenchées plusieurs fois au cours d’une recherche ; les systèmes d’IA peuvent décider librement de la nécessité d’une ou de plusieurs recherches et n’utilisent toujours que le nombre de recherches nécessaire à la résolution d’une tâche donnée.

Le mode privé est une variante d’un assistant/agent ou d’un outil qui fonctionne sans aucune possibilité d’accès externe, de consultation ou de stockage. Les données ne sont utilisées qu’au moment où elles sont réellement nécessaires. Aucun historique n’est créé. Cela garantit une protection maximale des données et permet même de traiter en toute sécurité les données les plus confidentielles dans les systèmes d’IA. Par exemple, le mode privé peut être utilisé par des équipes de développement, des ONG ou des comités d’entreprise lorsqu’une seule personne ou un groupe précis doit avoir accès aux données et que même les administrateurs ne doivent pas y avoir accès (pas de portes dérobées).

L’entrée audio en temps réel désigne des données audio qui sont transmises directement et presque sans délai à un système d’IA pendant une utilisation en cours. La parole n’est pas d’abord téléversée sous forme de fichier fini, mais traitée en continu sous forme de flux audio. Un assistant IA peut ainsi reconnaître directement les saisies orales, les évaluer et y réagir.

Le téléversement audio pour les transcriptions désigne la possibilité de transmettre des fichiers audio existants à un système d’IA afin qu’un texte en soit automatiquement généré. Il peut s’agir par exemple d’enregistrements provenant d’un assistant de réunion, d’entretiens, de notes téléphoniques, de formations, de mémos vocaux ou de sources audio externes.

L’IA traite le fichier audio téléversé et transforme les contenus parlés en une transcription écrite. Cette transcription peut ensuite être réutilisée, par exemple pour des résumés, des procès-verbaux, des listes de tâches, des articles de connaissances, de la documentation ou un traitement structuré dans une application d’IA. Les téléversements audio pour les transcriptions sont donc particulièrement utiles lorsqu’il s’agit de rendre des informations orales exploitables a posteriori, recherchables et documentables.

Vimmera Cortex est la base de connaissances de vos applications d’IA. Les informations de l’entreprise, documents, données produit, connaissances de service ou autres contenus peuvent y être déposés de manière structurée et rendus utilisables pour les systèmes d’IA. Un Cortex veille à ce qu’un assistant IA n’utilise pas seulement des connaissances générales, mais puisse accéder aux informations pertinentes de votre entreprise.

Vimmera Assist est un assistant IA configurable individuellement pour des tâches, départements ou cas d’usage spécifiques. Un Assist peut par exemple répondre à des questions internes, soutenir les collaborateurs, préparer des demandes de service, rédiger des textes ou utiliser des informations provenant d’un Cortex. Selon les besoins, un Assist peut être doté de rôles, règles, sources de connaissances et fonctions spécifiques.

Exemples d’Assist :

  • GPT d’entreprise
  • Assistants de recherche web
  • Support de premier niveau
  • Traitement de documents / création de documents
  • Recherche documentaire
  • Assistants de gestion des connaissances
  • Assistants d’onboarding et d’offboarding

Vimmera Tool est une fonction IA spéciale ou une extension permettant d’automatiser ou de soutenir des tâches concrètes. Les outils peuvent par exemple analyser des données, structurer des contenus, préparer des documents, interroger des interfaces ou faciliter certains processus récurrents. Ils étendent un ou plusieurs assistants IA avec des capacités supplémentaires.

Exemples d’outils :

  • Assistant de réunion (enregistrements de réunions)
  • Assistant de traduction (traductions)
  • Assistant de transcription (gestion des connaissances)
  • Assistant de comptabilisation des factures

Vimmera Webchat est un chatbot pour intranet ou Internet qui peut être intégré à un site web. Il permet aux collaborateurs, clients ou autres groupes d’utilisateurs d’interagir directement avec un système d’IA via une interface de chat. Selon la configuration, un webchat peut accéder aux connaissances de l’entreprise depuis un Cortex, être relié à un Assist ou utiliser certains outils.

Exemples de webchat :

  • Mera sur notre page d’accueil

En termes simples : le Cortex fournit les connaissances, l’Assist utilise ces connaissances dans le dialogue, un outil étend l’IA avec des fonctions concrètes ou des étapes de processus, et le webchat rend l’IA utilisable via un site web.

Protection des données et hébergement

La protection des données et la sécurité font partie intégrante de chaque solution. Selon les exigences du projet, nous définissons individuellement le lieu d’hébergement, les droits d’accès, le modèle de rôles, la journalisation et le traitement des données.

Des modèles d’hébergement individuels, un hébergement en Allemagne ou des solutions sur site sont possibles après examen technique et accord séparé.

Préparation des données pour de meilleurs résultats d’IA

Les données de l’entreprise peuvent être déposées directement dans Vimmera Cortex et rendues utilisables pour les applications d’IA. Toutefois, en cas de volumes de données importants ou de formats de données difficiles à lire, des confusions, des résultats imprécis ou des informations mélangées peuvent survenir.

C’est pourquoi Vimmera AI propose une préparation avancée des données. Les connaissances de l’entreprise ne sont alors pas seulement stockées, mais structurées, reliées et optimisées pour les systèmes d’IA. Les assistants peuvent ainsi utiliser des contextes plus pertinents et produire des réponses plus fiables.

Nous recommandons particulièrement cette préparation des données pour les documents complexes, les informations produit volumineuses, les documents techniques, les connaissances de service ou les grands fonds de connaissances internes.

Les prestations de préparation des données sont facturées au temps passé (voir services).


Durée du contrat et facturation

Sauf accord contraire, la durée minimale du contrat par produit est de 12 mois.

Facturation habituelle :

  • Services, ateliers et formations facturés au temps passé
  • Licences logicielles mensuelles
  • Frais d’utilisation mensuels selon l’utilisation réelle

Quelle solution vous convient ?

Vimmera Now convient pour débuter, pour les petites équipes et pour des applications d’IA clairement limitées. Les licences de Vimmera Now peuvent à tout moment être converties en licences pour Vimmera Studio.

Vimmera Studio convient aux entreprises qui souhaitent intégrer durablement l’IA dans les processus, les connaissances, le support, la communication ou les opérations internes.

Lors d’un premier entretien, nous déterminons ensemble quelle plateforme, quels assistants IA, quelles sources de données et quelles exigences de sécurité sont pertinentes pour votre entreprise.

Accès de test

Vous souhaitez découvrir Vimmera AI dans un premier temps ? Sur demande, nous vous fournissons volontiers, en plus d’explications détaillées, un accès de test gratuit et sans engagement. Vous pouvez ainsi essayer certaines fonctionnalités, recueillir vos premières impressions et vérifier si Vimmera Now ou Vimmera Studio répond à vos besoins.

L’accès de test sert uniquement à vous orienter et n’est lié ni à une commande ni à un engagement contractuel.

L’étendue, la durée et les fonctionnalités disponibles de l’accès de test sont définies individuellement.

Remarques sur les prix et la facturation

Notre offre s’adresse exclusivement aux clients professionnels.

Tous les prix indiqués s’entendent hors taxes, TVA légale en sus. Les prix sont donnés à titre indicatif et peuvent varier selon l’ampleur du projet, la quantité de données, la qualité des données, l’infrastructure souhaitée, le lieu d’hébergement et le modèle d’IA utilisé.

Seules les offres et les contrats individuels font foi. Sauf accord contraire, le délai de paiement est de 14 jours nets à compter de la date de facture. Sous réserve de modifications et d’erreurs.

Les CGV de Vimmera AI Solutions GmbH s’appliquent. Les offres et contrats individuels prévalent toujours.


Convenir d’un premier entretien sans engagement

Vous souhaitez savoir quels coûts votre projet d’IA concret entraînera ?

Alors parlez-en avec nous. Après un premier entretien d’analyse, nous pouvons évaluer quelle solution est adaptée, quelles données sont nécessaires et quel effort est réaliste.