Aller au contenu

Quelle IA choisir en entreprise, cinq critères qui ne périment pas

Quelle IA choisir en entreprise se décide sur cinq critères : ce que l'éditeur fait des documents que vous lui donnez, où ces données sont stockées et traitées, l'environnement de travail déjà en place chez vous, le coût par personne, et ce que vaut la réponse sur vos propres textes.

Le nom du modèle n'est pas dans la liste, et c'est volontaire.

Pourquoi comparer les modèles ne règle pas le choix d'une IA pour son entreprise

Une comparaison de modèles a la durée de vie d'un trimestre. Au 07/09/2026, la documentation d'Anthropic présente Claude Opus 5, Claude Sonnet 5 et Claude Haiku 4.5, et le modèle qui faisait référence il y a un an et demi, Claude 3.7 Sonnet, ne figure même plus dans sa liste de modèles hérités.

Chez Google, la page des modèles mise à jour le 04/09/2026 donne Gemini 3.8 Flash comme dernier modèle stable, et le modèle Pro le plus récent n'y est encore qu'en préversion. Chez OpenAI, GPT-4o et GPT-4.5 sont retirés de ChatGPT.

Trois générations de noms en dix-huit mois.

Une entreprise ne peut pas rejouer son choix à ce rythme. Elle a besoin de critères qui survivent à la prochaine annonce, et ces critères portent sur elle : ses documents, son environnement de travail, son contrat.

Vous préférez en parler de vive voix ?

Prendre rendez-vous avec France IA

Critère 1 : ce que l'éditeur fait des documents que vous lui donnez

Sur les offres professionnelles des trois éditeurs, les contenus saisis ne servent pas à entraîner les modèles par défaut. Chacun l'écrit sur ses pages officielles : sur ce point, ils ne se distinguent pas.

La différence est ailleurs, et elle est chez vous.

Elle est entre le compte personnel gratuit que votre équipe utilise déjà et le contrat professionnel que vous n'avez pas encore signé. Sur l'application Gemini grand public, Google indique qu'un sous-ensemble de conversations est relu par des humains et conservé jusqu'à trois ans, avec un réglage pour s'y soustraire. Chez Anthropic, les offres Free, Pro et Max dépendent d'un réglage d'amélioration des modèles, quand les conditions commerciales interdisent l'entraînement sur les contenus professionnels.

Autrement dit, le partage ne passe pas par le fait de payer, mais par le type de contrat.

La question n'est donc pas « quel outil est le plus sûr » mais « sous quel compte mon équipe travaille-t-elle aujourd'hui ». La CNIL recommande d'encadrer cet usage par une charte interne qui définit les usages autorisés et les usages interdits. Ce document manque presque partout.

Critère 2 : où vos données sont stockées, et où elles sont traitées

Ces deux questions sont différentes et se confondent tout le temps. Le stockage, c'est l'endroit où la conversation dort. Le traitement, c'est l'endroit où le calcul se fait au moment où vous appuyez sur entrée.

Un éditeur peut garantir le premier sans garantir le second.

Sur ce critère, l'écart entre les trois est réel et vérifiable. Google Workspace permet de choisir entre les États-Unis et l'Europe, et sa documentation liste explicitement les prompts et les réponses Gemini parmi les données couvertes. Anthropic, à la même date, indique que les données sont stockées aux États-Unis et présente les points d'accès européens comme à venir en 2026, via des clouds tiers plutôt que par son assistant.

Pour ChatGPT, la résidence européenne existe, mais les documents disponibles la rattachent aux offres les plus hautes et la limitent aux données au repos. Posez la question à l'éditeur avant de signer, offre par offre, et demandez une réponse écrite : c'est un point qui bouge et qui se contractualise.

Choisir l'Europe pour le stockage ne dit rien du lieu où le calcul s'effectue, et aucune des trois documentations lues ne répond aux deux questions dans la même phrase.

Critère 3 : l'environnement de travail déjà en place chez vous

Ce critère décide plus souvent que tous les autres, et personne ne l'écrit dans un comparatif. Vos équipes passent leurs journées quelque part, dans une messagerie, un traitement de texte, un tableur, et l'assistant qui vit à cet endroit se fait adopter sans plan de conduite du changement.

Un fait tarifaire le rend très concret. Sur la page française de tarifs de Google Workspace, Gemini est inclus dans toutes les éditions, à niveau d'accès variable, sans option payante distincte à souscrire. Une entreprise déjà abonnée à Workspace dispose donc de l'assistant sans nouvelle ligne budgétaire.

La symétrie vaut ailleurs. Une équipe dont la matière première est un dossier de documents longs ne travaille pas dans un tableur : le choix s'y fera sur la capacité à ingérer et à citer.

Une fois l'outil arrêté, la prise en main se fait sur vos propres fichiers : la formation Gemini pour un environnement Google, la formation Claude pour des dossiers de documents longs, et la formation à l'IA générative si le socle n'est pas encore posé.

Regardez donc d'abord vos vingt dernières heures de travail.

Pas la démonstration commerciale.

Critère 4 : le coût par personne, et pour combien de personnes

Les offres professionnelles se ressemblent plus qu'on ne le croit. Anthropic affiche Claude Team à 20 $ par siège et par mois en engagement annuel, 25 $ en paiement mensuel, ce qui donne l'ordre de grandeur du marché sur ce segment.

Google Workspace, sur sa page française, va de 6,80 € à 21,10 € par utilisateur et par mois selon l'édition, Gemini compris, donc l'assistant n'y est pas une dépense séparée.

Chez OpenAI, aucun prix public n'existe pour l'offre Enterprise : la page de tarification renvoie vers un contact commercial. Les fourchettes qui circulent sur les blogs de revendeurs ne sont pas des faits, et nous ne les reprenons pas.

Le vrai coût est ailleurs de toute façon.

Il est dans le nombre de personnes équipées, et dans les licences payées en double parce que deux services ont choisi séparément. Comptez les sièges avant de comparer les prix.

Critère 5 : ce que vaut la réponse sur vos propres textes

C'est le critère dont tout le monde parle et que personne ne mesure. Nous avons cherché un classement public de la qualité en français, et le résultat mérite d'être dit tel quel.

Des classements qui isolent le français existent : l'arène Compar:IA du ministère de la Culture, la catégorie française d'Arena, la page française d'Artificial Analysis, le benchmark académique COLE. Aucun ne mesure la qualité de la langue française produite. Ils mesurent des préférences d'utilisateurs sur des questions posées en français, ou des connaissances évaluées à travers le français.

Sur le relevé du 02/09/2026 de la catégorie française d'Arena, les quinze premiers modèles tiennent dans un intervalle de 22 points, avec des marges d'erreur de 14 à 43 points. Autrement dit, aucun écart n'y est significatif.

Il ne reste donc qu'un test, le vôtre.

Prenez dix tâches que votre entreprise fait vraiment, avec les documents réels. Faites-les passer le même jour, avec la même demande, sur les deux ou trois outils envisagés. Une seule personne note chaque réponse sur un critère unique, écrit à l'avance : combien de corrections avant envoi.

Une précaution : une demande mal formulée fait mal noter le meilleur outil. Écrivez-la une fois, proprement, et servez-vous de la même pour les trois, ce qui relève du prompt engineering en entreprise.

Ce que ce comparatif ne tranche pas

Il ne dit pas lequel est le meilleur. Sur les tâches courantes d'une entreprise, rédiger, résumer, reformuler, comparer deux documents, les trois assistants généralistes font le travail, et la différence viendra plus souvent de vos documents que du modèle.

Il ne couvre pas les usages réglementés. Tout ce qui produit une décision individuelle sur une personne relève d'un régime à part et ne se choisit pas sur ces cinq critères.

Il ne répond pas non plus au besoin qui n'est pas un assistant. Si ce que vous voulez, c'est qu'une suite d'étapes se déclenche seule à heure fixe et écrive dans un autre outil, aucun de ces trois outils n'est la réponse : il s'agit d'automatiser ses process avec n8n, et le raisonnement y est différent.

Enfin, un outil choisi n'est pas un outil utilisé. C'est le travail que nous faisons en présentiel, sur les tâches que les apprenants apportent, dans notre formation ChatGPT en entreprise.

Nous assumons ce parti pris : mieux vaut un outil moyen que votre équipe maîtrise qu'un outil optimal que personne n'ouvre.

En bref

  • Les noms de modèles changent chaque trimestre : Claude 3.7 Sonnet ne figure plus dans la liste des modèles hérités d'Anthropic, GPT-4o est retiré de ChatGPT.
  • Sur les offres professionnelles des trois éditeurs, les contenus saisis ne servent pas à entraîner les modèles par défaut. Le régime change sur les comptes grand public.
  • Le stockage des données et leur traitement sont deux questions distinctes, et un éditeur peut garantir l'un sans l'autre.
  • Gemini est inclus dans toutes les éditions de Google Workspace, de 6,80 € à 21,10 € par utilisateur et par mois, sans option distincte à souscrire.
  • Claude Team est affiché à 20 $ par siège et par mois en engagement annuel. Aucun prix public n'existe pour ChatGPT Enterprise.
  • Aucun classement public ne mesure la qualité de la langue française produite, et les écarts entre les premiers sont inférieurs aux marges d'erreur.
  • France IA anime cette montée en compétence en présentiel sur deux jours, neuf apprenants au maximum par session, pour 1 650 € TTC, tarif unique.
  • France IA est certifiée Qualiopi N°FRCM25066. La certification qualité a été délivrée au titre de la catégorie d'action suivante : ACTIONS DE FORMATION. Déclaration d'activité 11757121375.

Questions fréquentes

Faut-il choisir un seul assistant pour toute l'entreprise ?

Un seul par usage, pas forcément un seul par entreprise. Une équipe qui vit dans Google Workspace et une équipe qui lit des documents longs n'ont pas le même besoin. Ce qui coûte cher, ce n'est pas la deuxième licence, c'est la deuxième façon de travailler que personne n'a écrite.

Les données saisies servent-elles à entraîner les modèles ?

Sur les offres professionnelles des trois éditeurs, non par défaut : Anthropic, Google et OpenAI l'écrivent chacun sur leurs pages officielles. Le régime change sur les comptes grand public, où le partage dépend d'un réglage ou d'une autorisation. La ligne de partage passe par le contrat, pas par le fait de payer.

Peut-on garder ses données en Europe ?

Cela dépend de l'éditeur et de l'offre, et le stockage ne vaut pas le traitement. Google Workspace permet de choisir l'Europe et couvre explicitement les prompts et les réponses. Anthropic indique au 07/09/2026 que les données sont stockées aux États-Unis, les points d'accès européens étant annoncés via des clouds tiers.

Existe-t-il un classement de la qualité en français ?

Il existe des classements qui isolent le français, dont l'arène Compar:IA du ministère de la Culture. Aucun ne mesure la qualité de la langue produite : ils mesurent des préférences sur des questions posées en français. Les écarts entre les premiers y sont inférieurs aux marges d'erreur.

Combien de temps consacrer à ce choix ?

Une demi-journée pour lire les conditions contractuelles des offres envisagées, une semaine pour le test sur dix tâches réelles. Au-delà, vous comparez des fiches de caractéristiques qui auront changé avant votre décision, ce qui arrive à chaque génération de modèles.