Aller au contenu
quelagentia.fr agents IA pour entreprises

Méthode de notation des agents IA : critères, pondération et protocole de test

Un classement n'a de valeur que si l'on peut le refaire. Cette page décrit la cible, les tâches, les critères, la pondération et les règles que nous nous imposons.

1. Pour qui nous notons

Un dirigeant de TPE ou PME, un artisan, un indépendant ou une petite équipe sans service informatique. La question posée à chaque agent est toujours la même : peut-il reprendre une partie de la charge administrative et commerciale, sans risque pour l'entreprise, à un coût que l'on peut justifier ?

2. Les douze tâches de référence

Chaque agent reçoit les mêmes douze missions, formulées comme un dirigeant les dicterait, avec les mêmes fichiers d'entrée. Nous mesurons le résultat livré, le temps que nous avons passé, et le nombre de corrections nécessaires.

  1. 01 Rédiger un devis à partir d’une demande client et d’une grille tarifaire
  2. 02 Relancer trois factures impayées avec le bon ton
  3. 03 Préparer le rendez-vous de demain : historique, points ouverts
  4. 04 Trier et résumer 48 h de boîte mail
  5. 05 Répondre à un avis client négatif
  6. 06 Planifier une semaine d’interventions à partir de contraintes
  7. 07 Extraire les dépenses du mois depuis des tickets photographiés
  8. 08 Rédiger une annonce de recrutement conforme
  9. 09 Comparer trois fournisseurs à partir de leurs PDF
  10. 10 Préparer les éléments pour l’expert-comptable
  11. 11 Mettre à jour le CRM après un appel transcrit
  12. 12 Veille hebdomadaire : réglementation du secteur

3. Les sept critères et leur poids

Le poids reflète ce qui compte pour une petite entreprise. Le gain de temps est la raison d'acheter ; la fiabilité, la sécurité et la prise en main sont ce qui fait qu'on continue à l'utiliser.

20 %

Gain de temps réel

Combien de minutes rend-il par tâche, corrections comprises ?

Mesuré sur les douze tâches : temps total passé par nous, du brief à la validation, comparé au temps sans agent.

15 %

Fiabilité des résultats

Peut-on envoyer le livrable sans tout relire ?

Nombre d’erreurs factuelles, de chiffres inventés et d’options choisies sans demander. Une invention de prix ou de date coûte un point entier.

15 %

Sécurité et RGPD

Où vont les données et qui peut y accéder ?

Localisation déclarée, sous-traitants, entraînement sur vos données, contrôle des droits app par app. L’absence d’information est notée comme un manque.

15 %

Intégrations métier

Agit-il dans vos outils : mail, agenda, devis, compta ?

Connexions réelles testées (pas seulement annoncées) avec Gmail/Outlook, agenda, un outil de devis-facture et un tableur.

15 %

Prise en main

Un non-technicien est-il opérationnel en une heure ?

Temps entre l’inscription et la première tâche livrée, sans aide extérieure. Installation serveur ou ligne de commande pénalisée.

10 %

Coût mensuel

Que paie-t-on réellement pour un usage quotidien ?

Coût TTC constaté pour un utilisateur qui délègue 3 à 5 tâches par jour, crédits et dépassements inclus.

10 %

Support et français

Est-on aidé, en français, quand ça bloque ?

Interface et documentation en français, délai de réponse du support à deux demandes réelles, présence d’un interlocuteur humain.

4. L'échelle de 1 à 5

Chaque critère reçoit une note de 1 à 5, par demi-point. La note finale sur 100 tient compte du poids de chaque critère et est arrondie à l'entier.

5

Livrable prêt à envoyer, aucune correction, aucune information à demander. Fait mieux qu’un bon assistant humain sur cette tâche.

4

Résultat exploitable après une relecture rapide ; une correction mineure au plus.

3

Résultat utile mais à retravailler ; il reste plus rapide que de faire soi-même.

2

Résultat partiel ou erreurs qui exigent une vérification complète ; gain de temps douteux.

1

Échec, refus, ou erreur qui aurait porté préjudice à l’entreprise si elle était passée.

Le calcul, en clair. Note finale = somme de (note du critère × son poids), multipliée par 20, arrondie à l'entier. Un agent noté 5 partout obtient 100 ; un agent noté 3 partout obtient 60. Les 7 poids sont ceux du tableau ci-dessus et leur somme fait 100 %.

5. Nos règles

Indépendance

Aucun éditeur ne finance ce site, ne relit les notes avant publication ni ne bénéficie de lien d'affiliation. Les abonnements testés sont payés par la rédaction.

Information manquante

Quand un éditeur ne publie pas une information (localisation des données, quota, prix), nous le signalons et notons ce qui est vérifiable, jamais ce qui est supposé.

Sources et date

Chaque fiche cite ses sources officielles et la date du relevé. Les fonctionnalités et les prix changent vite : vérifiez toujours la page de l'éditeur avant de souscrire.

Droit de réponse

Les éditeurs peuvent contester une note avec des éléments vérifiables. Les corrections sont publiées avec leur date dans un historique visible sur chaque fiche.

6. Contester une note

Éditeur, utilisateur ou lecteur : si une note vous paraît fausse, écrivez-nous avec l'élément vérifiable qui la contredit. Nous rejouons la tâche concernée et publions la correction avec sa date. Nous écrire.