Méthode
Comment nous évaluons les outils d'IA.
Nous lisons les pages de tarifs et la documentation que les éditeurs publient, puis nous mettons les outils côte à côte. Chaque chiffre de ce site nomme sa provenance et le jour de vérification.
- 01
Nous choisissons un axe qui sépare le terrain
Avant de classer quoi que ce soit, nous notons chaque outil de la catégorie sur l'axe même qui servira au classement. Si tous obtiennent la même note, cet axe ne décide rien : nous le jetons et nous en cherchons un autre. Une règle qui ne peut trancher contre rien n'est qu'une décoration.
- 02
Nous lisons les pages de l'éditeur lui-même
Page de tarifs, documentation et journal des versions. Chaque chiffre publié est noté avec l'URL dont il vient et le jour où une personne l'a ouverte, et les deux figurent dans le registre des sources au bas de la page qui porte ce chiffre.
- 03
Nous citons les mesures par leur nom
Là où un groupe indépendant a mesuré quelque chose, nous lions son résultat publié et disons à qui il appartient. Nous ne réalisons aucune mesure de performance par nous-mêmes. Aucune page ici n'en porte aujourd'hui, et le jour où l'une en portera une, elle nommera le groupe qui l'a réalisée.
- 04
Nous publions une note de la rédaction selon une grille fixe
La grille est ci-dessous. La note est notre jugement, pondéré de la même façon pour chaque outil d'une catégorie. Les faits qui la portent ne sont pas un jugement, et c'est pourquoi ils sont sourcés séparément et vérifiables sans être d'accord avec nous.
- 05
Nous disons à qui chaque outil ne convient pas
Une fiche qui ne tranche jamais contre le produit est une publicité. Chaque avis noté ici porte une ligne Déconseillé à, et elle est obligatoire avant que la page ne soit construite.
La grille
Ce qui compose la note de la rédaction.
Cinq composantes pondérées, appliquées de la même façon à chaque outil d'une catégorie. Les pondérations ne diffèrent d'une catégorie à l'autre que lorsque la catégorie l'exige, et dans ce cas l'avis le précise.
| Composante | Poids | Ce qu'elle lit |
|---|---|---|
| Adéquation au travail annoncé | 30% | À quel point la capacité publiée correspond au cas d'usage dont la catégorie parle |
| Coût pour démarrer | 25% | Ce que l'offre gratuite permet réellement, et ce que coûte le premier palier payant |
| Ce que l'éditeur s'engage à tenir | 20% | Limites, conditions et conformité que l'éditeur publie par écrit, et non dans un argumentaire |
| Réversibilité | 15% | Formats d'export, disponibilité d'une API, et difficulté à partir |
| Qualité de la documentation | 10% | Si la documentation répond à une vraie question sans passer par le service commercial |
Portée
Ce que cette méthode ne couvre pas.
Nos notes reposent sur du matériel publié : ce qu'un éditeur s'engage à tenir par écrit, ce que sa documentation spécifie, et ce que des groupes indépendants ont mesuré et publié. C'est une base plus étroite que d'utiliser chaque outil pendant un mois, et c'est aussi une base que vous pouvez vérifier vous-même, ligne par ligne, depuis le registre de chaque page.
Là où un éditeur ne publie rien sur un point, nous laissons le champ vide plutôt que de le remplir, et le registre n'imprime aucune ligne pour lui. Une ligne absente signifie que nous ne l'avons pas trouvée. Elle ne signifie pas que la fonctionnalité manque, et nous prenons soin de ne jamais l'écrire comme si c'était le cas.