Méthodologie
Le Protocole JDLT
Notre cadre d'évaluation des outils d'intelligence artificielle : quatre axes, appliqués à l'identique à chaque comparatif que nous publions.
La plupart des comparatifs d'IA reposent sur les mêmes scores publics, recopiés d'un article à l'autre. Nous avons voulu un cadre stable, nommé et réutilisable, qui produise des données que l'on ne trouve nulle part ailleurs — et que nos lecteurs puissent contester chiffre par chiffre.
Benchmarks publics vérifiés
Nous ne recopions pas les chiffres qui circulent : chaque score est rattaché à sa source, à sa date et au modèle exact évalué (version comprise). Un benchmark dont nous ne retrouvons pas la publication d'origine n'est pas cité.
Contrôle : Source, date et version du modèle indiquées pour chaque score
Tests en français natif
Cinquante prompts standardisés en français professionnel — rédaction B2B, résumé de contrat, reformulation juridique — soumis à chaque modèle dans les mêmes conditions. Notation sur la cohérence stylistique, la précision lexicale, l'absence de calques anglais et le respect des conventions typographiques françaises.
Contrôle : 50 prompts identiques, notés à l'aveugle sur 4 critères
Coût réel calculé
Les grilles tarifaires ne disent pas ce que coûte un outil. Nous simulons un cas d'usage d'entreprise documenté (volume d'appels, tokens en entrée et en sortie) et publions le détail du calcul, tarifs datés à l'appui, pour que chacun puisse le refaire avec ses propres volumes.
Contrôle : Hypothèses publiées, calcul reproductible, tarifs datés
Grille de conformité RGPD
Pour chaque outil : existence d'un accord de traitement (DPA), résidence des données, politique d'entraînement sur les contenus clients, certifications détenues et alertes réglementaires en cours. Un outil peut être excellent techniquement et inutilisable pour une entreprise française.
Contrôle : DPA, résidence, entraînement, certifications, alertes
Deux séries de données produites par la rédaction
Deux axes du protocole génèrent des données originales, mesurées par nos soins et republiées à chaque édition d'un comparatif : le test de fiabilité en français (50 prompts professionnels, taux de sorties exploitables sans correction) et la simulation de coût réel (cas d'usage PME documenté, calcul détaillé, tarifs datés). Elles sont signalées dans nos articles par un encadré dédié.
Comparatifs évalués selon ce protocole
Une erreur de calcul, un chiffre contestable, une source à actualiser ? Écrivez-nous : les corrections sont publiées et datées, comme le prévoit notre charte éditoriale.