Zolamir est conçu pour être vérifiable. Chaque chiffre du site provient d’une source publique que nous citons, est actualisé automatiquement et s’accompagne de la méthode utilisée. Cette page explique comment.
D’où viennent les données
- Modèles et prix : l’API publique d’OpenRouter, qui recense les modèles proposés par des dizaines de fournisseurs avec leurs prix par million de tokens, leur fenêtre de contexte et leurs capacités. Les prix et la disponibilité par fournisseur viennent de la même API.
- Scores de qualité : les résultats de tests indépendants publiés par Epoch AI sous licence CC BY 4.0 : l’Epoch Capabilities Index, SWE-bench Verified, GPQA Diamond, AIME, FrontierMath et SimpleQA Verified. Nous n’utilisons pas les scores annoncés par les entreprises elles-mêmes.
- Actualités : les flux RSS publics des laboratoires d’IA et de la presse tech en quatre langues, ainsi que les sujets IA les plus discutés sur Hacker News. Nous n’affichons qu’un titre, un court extrait et un lien : l’article reste toujours sur le site de l’éditeur.
- Recherche : les articles mis en avant par la communauté Hugging Face et les modèles ouverts en tendance sur Hugging Face.
À quelle fréquence tout est mis à jour
Une tâche automatique tourne toutes les quatre heures. Elle télécharge les nouvelles données, enregistre les nouveaux modèles et les changements de prix dans le journal des changements, traduit les nouveaux titres et reconstruit le site. Les scores de qualité sont actualisés chaque jour et nos mesures de tokens chaque mois. Chaque semaine est résumée dans Cette semaine dans l’IA.
Comment fonctionnent les classements
Les classements ordonnent les modèles selon un test indépendant à la fois. Quand un modèle a été testé avec plusieurs réglages, nous retenons son meilleur résultat. Les nouveaux modèles apparaissent une fois testés, en général quelques semaines après leur sortie. Les pages « meilleurs pour » croisent ces scores avec les prix actuels selon des règles simples et affichées (par exemple, « performant » signifie un indice général de 140 ou plus).
Comment nous mesurons le coût de chaque langue
Nous avons rédigé les quatre mêmes textes dans 15 langues, puis compté les tokens produits par le tokeniseur public de chaque entreprise. Le rapport à l’anglais donne le surcoût de chaque langue pour chaque famille de modèles. Les entreprises qui ne publient pas leur tokeniseur reçoivent la moyenne des familles mesurées, signalée par ≈.
Traductions
Les titres et résumés publiés dans d’autres langues sont traduits automatiquement par des modèles open source (Opus-MT et NLLB) que nous faisons tourner nous-mêmes. Ils portent toujours la mention « Traduit de… » et renvoient à l’article original. Les textes de l’interface, les guides et les explications sont rédigés par nos soins dans chaque langue.
Limites et corrections
Des données automatiques peuvent être fausses ou dépassées : un fournisseur peut changer un prix avant notre prochaine mise à jour, et tout test avantage certains types de modèles. Vérifiez toujours la page officielle du fournisseur avant une décision d’achat. Si vous repérez une erreur, signalez-la-nous et nous la corrigerons.