Résumé exécutif
Le référentiel de lancement couvre six grands développeurs d’IA et entreprises technologiques présents dans le corpus vérifié. Il inventorie, selon une fenêtre de preuves commune, les cadres officiels de gouvernance, les politiques de sécurité, les rapports de transparence, la documentation des modèles et les positions réglementaires déclarées. Les graphiques montrent uniquement la couverture documentaire ; ils ne classent pas la performance des entreprises.
La grille publique de comparabilité définit six dimensions et quatre états de preuve. Les documents produits par les entreprises sont enregistrés comme informations attribuables de niveau 3, tandis que les constatations des régulateurs, les évaluations indépendantes et les incidents restent des catégories de preuves distinctes. Aucune entreprise ne reçoit de score tant que les preuves de chaque dimension admissible n’ont pas achevé l’examen humain selon la même date limite et que l’édition notée n’a pas été explicitement publiée.
Processus publiés de gouvernance et de gestion des risques
Le référentiel enregistre les cadres nommés, les structures responsables, les seuils d’escalade, les mécanismes d’examen et les domaines de risque déclarés lorsque la source principale les divulgue. Les engagements généraux restent séparés des procédures opérationnelles et des preuves de mise en œuvre.
Les obligations juridiques et les constatations des régulateurs sont reliées comme dossiers externes plutôt que reformulées en déclarations de l’entreprise. Cette approche préserve à la fois l’attribution et la distinction entre gouvernance volontaire et conformité obligatoire.
Transparence et documentation des modèles
Les fiches système, fiches de modèles, rapports de transparence, politiques de sécurité et pratiques de mise à jour substantielle sont suivis comme types de preuves distincts. Un cadre au niveau de l’entreprise ne renseigne pas automatiquement une évaluation au niveau du modèle, et une seule fiche de modèle n’établit pas une pratique à l’échelle de l’entreprise.
Le graphique du corpus compte les dossiers de preuves primaires vérifiés par entreprise et par type de source. Il ne transforme pas les mots, les pages ou les affirmations commerciales en preuves supplémentaires.
Limites d’interprétation
La divulgation publique varie selon l’entreprise, le produit et la juridiction. Les structures d’entreprise diffèrent aussi : un développeur de modèles filiale et une société cotée diversifiée peuvent publier leurs preuves à des niveaux organisationnels différents. La comparabilité repose sur des définitions stables, des fenêtres de preuves équivalentes et des périmètres d’entités explicites.
Le référentiel facilite donc la diligence raisonnable au niveau des sources et l’identification des lacunes. Il ne constitue ni une certification, ni un conseil en investissement, ni une constatation de conformité juridique.
Cohorte et fenêtre de preuves
La cohorte initiale contient les six dossiers d’entreprise vérifiés du corpus de lancement. L’inclusion signifie qu’une entreprise dispose d’une source principale attribuable et d’un dossier d’entité ; elle ne signifie ni approbation, ni pratique supérieure, ni divulgation complète.
Chaque comparaison utilise la date limite de l’édition et la source admissible la plus récente collectée au plus tard à cette date. Les publications ultérieures entrent dans une mise à jour postérieure ou une révision documentée, plutôt que de modifier silencieusement la fenêtre de preuves.
Grille publique de comparabilité
La grille applique six dimensions : (1) la responsabilité et la supervision, notamment les structures de gouvernance nommées et les droits de décision ; (2) la gouvernance des risques, notamment les processus définis pour identifier, faire remonter et traiter les risques liés à l’IA ; (3) la documentation des modèles et systèmes, notamment l’usage prévu, les limites et les changements substantiels ; (4) les essais et l’évaluation, notamment les méthodes documentées et les évaluateurs responsables ; (5) la réponse aux incidents et le signalement externe, notamment les processus d’escalade, de notification et d’action corrective ; et (6) la transparence de la mise en œuvre, notamment les preuves que la politique publiée est opérationnalisée.
Les dimensions sont appliquées de manière cohérente à chaque entreprise. Une source ne peut étayer plusieurs dimensions que si la preuve citée est propre à chaque affirmation.
États de preuve, sans performance déduite
« Documenté » signifie qu’une preuve admissible étaye directement l’élément de la grille. « Partiellement documenté » signifie que la source ne couvre qu’une partie de l’élément. « Non documenté dans la fenêtre de preuves » signifie que les examinateurs n’ont trouvé aucune source admissible à l’appui avant la date limite. « Non évalué » signifie que la collecte ou l’examen des preuves est incomplet.
« Non documenté » ne prouve pas l’absence d’une pratique, et « documenté » ne prouve pas son efficacité. Ces états rendent visible la comparabilité de la divulgation sans transformer le volume de communication publique en score de performance.
Examen humain et seuil de publication des scores
Un résultat numérique ne peut être créé qu’après l’archivage des preuves admissibles, leur rattachement à la grille, l’examen de leur attribution et leur évaluation selon la même date limite. Les notes des examinateurs doivent distinguer les déclarations de première partie, les évaluations indépendantes et les preuves d’exécution.
Cette édition publie la grille et la couverture des preuves, mais aucun score d’entreprise. Une édition notée ultérieure devra publier ses pondérations, son traitement des preuves manquantes, son protocole d’examen et sa politique de révision avant d’afficher des classements.
Graphiques et données
- Anthropic
- 1
- Google DeepMind
- 1
- Meta
- 1
- Microsoft
- 1
- NVIDIA
- 1
- OpenAI
- 1
Entreprises de la cohorte du référentiel regroupées selon le nombre de dossiers de preuves primaires vérifiés.
- Rapport d’entreprise
- 5
- Fiche de modèle
- 1
Dossiers de preuves d’entreprise vérifiés regroupés par type de source.
- Entreprises dans le périmètre
- 6
- Champs de gouvernance renseignés
- 6
- Champs de sécurité renseignés
- 6
- Champs de transparence renseignés
- 6
6 entreprises sont dans le périmètre ; 6 ont un champ de gouvernance, 6 un champ de sécurité et 6 un champ de transparence renseignés à partir de sources vérifiées.
Méthodologie
La cohorte du référentiel correspond aux entités d’entreprise vérifiées incluses dans l’édition. Les preuves admissibles comprennent les rapports officiels et la documentation technique des entreprises, les dossiers réglementaires ou juridiques de niveau 1 et les évaluations indépendantes de niveau 2 assorties de méthodes attribuables. Les médias sont exclus des preuves principales. Toutes les entreprises utilisent la même date limite, les mêmes définitions de dimensions et les mêmes règles d’admissibilité des sources.
Les six dimensions de comparabilité sont la responsabilité et la supervision ; la gouvernance des risques ; la documentation des modèles et systèmes ; les essais et l’évaluation ; la réponse aux incidents et le signalement externe ; et la transparence sur la mise en œuvre des politiques. Chaque dimension reçoit l’un des états suivants : documenté, partiellement documenté, non documenté dans la fenêtre de preuves ou non évalué. Ces états décrivent la disponibilité des preuves et ne constituent pas des scores numériques. Tout score futur exige l’approbation des examinateurs, des citations au niveau des sources et une méthode de notation publiée séparément.
Références
- Règlement (UE) 2024/1689 — Règlement sur l’intelligence artificielleUnion européenne · Niveau 1 · 12 juil. 2024
- SB-53 — Modèles d’intelligence artificielle : grands développeursInformation législative de Californie · Niveau 1 · 29 sept. 2025
- La NHTSA annonce une ordonnance par consentement avec Cruise après la communication incomplète d’un accident impliquant un piétonAdministration nationale de la sécurité routière · Niveau 1 · 30 sept. 2024
- Cadre de gouvernance des modèles de pointe d’OpenAIOpenAI · Niveau 3 · 28 mai 2026
- Politique de mise à l’échelle responsable d’AnthropicAnthropic · Niveau 3 · 29 avr. 2026
- Fiche du modèle Gemini 3.5 FlashGoogle DeepMind · Niveau 3 · 19 mai 2026
- Rapport 2025 sur la transparence en matière d’IA responsableMicrosoft · Niveau 3 · 20 juin 2025
- Principes d’IA responsable chez MetaMeta · Niveau 3 · 9 août 2026
- IA digne de confiance de NVIDIANVIDIA · Niveau 3 · 9 août 2026