AI Safety Index été 2026 : neuf labos notés sur la sécurité et le risque
L'index de juillet 2026 du Future of Life Institute note neuf labos de pointe sur 37 indicateurs de sûreté et de sécurité. Aucun ne dépasse C+, et les cadres de sûreté manquent de mordant.
What is this?
Le 7 juillet 2026, le Future of Life Institute (FLI) a publié l’AI Safety Index — Summer 2026 Edition, quatrième volet d’une série qui note les entreprises d’IA de pointe sur leurs pratiques de sûreté et de sécurité. Il ne s’agit pas d’un rapport de vulnérabilité, mais d’un bulletin de notes : un panel indépendant de sept chercheurs et experts en gouvernance attribue des notes à neuf grands labos — Anthropic, OpenAI, Google DeepMind, Meta, xAI, Mistral, DeepSeek, Alibaba Cloud et Z.ai — sur 37 indicateurs répartis en six domaines.
Le constat principal : personne ne s’en sort bien. Le rapport complet, daté du 14 juillet, place Anthropic en tête avec un C+ (2,66 sur une échelle GPA de 4,0), OpenAI à C (2,28) et Google DeepMind à C (2,01). Meta obtient un D+, les deux labos chinois dont la note est publiée (Z.ai et Alibaba Cloud) un D-, tandis que xAI, DeepSeek et Mistral écopent d’une note éliminatoire. Les preuves ont été collectées jusqu’au 3 juin 2026 : les notes reflètent donc l’état des lieux à la mi-2026, pas un instantané en temps réel.
How the index scores labs
Les six domaines sont l’évaluation des risques (Risk Assessment), les préjudices actuels (Current Harms), les cadres de sûreté (Safety Frameworks), la sûreté existentielle (Existential Safety), la gouvernance et la responsabilité (Governance & Accountability) et le partage d’information (Information Sharing). Pour un lecteur sécurité, les indicateurs intéressants sont concrets plutôt qu’incantatoires : programmes de bug bounty sur les vulnérabilités système, tests de sécurité externes avant déploiement, revue indépendante des évaluations, évaluations de capacités dangereuses avec élicitation, protection des garde-fous contre le fine-tuning, réponse aux incidents majeurs, respect de la vie privée, et signalement des incidents graves aux autorités. Ce sont exactement les contrôles qu’un programme de sécurité fournisseur mature exigerait.
La méthode compte si vous voulez citer l’index. Le panel a examiné des documents publics — cartes de modèle, articles de recherche, résultats de benchmarks — complétés par un questionnaire ciblé sur les angles morts de transparence, comme la protection des lanceurs d’alerte et l’évaluation externe. Les évaluateurs ont attribué des notes par domaine selon des standards absolus, motivé leurs choix, puis les scores ont été moyennés ; les notes individuelles restent confidentielles. C’est un jugement d’experts, pas un benchmark automatisé : la valeur réside dans le raisonnement et les recommandations, pas dans un chiffre unique.
Anthropic domine cinq des six domaines, surtout grâce à sa transparence (il publie à la fois les spécifications de modèle et les prompts système) et à un cadre de sûreté relativement développé ; OpenAI mène désormais l’évaluation des risques grâce à des tests externes plus larges. Le domaine le plus faible de toute l’industrie est la sûreté existentielle, où aucune entreprise ne dépasse le C- et où la plupart stagnent à D ou en dessous.
Why it matters
Deux constats devraient préoccuper quiconque dépend de ces systèmes. D’abord, le panel juge que les cadres de sûreté manquent de mordant : même les labos qui ont publié ou actualisé un cadre à l’approche des échéances européennes et américaines manquent souvent de seuils quantitatifs, d’audits réellement indépendants, et d’une autorité interne clairement habilitée à stopper un déploiement. Ensuite, plusieurs acteurs de premier plan sont revenus sur leurs engagements de pause en cas de franchissement de lignes rouges de capacité — un schéma que les évaluateurs qualifient de « déplacement des poteaux » qui a « sapé les cadres de sûreté dans tout le secteur ».
Pour les défenseurs, l’index est utile précisément parce qu’il est neutre vis-à-vis des éditeurs et argumenté. Il donne aux équipes sécurité et achats une référence externe pour contrer les arguments marketing, et il nomme l’écart entre le discours et le comportement réel : le rapport note que la communication rassurante de plusieurs labos diverge de leur conduite commerciale et de leurs positions législatives. Comme le résume un membre du panel, Stuart Russell, les entreprises prévoient de plus en plus de « déployer [des systèmes] même quand c’est manifestement dangereux ».
Defenses
L’usage concret d’un tel rapport est d’alimenter l’évaluation du risque fournisseur. Le fil conducteur : se fier aux preuves, pas aux promesses.
- Reliez les domaines à vos propres contrôles. Traitez l’évaluation des risques et le partage d’information comme des indicateurs indirects de la maturité du red teaming et de la transparence sur les incidents, et pondérez-les selon votre cas d’usage.
- Réclamez ce que l’index dit manquant. Exigez des seuils de capacité quantitatifs, des auditeurs indépendants nommés, et l’identité de l’instance interne habilitée à arrêter un lancement — pas seulement un document-cadre.
- Vérifiez la durabilité des garde-fous. Confirmez comment un fournisseur protège ses garde-fous contre le fine-tuning et l’abus d’API, l’un des indicateurs explicites de l’index.
- Contrôlez les canaux d’incident et de divulgation. Exigez un engagement de signalement des incidents graves et un canal de bug bounty ou de divulgation opérationnel avant d’intégrer un modèle à des flux sensibles.
- Revérifiez à chaque édition. Les notes évoluent (Meta progresse, xAI recule) ; utilisez la tendance, pas un seul instantané, et réévaluez au renouvellement.
Status
| Aspect | Détail |
|---|---|
| Éditeur | Future of Life Institute (FLI) |
| Publication | 7 juillet 2026 (rapport complet daté du 14 juillet) |
| Périmètre | 9 labos, 37 indicateurs, 6 domaines |
| Arrêt des preuves | 3 juin 2026 |
| Meilleure note | Anthropic — C+ (2,66 / 4,0) |
| Notes éliminatoires | xAI, DeepSeek, Mistral |
| Type | Évaluation de sûreté indépendante — pas un avis de vulnérabilité |
À retenir : non pas une nouvelle attaque, mais un problème de mesure rendu explicite. Les engagements de sûreté que les entreprises se donnent constituent, selon la lecture du panel, un indicateur peu fiable de la sécurité réelle. L’index offre aux acheteurs et aux défenseurs un moyen structuré et sourcé d’interroger cet écart avant de dépendre d’un modèle.
Sources
- → https://futureoflife.org/ai-safety-index-summer-2026/
- → https://futureoflife.org/wp-content/uploads/2026/07/AI-Safety-Index-Summer-2026-Digital-14-Jul.pdf
- → https://time.com/article/2026/07/07/ai-safety-rankings-openai-anthropic-meta/
- → https://www.techtimes.com/articles/320959/20260719/ai-safety-grades-are-no-lab-tops-c-best-ones-are-retreating.htm