IA : en mars 2026, Anthropic revoit ses engagements de sécurité sur fond de controverses 马会
La revue de presse de LinuxFr.org publiée le 6 avril 2026 revient sur les développements de mars autour de l’IA : bras de fer judiciaire entre Anthropic et le gouvernement américain, révision des engagements de sécurité de l’entreprise et performances de nouveaux modèles. Elle met aussi en lumière les limites des évaluations et les risques liés aux usages juridiques, militaires et informatiques.
Anthropic revoit ses engagements de sécurité
En mars, le Département américain de la Défense a officiellement classé Anthropic comme un « risque pour la chaîne d’approvisionnement ». La décision a été contestée par l’entreprise, qui a obtenu une injonction préliminaire suspendant son application dans l’attente d’un jugement sur le fond. La revue de LinuxFr.org relève que la notification officielle était moins restrictive que les déclarations publiques antérieures : elle n’interdisait notamment pas aux sous-traitants du ministère de travailler avec Anthropic.
L’autre dossier important concerne la politique de développement responsable (RSP) de l’entreprise. Dans ses versions précédentes, celle-ci prévoyait de ralentir ou de suspendre le développement et le déploiement de modèles si les dispositifs de sécurité ne suivaient pas leur progression. La revue souligne que les évaluations d’Opus 4.6 ne permettaient plus d’écarter la possibilité d’atteindre le niveau de risque ASL-4, alors que les procédures correspondantes n’étaient pas encore établies.
La nouvelle version de la politique réduit la portée de plusieurs engagements unilatéraux. Anthropic explique que certaines exigences de sécurité avancées sont difficiles à satisfaire seule et dit vouloir maintenir des engagements jugés réalisables, tout en recensant les risques qui, selon elle, nécessitent une réponse collective du secteur. La revue présente ce changement comme un recul par rapport aux promesses antérieures, dans un contexte où une pause décidée par une seule entreprise lui paraît difficilement envisageable.
Des progrès annoncés, des évaluations à nuancer
Google DeepMind a présenté Gemini 3.1 Pro et OpenAI GPT 5.4. Selon la revue, les résultats publiés placent Gemini parmi les modèles de pointe, mais les retours d’usage mentionnés sont plus réservés. La fiche de sécurité de DeepMind est également jugée peu détaillée : elle indique que le modèle ne justifie pas de mes supplémentaires sans développer cette conclusion.
Sur FrontierMath, trois modèles — GPT 5.4, Opus 4.6 et Gemini 3.1 Pro — auraient résolu le premier problème ouvert du test, consacré aux hypergraphes de Ramsey. Opus 4.6 a aussi apporté une solution partielle à un problème mathématique sur lequel travaillait Donald Knuth. Ces résultats illustrent des avancées, mais d’autres évaluations rappellent que les performances annoncées ne disent pas tout.
Le test BrokenArXiv me notamment si un modèle sait repérer des théorèmes volontairement modifiés pour être faux. GPT 5.4 y obtient le meilleur résultat, avec un taux de réussite inférieur à 40 %. De son côté, METR estime que la moitié des solutions déclarées correctes par l’évaluation automatique de SWE-bench devraient être rejetées après examen humain. La revue précise toutefois que cette vérification manuelle applique des critères plus exigeants.
Cybersécurité, droit et usages sensibles
Plusieurs annonces concernent la sécurité informatique. Anthropic indique qu’Opus 4.6 a repéré 22 failles dans Firefox. OpenAI a présenté Codex Security, tandis que Shannon, un agent autonome de test d’intrusion, a été publié. En parallèle, un outil nommé Obliteratus vise à supprimer les protections de modèles dont les poids sont accessibles. La revue signale aussi des travaux sur les comportements offensifs possibles d’agents de programmation et rapporte qu’un module populaire d’OpenClaw était un logiciel malveillant.
Les usages juridiques suscitent également des inquiétudes. Un test manuel des capacités en droit place, selon la revue, les modèles d’Anthropic derrière Grok et certains modèles chinois accessibles en poids ouverts. Dans une affaire distincte rapportée par Reuters, OpenAI a été poursuivi après qu’un utilisateur, conseillé par ChatGPT, aurait déposé des plaintes fondées sur des décisions et des règles inexistantes, entraînant des frais de justice. Il s’agit d’une procédure judiciaire, et non d’une conclusion définitive sur la responsabilité de l’entreprise.
Enfin, la revue relaie des articles affirmant que Claude aurait été employé dans le conflit contre l’Iran, notamment pour identifier et hiérarchiser des cibles de bombardement. Cette utilisation est rapportée par des médias et n’est pas présentée comme une confirmation officielle dans le texte. Plus largement, les sujets recensés en mars vont des risques de désanonymisation en ligne aux erreurs de reconnaissance faciale, en passant par les effets des centres de données et les débats sur la place des outils génératifs dans le travail et le logiciel libre.
Source : LinuxFr.org : les contenus étiquetés avec « nouvelles_sur_l_ia » (linuxfr.org)
Article original : Consulter la source originale
Auteur : Moonz
