IA: En marzo de 2026, Anthropic revisará sus compromisos de seguridad en medio de controversias.
El informe de prensa de LinuxFr.org, publicado el 6 de abril de 2026, repasa los acontecimientos de marzo relacionados con la IA: la batalla legal entre Anthropic y el gobierno estadounidense, la revisión de los compromisos de seguridad de la empresa y el rendimiento de los nuevos modelos. Asimismo, destaca las limitaciones de las evaluaciones y los riesgos asociados a las aplicaciones legales, militares y de TI.
Anthropic está revisando sus compromisos de seguridad.
En marzo, el Departamento de Defensa de EE. UU. clasificó oficialmente a Anthropic como un « riesgo para la cadena de suministro ». La empresa impugnó la decisión y obtuvo una orden judicial preliminar que suspendió su implementación a la espera de una resolución definitiva. LinuxFr.org señala que la notificación oficial fue menos restrictiva que las declaraciones públicas anteriores: en particular, no prohibió a los subcontratistas del Departamento de Defensa trabajar con Anthropic.
Otro aspecto importante se refiere a la Política de Desarrollo Responsable (PDR) de la empresa. En versiones anteriores, esta política estipulaba ralentizar o suspender el desarrollo y la implementación de modelos si las medidas de seguridad no evolucionaban al mismo ritmo. La revisión destaca que las evaluaciones en Opus 4.6 ya no descartaban la posibilidad de alcanzar el nivel de riesgo ASL-4, a pesar de que aún no se habían establecido los procedimientos correspondientes.
La nueva versión de la política reduce el alcance de varios compromisos unilaterales. Anthropic explica que algunos requisitos de seguridad avanzados son difíciles de cumplir en solitario y afirma que desea mantener los compromisos que considera alcanzables, al tiempo que identifica los riesgos que, a su juicio, requieren una respuesta colectiva del sector. El informe presenta este cambio como un retroceso respecto a las promesas anteriores, en un contexto en el que una pausa decidida por una sola empresa parece prácticamente inconcebible.
Se han anunciado avances, pero las evaluaciones deben matizarse.
Google DeepMind presentó Gemini 3.1 Pro y OpenAI GPT 5.4. Según la reseña, los resultados publicados sitúan a Gemini entre los mejores modelos, pero la retroalimentación de los usuarios es más reservada. El informe de seguridad de DeepMind también se considera insuficientemente detallado: afirma que el modelo no justifica una investigación más profunda sin explicar esta conclusión.
En FrontierMath, tres modelos —GPT 5.4, Opus 4.6 y Gemini 3.1 Pro— resolvieron el primer problema abierto de la prueba, relacionado con hipergrafos de Ramsey. Opus 4.6 también proporcionó una solución parcial a un problema matemático en el que trabajaba Donald Knuth. Estos resultados ilustran el progreso, pero otras evaluaciones nos recuerdan que el rendimiento anunciado no lo dice todo.
La prueba BrokenArXiv, en particular, detecta si un modelo puede identificar teoremas modificados deliberadamente para ser falsos. GPT 5.4 obtiene el mejor resultado, con una tasa de éxito inferior al 40 %. METR, por su parte, estima que la mitad de las soluciones declaradas correctas por la evaluación automática de SWE-bench deberían rechazarse tras una revisión humana. Sin embargo, la revisión especifica que esta verificación manual aplica criterios más estrictos.
Ciberseguridad, legislación y usos sensibles
Varios anuncios se refieren a la seguridad informática. Anthropic informa que Opus 4.6 ha identificado 22 vulnerabilidades en Firefox. OpenAI presentó Codex Security, mientras que Shannon, un agente autónomo de pruebas de penetración, fue lanzado. Paralelamente, una herramienta llamada Obliteratus busca eliminar las protecciones de los modelos cuyos pesos son accesibles. La revista también destaca trabajos sobre el posible comportamiento ofensivo de los agentes programáticos e informa que un módulo popular de OpenClaw era malware.
Las prácticas legales también generan preocupación. Según la revisión, una prueba manual de capacidad legal sitúa a los modelos de Anthropic por detrás de Grok y algunos modelos chinos disponibles en Open Weights. En un caso aparte, reportado por Reuters, OpenAI fue demandada después de que un usuario, asesorado por ChatGPT, supuestamente presentara quejas basadas en resoluciones y normas inexistentes, lo que generó gastos legales. Se trata de un proceso judicial, no de una conclusión definitiva sobre la responsabilidad de la empresa.
Finalmente, la revista reproduce artículos que afirman que Claude fue utilizado en el conflicto contra Irán, en particular para identificar y priorizar objetivos de bombardeo. Este uso es reportado por medios de comunicación y no se presenta como confirmación oficial en el texto. En términos más generales, los temas tratados en marzo abarcan desde los riesgos de la desanonimización en línea y los errores de reconocimiento facial hasta los efectos de los centros de datos y los debates sobre el papel de las herramientas generativas en el trabajo y el software libre.
Fuente: LinuxFr.org: contenido etiquetado con « news_about_AI » (linuxfr.org)
Artículo original: Ver la fuente original
Autor: Moonz
