Biblioteca: última revisión editorial 29 jul 2026. Consulta la fuente original para comprobar su vigencia; el radar automático se actualiza por separado.

Biblioteca

Riesgo catastrófico

Documentos, normas e investigación sobre política de IA. Filtra por tema, ámbito o fuente; cada referencia conserva su fecha de revisión.

19 resultados · Los títulos de las fuentes conservan su idioma original; las síntesis editoriales están en español.

Punto de entrada operativo de la UE para la GPAI de riesgo sistémico: todos los proveedores de GPAI deben cumplir obligaciones sobre documentación, derechos de autor y contenido de entrenamiento; los modelos de riesgo sistémico añaden notificación, mitigación de riesgos, comunicación de incidentes y ciberseguridad.

Shaping Europe's Digital FutureGuíaUnión EuropeaRiesgo catastróficoInglésRevisado 29 Jul 2026

La mejor base científica actual sobre el riesgo de la IA avanzada de propósito general: capacidades, uso indebido, debate sobre la pérdida de control, técnicas de gestión de riesgos y lagunas de evidencia, respaldada por más de 30 países y organizaciones internacionales.

International AI Safety ReportInformeGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

La red de evaluación de modelos de frontera con la que comparar la arquitectura española: España participa en procesos internacionales de informes de seguridad y cuenta con AESIA para supervisar el AI Act, pero no figura públicamente entre sus miembros como instituto nacional de seguridad de la IA.

NISTPortalGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

La declaración internacional de 2023, que incluye a España entre los países representados, enmarca los riesgos de la IA de frontera como un problema internacional y reclama ciencia compartida, evaluación, transparencia y capacidad pública.

GOV.UKPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Un marco práctico de gestión de riesgos para organizaciones públicas y privadas: gobernar, identificar, medir y gestionar los riesgos de la IA, con un perfil de IA generativa de 2024 y trabajos sobre infraestructuras críticas en curso en 2026.

NISTGuíaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Encuesta a 2.778 investigadores en IA: la wiki recoge medianas del 5 %, 10 % y 5 % para tres formulaciones sobre extinción o pérdida grave de capacidad de decisión humana, y un 57,8 % asigna al menos un 5 % de probabilidad a impactos extremadamente negativos de la HLMI.

AI ImpactsAcadémicoGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

El trabajo de METR sobre horizontes de tareas hace legible la autonomía para la política pública: el artículo de marzo de 2025 estima una duplicación aproximada cada siete meses durante seis años; las estimaciones en vivo más recientes avanzan más rápido y deben interpretarse por separado.

METRInformeGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

El panel en vivo de METR sobre autonomía: horizontes temporales con fiabilidad del 50 % y 80 % para agentes de frontera públicos. La actualización del 8 de mayo de 2026 añade Claude Mythos Preview (preliminar), con estimaciones p50 de unas 17,4 horas y p80 de 3,1 horas, y advierte expresamente de que las mediciones superiores a 16 horas no son fiables con la batería actual.

METRHerramientaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Mapa útil para política pública de benchmarks de capacidades de frontera en razonamiento, programación, agentes, multimodalidad y otros dominios; ayuda a evitar la exageración basada en una única puntuación.

Epoch AIHerramientaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

FrontierMath

Primaria

Benchmark de matemáticas de nivel experto de Epoch AI, diseñado para evaluar razonamiento avanzado más allá de las pruebas estándar ya saturadas y respaldar una medición más rigurosa de capacidades.

Epoch AIAcadémicoGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Artículo de Nature sobre Humanity's Last Exam, un benchmark experto de 2.500 preguntas en distintas disciplinas; es útil porque muestra tanto un diseño de evaluación más exigente como la persistencia de la incertidumbre.

NatureAcadémicoGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Benchmark de Epoch AI para tareas agénticas en terminal y línea de comandos, un indicador útil de capacidades de operación de software, depuración y uso de herramientas.

Epoch AIHerramientaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

OSWorld

Primaria

Benchmark para agentes multimodales que realizan tareas abiertas en entornos informáticos reales; relevante para la IA en el sector público porque la autonomía implica cada vez más operar software, no solo generar texto.

OSWorldHerramientaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Herramientas concretas para evaluar capacidades autónomas peligrosas, incluidas orientaciones para baterías de tareas y un protocolo de ejemplo para medir el riesgo agéntico de modelos de frontera.

METRHerramientaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Fuente primaria de un laboratorio de frontera sobre categorías de riesgo grave, incluidas ciberseguridad, CBRN, persuasión, autonomía, evaluaciones, red teaming, notificación y controles de seguridad.

OpenAIPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Fuente de gobernanza de un laboratorio de frontera, de 28 de mayo de 2026, que vincula prácticas de seguridad y protección con requisitos legales emergentes, incluidos el Código de Buenas Prácticas para GPAI del AI Act de la UE, ciberseguridad, CBRN, manipulación, pérdida de control, notificación, protección y respuesta a incidentes.

OpenAIPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Fuente primaria de un laboratorio de frontera sobre la RSP v3.0 de Anthropic: sustituye el anterior umbral de pausa estricta por Frontier Safety Roadmaps públicos, objetivos, informes de riesgo, salvaguardas, evaluaciones y requisitos de seguridad.

AnthropicPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

El marco actualizado de seguridad de frontera de DeepMind añade niveles de capacidad supervisados y un proceso de gestión para riesgos graves derivados de modelos avanzados; útil para comparar la gobernanza de laboratorios con la supervisión pública.

Google DeepMindPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026

Declaración pública influyente de 2023 que contribuyó a introducir el riesgo de extinción en el debate general; debe leerse como señal de preocupación experta, no como sustituto de evidencia, legislación o diseño institucional.

Center for AI SafetyPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026