Biblioteca: última revisión editorial 29 jul 2026. Consulta la fuente original para comprobar su vigencia; el radar automático se actualiza por separado.
Biblioteca
Riesgo catastrófico
Documentos, normas e investigación sobre política de IA. Filtra por tema, ámbito o fuente; cada referencia conserva su fecha de revisión.
19 resultados · Los títulos de las fuentes conservan su idioma original; las síntesis editoriales están en español.
Punto de entrada operativo de la UE para la GPAI de riesgo sistémico: todos los proveedores de GPAI deben cumplir obligaciones sobre documentación, derechos de autor y contenido de entrenamiento; los modelos de riesgo sistémico añaden notificación, mitigación de riesgos, comunicación de incidentes y ciberseguridad.
Shaping Europe's Digital FutureGuíaUnión EuropeaRiesgo catastróficoInglésRevisado 29 Jul 2026
La mejor base científica actual sobre el riesgo de la IA avanzada de propósito general: capacidades, uso indebido, debate sobre la pérdida de control, técnicas de gestión de riesgos y lagunas de evidencia, respaldada por más de 30 países y organizaciones internacionales.
International AI Safety ReportInformeGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026
La red de evaluación de modelos de frontera con la que comparar la arquitectura española: España participa en procesos internacionales de informes de seguridad y cuenta con AESIA para supervisar el AI Act, pero no figura públicamente entre sus miembros como instituto nacional de seguridad de la IA.
La declaración internacional de 2023, que incluye a España entre los países representados, enmarca los riesgos de la IA de frontera como un problema internacional y reclama ciencia compartida, evaluación, transparencia y capacidad pública.
Un marco práctico de gestión de riesgos para organizaciones públicas y privadas: gobernar, identificar, medir y gestionar los riesgos de la IA, con un perfil de IA generativa de 2024 y trabajos sobre infraestructuras críticas en curso en 2026.
Encuesta a 2.778 investigadores en IA: la wiki recoge medianas del 5 %, 10 % y 5 % para tres formulaciones sobre extinción o pérdida grave de capacidad de decisión humana, y un 57,8 % asigna al menos un 5 % de probabilidad a impactos extremadamente negativos de la HLMI.
AI ImpactsAcadémicoGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026
El trabajo de METR sobre horizontes de tareas hace legible la autonomía para la política pública: el artículo de marzo de 2025 estima una duplicación aproximada cada siete meses durante seis años; las estimaciones en vivo más recientes avanzan más rápido y deben interpretarse por separado.
El panel en vivo de METR sobre autonomía: horizontes temporales con fiabilidad del 50 % y 80 % para agentes de frontera públicos. La actualización del 8 de mayo de 2026 añade Claude Mythos Preview (preliminar), con estimaciones p50 de unas 17,4 horas y p80 de 3,1 horas, y advierte expresamente de que las mediciones superiores a 16 horas no son fiables con la batería actual.
Mapa útil para política pública de benchmarks de capacidades de frontera en razonamiento, programación, agentes, multimodalidad y otros dominios; ayuda a evitar la exageración basada en una única puntuación.
Benchmark de matemáticas de nivel experto de Epoch AI, diseñado para evaluar razonamiento avanzado más allá de las pruebas estándar ya saturadas y respaldar una medición más rigurosa de capacidades.
Artículo de Nature sobre Humanity's Last Exam, un benchmark experto de 2.500 preguntas en distintas disciplinas; es útil porque muestra tanto un diseño de evaluación más exigente como la persistencia de la incertidumbre.
Benchmark de Epoch AI para tareas agénticas en terminal y línea de comandos, un indicador útil de capacidades de operación de software, depuración y uso de herramientas.
Benchmark para agentes multimodales que realizan tareas abiertas en entornos informáticos reales; relevante para la IA en el sector público porque la autonomía implica cada vez más operar software, no solo generar texto.
Herramientas concretas para evaluar capacidades autónomas peligrosas, incluidas orientaciones para baterías de tareas y un protocolo de ejemplo para medir el riesgo agéntico de modelos de frontera.
Fuente primaria de un laboratorio de frontera sobre categorías de riesgo grave, incluidas ciberseguridad, CBRN, persuasión, autonomía, evaluaciones, red teaming, notificación y controles de seguridad.
Fuente de gobernanza de un laboratorio de frontera, de 28 de mayo de 2026, que vincula prácticas de seguridad y protección con requisitos legales emergentes, incluidos el Código de Buenas Prácticas para GPAI del AI Act de la UE, ciberseguridad, CBRN, manipulación, pérdida de control, notificación, protección y respuesta a incidentes.
Fuente primaria de un laboratorio de frontera sobre la RSP v3.0 de Anthropic: sustituye el anterior umbral de pausa estricta por Frontier Safety Roadmaps públicos, objetivos, informes de riesgo, salvaguardas, evaluaciones y requisitos de seguridad.
El marco actualizado de seguridad de frontera de DeepMind añade niveles de capacidad supervisados y un proceso de gestión para riesgos graves derivados de modelos avanzados; útil para comparar la gobernanza de laboratorios con la supervisión pública.
Google DeepMindPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026
Declaración pública influyente de 2023 que contribuyó a introducir el riesgo de extinción en el debate general; debe leerse como señal de preocupación experta, no como sustituto de evidencia, legislación o diseño institucional.
Center for AI SafetyPolítica públicaGlobalRiesgo catastróficoInglésRevisado 29 Jul 2026