Nota: esta página es una traducción automática y puede contener errores o frases poco naturales. Si algo no queda claro, consulta el original en inglés.
Horizonte temporal 1.1 (actual)
Sigue la misma metodología del artículo inicial, pero con un conjunto de tareas más grande. Véase el anuncio de publicación.
Horizonte temporal 1.0 (marzo de 2025)
Cálculos originales del horizonte temporal. Calculados para modelos de 2019 a noviembre de 2025, siguiendo los métodos descritos en el artículo original.

Evaluación de riesgos

Evaluamos los riesgos que pueden plantear los sistemas de IA de frontera. Este trabajo incluye el Informe de riesgos de frontera, revisiones independientes de las evaluaciones de riesgos de los desarrolladores de IA y evaluaciones de capacidades de modelos de frontera.

METR no recibe remuneración por este trabajo.

Empresas como Anthropic, OpenAI y xAI han facilitado acceso y tokens para nuestras evaluaciones, investigación e ingeniería.

Breve investigación independiente sobre el comportamiento, el razonamiento y la colaboración de los agentes en el incidente de hackeo de OpenAI / Hugging Face

26 de agosto de 2026 •
Colaboración

Informe de riesgos de frontera (febrero–marzo de 2026)

19 de mayo de 2026 •
Colaboración

Revisión del informe Anthropic (feb. 2026): riesgos de I+D automatizada

8 de mayo de 2026 •
Colaboración

Red-teaming de los sistemas internos de monitoreo de agentes de Anthropic

26 de marzo de 2026 •
Colaboración

Revisión del Informe de riesgos de sabotaje de Anthropic: Claude Opus 4.6

12 de marzo de 2026 •
Colaboración

Revisión del Informe piloto de riesgos de sabotaje de Anthropic, verano de 2025

28 de octubre de 2025 •
Colaboración

Resumen de nuestra revisión de la metodología de gpt-oss

23 de octubre de 2025 •
Colaboración

Claude Opus 5.5

22 de septiembre de 2026 •
Colaboración

GPT-5.6 Sol

26 de junio de 2026 •
Colaboración

GPT-5.1-Codex-Max

19 de noviembre de 2025 •
Colaboración

GPT-5

7 de agosto de 2025 •
Colaboración

OpenAI o3 and o4-mini

16 de abril de 2025 •
Colaboración

Claude 3.7

4 de abril de 2025 •
Colaboración

GPT-4.5

27 de febrero de 2025 •
Colaboración

Claude 3.5 Sonnet and o1

31 de enero de 2025 •
Colaboración

Claude 3.5 Sonnet (original)

30 de octubre de 2024 •
Colaboración

o1-preview

12 de septiembre de 2024 •
Colaboración

GPT-4o

7 de agosto de 2024 •
Colaboración

GPT-4 and Claude

17 de marzo de 2023 •
Colaboración

Ver todas las evaluaciones

Políticas de seguridad de IA de frontera

Asesoramos a desarrolladores de IA y gobiernos en la implementación de metodologías para evaluar riesgos de IA. Por ejemplo, hemos asesorado a desarrolladores sobre políticas de seguridad de IA de frontera.

Recursos sobre FSP

Recientes