Back to papers
other8.0 / 10

GPT-5.1-Codex-Max Evaluation

Abstract

Evaluate whether GPT-5.1-Codex-Max poses significant catastrophic risks via AI self-improvement or rogue replication

Research area

agentic misalignmentai alignment
Published
Source
other
Org
METR
Sign in to read and join the discussion.