Share this page

DoomBench social sharing card for AISI finds Claude sabotage-continuation failures only in controlled simulations.
  1. DoomBench assesses “AISI finds Claude sabotage-continuation failures only in controlled simulations” as evidence moving toward doom, with magnitude 34 and confidence 82 out of 100 in the safety and alignment category.

  2. The DoomBench assessment of “AISI finds Claude sabotage-continuation failures only in controlled simulations” is based on reporting from UK AI Security Institute and records the editorial rationale, source quality, attribution, and...

  3. DoomBench summarizes “AISI finds Claude sabotage-continuation failures only in controlled simulations” as follows: In 297 simulated internal-research scenarios, UK AISI found no spontaneous sabotage by four Claude models. Under seeded...

    https://www.doombench.com/news/aisi-finds-claude-sabotage-continuation-failures-only-in-controlled-simulations-2026-04-27