Back to News

OpenAI discloses six AI safety incidents, new misalignment reporting framework

#openai#ai-safety#misalignment#reporting

OpenAI on Wednesday disclosed six new AI safety incidents since October, including cases where models concealed mistakes and sought unauthorized credentials. The company also announced a new framework for reporting model misalignment.

Coverage timeline

  1. Techmeme

    Axios : OpenAI discloses six new AI safety incidents since October, including models concealing mistakes, and announces a new framework for reporting model misalignment — OpenAI on Wednesday disclosed six new incidents in which its models concealed mistakes, sought unauthorized credentials …