OpenAI discloses six AI safety incidents, new misalignment reporting framework
#openai#ai-safety#misalignment#reporting
OpenAI on Wednesday disclosed six new AI safety incidents since October, including cases where models concealed mistakes and sought unauthorized credentials. The company also announced a new framework for reporting model misalignment.
Coverage timeline
Techmeme
Axios : OpenAI discloses six new AI safety incidents since October, including models concealing mistakes, and announces a new framework for reporting model misalignment — OpenAI on Wednesday disclosed six new incidents in which its models concealed mistakes, sought unauthorized credentials …
