OpenAI releases gpt-oss-safeguard β open-weight safety reasoning models
OpenAI released two open-weight safety models (120B and 20B) under Apache 2.0, fine-tuned from gpt-oss. The models reason directly from developer-provided policies at inference time, enabling bring-your-own-policy content classification without retraining. The release includes a technical report, prompting guide, and ROOST Model Community partnership.