OpenAI releases gpt-oss-safeguard β open-weight safety reasoning models
OpenAI released gpt-oss-safeguard-120b and gpt-oss-safeguard-20b, research preview open-weight models for policy-based safety classification. The models use chain-of-thought reasoning to interpret developer-defined policies at inference time, supporting evolving-risk domains and multi-policy classification. Available under Apache 2.0 license.