gpt-oss-safeguard
Family overview — summarizes releases; licenses and availability belong to each release.
gpt-oss-safeguard is a pair of open-weight, text-only reasoning models from OpenAI, gpt-oss-safeguard-120b and gpt-oss-safeguard-20b, post-trained from the corresponding gpt-oss models to classify content against a policy that the user supplies. OpenAI's technical report is dated October 29, 2025. OpenAI lists the models as a model partner of the Robust Open Online Safety Tools (ROOST) Model Community, a group of safety practitioners working with open models.1234
- Repository: gpt-oss-safeguard repository (external site: github.com)
- Model hub: gpt-oss-safeguard-120b on Hugging Face (external site: huggingface.co)
- Model hub: gpt-oss-safeguard-20b on Hugging Face (external site: huggingface.co)
- Paper: Technical report (PDF) (external site: cdn.openai.com)
- Documentation: gpt-oss-safeguard user guide (external site: developers.openai.com)
Releases assessed
| Release | Weights | Tier (USASI rubric v0.2) | License | Released |
|---|---|---|---|---|
| gpt-oss-safeguard-120b | Weights: Public | Model-disclosure tier (USASI rubric v0.2): Open-weight | Apache-2.0, Apache-2.0 | Oct 2025 |
| gpt-oss-safeguard-20b | Weights: Public | Model-disclosure tier (USASI rubric v0.2): Open-weight | Apache-2.0, Apache-2.0 | Oct 2025 |
What it is useful for
Organization context
Provenance and derivatives
U.S. eligibility
Sources
This listing is not an endorsement, a safety assessment, or a federal approval.