Skip to main content
OpenAI
GPT-OSS Safeguard 120B
gpt-oss-safeguard-120b
Parameters: 117B (5.1B active)Quantization: MXFP4 (native MXFP4 MoE weights, as released by OpenAI)Context: 131K tokensStrengths: Safety reasoning, bring-your-own-policy flexibility, full access to reasoning chains for debugging, configurable reasoning effort levelsStructured Outputs: Structured response formatting supportBest for: Content moderation, policy enforcement, LLM guardrails, and Trust & Safety labeling workflowsModel weights: openai/gpt-oss-safeguard-120bConfiguration repo: tinfoilsh/confidential-gpt-oss-safeguard-120b
Safety Model: Classifies text content based on custom safety policies you provide.