描述
OpenAI 正在发布 gpt-oss-120b 和 gpt-oss-20b,这两个最先进的开放权重语言模型在低成本下提供强大的现实世界性能。这些模型在灵活的 Apache 2.0 许可下提供,并在推理任务上超越了同等规模的开放模型。它们展示了强大的工具使用能力,并针对消费者硬件的高效部署进行了优化。
gpt-oss-120b 模型在核心推理基准测试中与 OpenAI o4-mini 达到了近乎平等的水平,同时在单个 80 GB GPU 上高效运行。gpt-oss-20b 模型在常见基准测试中提供了与 OpenAI o3-mini 相似的结果,并且可以在仅有 16 GB 内存的边缘设备上运行。这使其非常适合于设备上的使用案例、本地推理或在没有高成本基础设施的情况下进行快速迭代。这两个模型在工具使用、少量示例函数调用和思维链推理方面也表现出色。
安全性是 OpenAI 发布模型方法的基础,尤其是对于开放模型。gpt-oss 模型经过全面的安全培训和评估,确保它们符合高安全标准。OpenAI 还与早期合作伙伴合作,探索现实世界的应用,提供这些模型以使开发者、企业和政府能够在自己的基础设施上运行和定制 AI。
gpt-oss 模型使用先进的预训练和后训练技术进行训练,专注于推理、效率和在各种部署环境中的可用性。每个模型都是一个利用专家混合的 Transformer,以优化性能。模型支持三种推理努力——低、中、高——允许开发者根据他们的需求调整性能。
这两个模型的权重可以在 Hugging Face 上免费下载,并以 MXFP4 原生量化格式提供。这允许高效的内存使用,使模型灵活且易于在本地或通过第三方提供商运行。OpenAI 致力于促进健康的开放模型生态系统,鼓励开发者和研究人员使用这些强大的工具进行实验和创新。
gpt-oss亮点
开放权重模型
Apache 2.0 许可
强大的推理能力
工具使用支持
可定制
高效部署
支持本地推理
专家混合架构
gpt-oss入门
访问模型:访问 OpenAI 网站以获取 gpt-oss。
身份验证:如果需要模型访问,请设置帐户。
设置环境:准备您的开发环境以进行集成。
通过 API 集成:使用提供的 API 将 gpt-oss 集成到您的应用程序中。
优化:根据您的特定用例调整模型参数以提高性能。
gpt-oss的使用案例
- 设备上的 AI
- 本地推理
- 快速迭代
- 工具集成
- 定制 AI 解决方案






