描述
gpt-oss-120b 是 OpenAI 的 gpt-oss 系列的一部分,旨在通过开源和开放科学推动和普及人工智能。该模型专为强大的推理和多功能开发者用例而设计,使其非常适合生产环境。
gpt-oss-120b 拥有 1170 亿个参数和 51 亿个活跃参数,针对需要高推理能力的通用任务进行了优化。它可以高效地在单个 80GB GPU 上运行,例如 NVIDIA H100 或 AMD MI300X,使开发者能够利用其能力,而无需大量硬件资源。
gpt-oss-120b 的一个关键特性是其宽松的 Apache 2.0 许可证,允许用户自由构建,而不受版权限制或专利风险。这使其成为实验、定制和商业部署的绝佳选择。此外,用户可以根据特定需求配置推理努力,提供低、中或高推理级别的选项,具体取决于所需的延迟和细节。
该模型提供完整的思维链访问,使用户能够理解模型的推理过程,从而更容易进行调试并增加对输出的信任。此外,gpt-oss-120b 可进行微调,允许开发者通过参数微调将模型定制为特定用例。
gpt-oss-120b 还具备代理能力,支持功能调用、网页浏览、Python 代码执行和结构化输出。这种多功能性使其适用于从网页浏览任务到更复杂的代理操作的广泛应用。该模型经过 MXFP4 量化后进行了后训练,确保在支持的硬件上高效运行。
总之,gpt-oss-120b 是一个强大的人工智能模型,结合了高推理能力、灵活性和易用性,是开发者在项目中实施先进人工智能解决方案的宝贵工具。
gpt-oss-120b亮点
1170 亿个参数
51 亿个活跃参数
Apache 2.0 许可证
可配置的推理努力
完整的思维链访问
可微调
代理能力
MXFP4 量化
gpt-oss-120b入门
访问页面:访问 gpt-oss-120b 的 Hugging Face 模型页面。
加载模型:使用 Hugging Face CLI 下载模型权重。
配置环境:设置您的环境并安装必要的依赖项。
集成:使用 Transformers 或 vLLM 进行部署。
微调:根据您的特定用例定制模型参数。
gpt-oss-120b的使用案例
- 网页浏览
- 功能调用
- 代理操作
- 微调
- 对话系统









