설명
OpenAI는 강력한 실제 성능을 저렴한 비용으로 제공하는 두 개의 최첨단 오픈 가중치 언어 모델인 gpt-oss-120b와 gpt-oss-20b를 출시합니다. 이 모델들은 유연한 Apache 2.0 라이선스 하에 제공되며, 추론 작업에서 유사한 크기의 오픈 모델보다 뛰어난 성능을 발휘합니다. 이들은 강력한 도구 사용 능력을 보여주며 소비자 하드웨어에서 효율적인 배포를 위해 최적화되어 있습니다.
gpt-oss-120b 모델은 단일 80 GB GPU에서 효율적으로 실행되면서 OpenAI o4-mini와 핵심 추론 벤치마크에서 거의 동등한 성능을 달성합니다. gpt-oss-20b 모델은 일반 벤치마크에서 OpenAI o3-mini와 유사한 결과를 제공하며, 단 16 GB의 메모리로 엣지 장치에서 실행될 수 있습니다. 이는 장치 내 사용 사례, 로컬 추론 또는 비용이 많이 드는 인프라 없이 신속한 반복에 이상적입니다. 두 모델 모두 도구 사용, 소수 샷 함수 호출 및 사고의 연쇄 추론에서 강력한 성능을 발휘합니다.
안전성은 OpenAI의 모델 출시 접근 방식의 기초입니다. 특히 오픈 모델에 대해 더욱 그렇습니다. gpt-oss 모델은 포괄적인 안전 교육과 평가를 거쳐 높은 안전 기준을 충족하도록 보장됩니다. OpenAI는 초기 파트너와 협력하여 실제 애플리케이션을 탐색하고, 이러한 모델을 제공하여 개발자, 기업 및 정부가 자신의 인프라에서 AI를 실행하고 사용자 맞춤화할 수 있도록 지원합니다.
gpt-oss 모델은 다양한 배포 환경에서 추론, 효율성 및 사용성을 중심으로 고급 사전 훈련 및 후 훈련 기술을 사용하여 훈련되었습니다. 각 모델은 성능을 최적화하기 위해 전문가 혼합을 활용하는 변환기입니다. 이 모델들은 낮음, 중간, 높음의 세 가지 추론 노력을 지원하여 개발자가 필요에 따라 성능을 조정할 수 있도록 합니다.
두 모델의 가중치는 Hugging Face에서 무료로 다운로드할 수 있으며, MXFP4에서 본래 양자화되어 제공됩니다. 이는 효율적인 메모리 사용을 가능하게 하여 모델을 유연하고 로컬 또는 제3자 제공자를 통해 쉽게 실행할 수 있도록 합니다. OpenAI는 건강한 오픈 모델 생태계를 조성하기 위해 노력하고 있으며, 개발자와 연구자가 이러한 강력한 도구로 실험하고 혁신할 수 있도록 장려합니다.
gpt-oss 하이라이트
오픈 가중치 모델
Apache 2.0 라이선스
강력한 추론 능력
도구 사용 지원
사용자 맞춤화 가능
효율적인 배포
로컬 추론 지원
전문가 혼합 아키텍처
gpt-oss 시작하기
모델 접근: OpenAI 웹사이트를 방문하여 gpt-oss에 접근합니다.
인증: 모델 접근을 위해 계정을 설정합니다.
환경 설정: 통합을 위한 개발 환경을 준비합니다.
API를 통한 통합: 제공된 API를 사용하여 gpt-oss를 애플리케이션에 통합합니다.
최적화: 특정 사용 사례에 따라 성능을 위해 모델 매개변수를 조정합니다.
gpt-oss의 사용 사례
- 장치 내 AI
- 로컬 추론
- 신속한 반복
- 도구 통합
- 맞춤형 AI 솔루션






