説明
OpenAIは、強力な実世界のパフォーマンスを低コストで提供する2つの最先端オープンウェイト言語モデル、gpt-oss-120bとgpt-oss-20bをリリースします。これらのモデルは柔軟なApache 2.0ライセンスの下で利用可能で、推論タスクにおいて同様のサイズのオープンモデルを上回ります。ツール使用能力が強力で、消費者ハードウェア上での効率的な展開に最適化されています。
gpt-oss-120bモデルは、コア推論ベンチマークでOpenAI o4-miniとほぼ同等の性能を達成し、単一の80 GB GPU上で効率的に動作します。gpt-oss-20bモデルは、一般的なベンチマークでOpenAI o3-miniと同様の結果を提供し、わずか16 GBのメモリでエッジデバイス上で動作できます。これにより、デバイス上での使用ケース、ローカル推論、または高価なインフラストラクチャなしでの迅速な反復に最適です。両モデルは、ツール使用、少数ショット関数呼び出し、思考の連鎖においても強力なパフォーマンスを発揮します。
安全性は、特にオープンモデルに対するOpenAIのモデルリリースアプローチの基盤です。gpt-ossモデルは包括的な安全トレーニングと評価を受けており、高い安全基準を満たしています。OpenAIは、初期のパートナーと協力して実世界のアプリケーションを探求し、これらのモデルを提供して開発者、企業、政府が自らのインフラストラクチャ上でAIを実行しカスタマイズできるようにしています。
gpt-ossモデルは、高度な事前トレーニングおよび事後トレーニング技術を使用して訓練され、推論、効率、さまざまな展開環境での使いやすさに焦点を当てています。各モデルは、パフォーマンスを最適化するためにエキスパートの混合を活用するトランスフォーマーです。モデルは、低、中、高の3つの推論努力をサポートしており、開発者はニーズに応じてパフォーマンスを調整できます。
両モデルの重みはHugging Faceで自由にダウンロード可能で、MXFP4でネイティブに量子化されています。これにより、効率的なメモリ使用が可能になり、モデルをローカルまたはサードパーティプロバイダーを通じて柔軟かつ簡単に実行できます。OpenAIは、健全なオープンモデルエコシステムを育成することにコミットしており、開発者や研究者がこれらの強力なツールを使って実験し革新することを奨励しています。
gpt-ossのハイライト
オープンウェイトモデル
Apache 2.0ライセンス
強力な推論能力
ツール使用サポート
カスタマイズ可能
効率的な展開
ローカル推論をサポート
エキスパートの混合アーキテクチャ
gpt-ossをはじめる
モデルにアクセス: OpenAIのウェブサイトにアクセスしてgpt-ossにアクセスします。
認証: モデルアクセスに必要な場合はアカウントを設定します。
環境を設定: 統合のために開発環境を準備します。
API経由で統合: 提供されたAPIを使用してgpt-ossをアプリケーションに統合します。
最適化: 特定の使用ケースに基づいてパフォーマンスのためにモデルパラメータを調整します。
gpt-ossの使用例
- デバイス上のAI
- ローカル推論
- 迅速な反復
- ツール統合
- カスタムAIソリューション






