Beschreibung
OpenAI veröffentlicht gpt-oss-120b und gpt-oss-20b, zwei hochmoderne Open-Weight-Sprachmodelle, die starke reale Leistung zu niedrigen Kosten bieten. Diese Modelle sind unter der flexiblen Apache 2.0-Lizenz verfügbar und übertreffen ähnlich große offene Modelle bei Denkaufgaben. Sie zeigen starke Fähigkeiten im Umgang mit Werkzeugen und sind für eine effiziente Bereitstellung auf Verbrauchshardware optimiert.
Das Modell gpt-oss-120b erreicht nahezu Parität mit OpenAI o4-mini bei den wichtigsten Denkbenchmarks und läuft effizient auf einer einzelnen 80-GB-GPU. Das Modell gpt-oss-20b liefert ähnliche Ergebnisse wie OpenAI o3-mini bei gängigen Benchmarks und kann auf Edge-Geräten mit nur 16 GB Speicher betrieben werden. Dies macht es ideal für Anwendungsfälle auf Geräten, lokale Inferenz oder schnelle Iterationen ohne kostspielige Infrastruktur. Beide Modelle zeigen auch starke Leistungen bei der Nutzung von Werkzeugen, Few-Shot-Funktionsaufrufen und Ketten von Gedanken.
Sicherheit ist grundlegend für OpenAIs Ansatz zur Veröffentlichung von Modellen, insbesondere für offene Modelle. Die gpt-oss-Modelle haben umfassende Sicherheitsschulungen und -bewertungen durchlaufen, um sicherzustellen, dass sie hohen Sicherheitsstandards entsprechen. OpenAI hat auch mit frühen Partnern zusammengearbeitet, um reale Anwendungen zu erkunden, und stellt diese Modelle zur Verfügung, um Entwicklern, Unternehmen und Regierungen zu ermöglichen, KI auf ihrer eigenen Infrastruktur zu betreiben und anzupassen.
Die gpt-oss-Modelle wurden mit fortschrittlichen Vor- und Nachtrainingstechniken trainiert, wobei der Fokus auf Denken, Effizienz und Benutzerfreundlichkeit in verschiedenen Bereitstellungsumgebungen lag. Jedes Modell ist ein Transformer, der eine Mischung von Experten nutzt, um die Leistung zu optimieren. Die Modelle unterstützen drei Denkansätze – niedrig, mittel und hoch – sodass Entwickler die Leistung basierend auf ihren Bedürfnissen anpassen können.
Die Gewichte beider Modelle sind kostenlos zum Download auf Hugging Face verfügbar und kommen nativ quantisiert in MXFP4. Dies ermöglicht eine effiziente Speichernutzung, wodurch die Modelle flexibel und einfach lokal oder über Drittanbieter ausgeführt werden können. OpenAI setzt sich dafür ein, ein gesundes Ökosystem offener Modelle zu fördern und Entwickler sowie Forscher zu ermutigen, mit diesen leistungsstarken Werkzeugen zu experimentieren und zu innovieren.
gpt-oss im Überblick
Open-Weight-Modelle
Apache 2.0-Lizenz
Starke Denkfähigkeiten
Unterstützung für Werkzeugnutzung
Anpassbar
Effiziente Bereitstellung
Unterstützt lokale Inferenz
Mischung-von-Experten-Architektur
Erste Schritte mit gpt-oss
Modellzugang: Besuchen Sie die OpenAI-Website, um auf gpt-oss zuzugreifen.
Authentifizierung: Richten Sie ein Konto ein, falls erforderlich, um auf das Modell zuzugreifen.
Umgebung einrichten: Bereiten Sie Ihre Entwicklungsumgebung für die Integration vor.
Integration über API: Verwenden Sie die bereitgestellte API, um gpt-oss in Ihre Anwendung zu integrieren.
Optimieren: Passen Sie die Modellparameter für die Leistung basierend auf Ihrem spezifischen Anwendungsfall an.
gpt-oss's Anwendungsfälle
- On-Device-KI
- Lokale Inferenz
- Schnelle Iteration
- Werkzeugintegration
- Benutzerdefinierte KI-Lösungen






