OpenAI secara tak terduga mengguncang lanskap kecerdasan buatan dengan peluncuran GPT -OSS , model sumber terbuka utama pertamanya dalam lebih dari lima tahun. Perkembangan ini menandai perubahan dari strategi perusahaan baru-baru ini, yang terutama berfokus pada model berpemilik dan layanan tertutup. Dengan GPT-OSS, OpenAI kembali ke akarnya, membuka pintu bagi siapa pun atau organisasi mana pun untuk mengakses, menjalankan, dan menyesuaikan model bahasa yang canggih tanpa bergantung pada platform cloud atau koneksi internetnya.
Model baru ini tersedia dalam dua versi: satu dengan 120.000 miliar parameter dan satu lagi yang lebih ringan dengan 20.000 miliar parameter . Varian yang lebih canggih dapat dijalankan pada satu GPU profesional dengan setidaknya 80 GB memori, sementara versi yang lebih kecil ditujukan untuk komputer desktop dan laptop konvensional dengan RAM 16 GB, yang secara signifikan mendemokratisasi akses ke kemampuan AI tingkat lanjut . Kedua versi dapat diunduh secara gratis dari platform seperti Hugging Face dan diimplementasikan pada layanan populer seperti Azure atau AWS.
Karakteristik teknis dan teknologi yang digunakan
Dengan GPT-OSS , OpenAI telah memperkenalkan dua model yang dirancang dengan arsitektur berbasis Transformer dan mixture-of-experts (MoE) . Ini mengoptimalkan penggunaan memori dan latensi dengan hanya mengaktifkan sebagian kecil expert per token input, meningkatkan efisiensi tanpa mengorbankan daya. Edisi 120B menggunakan 36 blok dan mengaktifkan 5.100 miliar parameter per token, sedangkan edisi 20B menggunakan 24 blok dan mengaktifkan 3.600 miliar, sehingga cocok untuk perangkat keras yang lebih terjangkau.
Kedua model tersebut dilatih terutama menggunakan data berbahasa Inggris dari bidang STEM, pemrograman, dan pengetahuan umum , termasuk fase tambahan berupa penyempurnaan dan penguatan terawasi untuk meningkatkan keselarasan mereka dengan instruksi manusia . Kemampuan mereka meliputi penalaran rantai pemikiran , kemampuan untuk memecah langkah-langkah perantara sebelum memberikan respons, dan penggunaan alat eksternal seperti penjelajahan web dan eksekusi kode Python.
Ketersediaan, lisensi, dan opsi integrasi
Salah satu keunggulan utama GPT-OSS adalah lisensi Apache 2.0 -nya , yang menghilangkan banyak batasan umum dari model kepemilikan lainnya: lisensi ini memungkinkan penggunaan komersial, redistribusi, dan integrasi ke dalam semua jenis proyek, mulai dari perusahaan rintisan kecil hingga organisasi publik besar atau inisiatif R&D. Bobot model tersedia dalam format MXFP4 dan mencakup implementasi referensi di PyTorch dan Apple Metal, serta kompatibilitas penuh dengan alat-alat seperti Ollama, llama.cpp, LM Studio, dan vLLM , sehingga memudahkan penggunaannya baik di lingkungan profesional maupun rumahan.
Instalasi dan penerapan GPT-OSS-20B sangat mudah berkat utilitas seperti LM Studio, yang memungkinkan pengguna tanpa pengalaman pemrograman untuk mengunduh dan menguji model secara lokal menggunakan antarmuka grafis. Selain itu, OpenAI telah menerbitkan rekomendasi dan dokumentasi terperinci untuk penyempurnaan dan adaptasi model, serta integrasi siap pakai untuk platform cloud dan on-premises.
Keamanan, pengujian dan pendekatan yang bertanggung jawab
Peluncuran GPT-OSS tidak hanya berfokus pada keterbukaan tetapi juga pada keamanan dan penggunaan model yang bertanggung jawab. OpenAI telah menggabungkan mekanisme peninjauan dan validasi baru untuk mencegah risiko yang terkait dengan penyalahgunaan, terutama di area sensitif seperti keamanan siber dan pembuatan agen jahat. Untuk tujuan ini, OpenAI telah menerapkan metodologi pengujian adversarial (red teaming), dengan tinjauan eksternal oleh para ahli independen dan protokol untuk mensimulasikan skenario eksploitasi ekstrem.
Bersamaan dengan perilisan model-model tersebut, OpenAI telah meluncurkan tantangan kerja sama jaringan dengan imbalan finansial bagi mereka yang mengidentifikasi kerentanan atau perilaku bermasalah, yang bertujuan untuk mendorong kolaborasi aktif dari komunitas global dalam deteksi risiko. Lebih lanjut, GPT-OSS memaparkan rantai penalaran (reasoning chain) yang dimilikinya , memfasilitasi audit respons dan pemantauan untuk mencegah bias atau kesalahan kritis.
Performa dan perbandingan dengan model terbuka lainnya
Dalam tolok ukur akademis dan tes penalaran , GPT-OSS-120B berkinerja setara dengan, dan bahkan melampaui di beberapa area, model OpenAI eksklusif terbaru seperti o4-mini, dan mengungguli model lain seperti DeepSeek R1 atau seri Llama dalam konteks tertentu. Versi 20B, yang dioptimalkan untuk perangkat rumahan, mempertahankan keseimbangan yang sangat baik antara efisiensi dan kinerja , dengan skor yang sangat kompetitif dalam tugas matematika, pengkodean, dan kesehatan.
OpenAI memperingatkan bahwa model terbuka ini mungkin lebih rentan terhadap "halusinasi" (kesalahan faktual) dibandingkan dengan model berbasis cloud, mengingat perbedaan dalam pelatihan dan pemantauan. Namun, pengguna sekarang memiliki pilihan untuk menggunakan model tingkat tinggi tanpa memerlukan layanan online.