ChatGPT menerima peningkatan pada bulan Agustus: GPT-5.6 menghadirkan fokus pada ketahanan dan keamanan bagi semua orang

OpenAI ChatGPT
Foto: OpenAI ChatGPT - Foto: One Artist / Shutterstock.com

OpenAI merilis serangkaian pembaruan untuk ChatGPT pada bulan Agustus, memperkenalkan model yang lebih canggih dan memperluas akses ke fitur-fitur canggih. Pengguna versi Gratis dan Go kini akan menggunakan model standar baru untuk interaksi sehari-hari mereka. Mereka yang berlangganan paket Plus dan Pro akan memiliki akses ke versi GPT-5.6 Sol yang ditingkatkan, yang mencakup penggeser untuk menyesuaikan tingkat upaya ChatGPT saat menghasilkan tanggapan. Model baru ini menggantikan GPT-5.5 Instan, yang menandai kemajuan signifikan dalam pengalaman pengguna.

Perusahaan menegaskan bahwa GPT-5.6 Sol dan GPT-5.6 Luna versi Agustus dianggap berkapasitas tinggi dalam hal keamanan siber serta pengenalan biologis dan kimia, menurut Kerangka Persiapannya. Namun, tidak ada versi yang mencapai ambang batas kapasitas tinggi dalam pengembangan diri AI. Penilaian keamanan model dilakukan pada pengaturan paling dasar, seperti mode snapshot, untuk menangkap kinerja di sebagian besar penggunaan, sementara kemampuan diuji pada upaya penalaran maksimal.

Untuk pertama kalinya, OpenAI menyertakan penilaian khusus untuk pengguna berusia di bawah 18 tahun. Analisis ini dikembangkan untuk mengukur perilaku model terhadap standar keamanan yang dibuat khusus untuk remaja, yang menunjukkan upaya berkelanjutan untuk membuat ChatGPT lebih aman untuk kelompok usia ini.

Detail tentang model dan proses pelatihan

Model GPT-5.6 Sol dan GPT-5.6 Luna, seperti model lainnya yang dikembangkan oleh OpenAI, dilatih pada kumpulan data yang sangat besar. Hal ini mencakup informasi yang tersedia untuk umum di internet, data yang diperoleh melalui kemitraan dengan pihak ketiga, dan informasi yang disediakan atau dihasilkan oleh pengguna, pelatih, dan peneliti. Perusahaan menggunakan proses penyaringan data yang ketat untuk memastikan kualitas dan mengurangi kemungkinan risiko. Pengklasifikasi keamanan digunakan untuk mencegah atau mengurangi keberadaan konten sensitif atau berbahaya, seperti materi seksual eksplisit yang melibatkan anak di bawah umur.

OpenAI menunjukkan bahwa nilai perbandingan untuk model yang dirilis sebelumnya mungkin memiliki variasi kecil dibandingkan dengan nilai yang dipublikasikan pertama kali, karena mengacu pada versi terbaru dari model tersebut. Perusahaan menegaskan kembali bahwa penggunaan GPT-5.6 harus sesuai dengan Kebijakan Penggunaan, Ketentuan Layanan, dan Ketentuan Penggunaannya, yang menjamin penggunaan teknologi kecerdasan buatan secara bertanggung jawab.

Penilaian keamanan pada konten terlarang

Untuk memastikan kepatuhan terhadap kebijakannya, OpenAI melakukan benchmarking pada beberapa kategori konten terlarang. Perusahaan ini menggunakan Tolok Ukur Produksi, serangkaian analitik yang mencakup percakapan menantang yang diambil dari data penggunaan dunia nyata. Tolok ukur ini dirancang agar sulit dan membantu mengukur kemajuan, terutama ketika penilaian standar sudah menunjukkan tingkat kinerja yang tinggi. Tingkat kesalahan yang diamati dalam evaluasi ini tidak mencerminkan rata-rata lalu lintas produksi, melainkan pengujian ketat terhadap perilaku model tanpa perlindungan tingkat sistem.

Saat mengevaluasi GPT-5.6 Sol dibandingkan GPT-5.5 Instant June Update, hasilnya menunjukkan performa serupa di semua kategori terlarang, kecuali untuk konten kekerasan dan seksual, yang tidak memiliki perbedaan signifikan secara statistik. Untuk GPT-5.6 Luna, performanya juga sebanding, kecuali konten kekerasan. Mengenai konten seksual terlarang, OpenAI telah menerapkan mitigasi tingkat sistem tambahan untuk mencegah materi erotis eksplisit menjangkau pengguna dalam produksi. Bagi mereka yang berusia di bawah 18 tahun, perlindungan tambahan sesuai usia telah diterapkan, sehingga semakin membatasi konten seksual dan paparan materi kekerasan yang mencolok.

Logo ObrolanGPT
Logo ChatGPT – Markus Mainka/ Shutterstock.com

Perlindungan dan batasan untuk pengguna di bawah 18 tahun

Sistem kecerdasan buatan dapat memberikan manfaat besar bagi remaja, membantu mereka belajar, menciptakan, memecahkan masalah, dan mengembangkan keterampilan baru. OpenAI dengan hati-hati merancang sistemnya untuk memaksimalkan manfaat ini, sekaligus memitigasi potensi bahaya yang mungkin berdampak tidak proporsional atau lebih parah pada pengguna di bawah usia 18 tahun. Prinsip dan persyaratan yang memandu perilaku model ditentukan dalam Spesifikasi Model.

Bagi remaja, ketentuan khusus usia diterapkan dalam kebijakan keselamatan, yang menetapkan batasan yang lebih ketat dibandingkan yang diterapkan pada orang dewasa dalam bidang seperti konten seksual, ketergantungan emosional, gangguan makan, dan akses terhadap barang/jasa dengan batasan usia. Model tersebut dilatih untuk menghindari permainan peran romantis, mendorong tantangan yang dibatasi usia, atau memposisikan dirinya sebagai pengganti hubungan nyata. Selain itu, ketika sistem ini mengidentifikasi tanda-tanda bahwa seorang remaja mungkin memerlukan dukungan, sistem ini dirancang untuk memperkuat batasan yang sehat dan mendorong hubungan dengan orang dewasa yang dipercaya, seperti orang tua atau guru. Langkah-langkah keamanan tingkat sistem menambahkan lapisan ekstra, membatasi akses ke konten sensitif, mendorong penghentian penggunaan yang lebih lama, dan menyediakan alat manajemen untuk orang tua. Ulasan spesifik di bawah 18 tahun menunjukkan kinerja yang solid dari GPT-5.6 Sol e Luna, termasuk peningkatan terkait produk/layanan dengan batasan usia dan konten seksual.

Kemampuan dan penilaian visi model

OpenAI juga melakukan evaluasi masukan gambar untuk mengukur keluaran model yang “tidak_aman”, dengan mempertimbangkan kombinasi teks dan gambar yang tidak diizinkan. Hasilnya menunjukkan bahwa performa GPT-5.6 Sol dalam penilaian penglihatan setara dengan GPT-5.5-Instan. GPT-5.6 Luna, sebaliknya, menunjukkan regresi kecil dalam penilaian ekstremisme, dengan signifikansi statistik yang rendah, yang menunjukkan bahwa kapasitas secara keseluruhan masih kuat.

Pengujian kesehatan mental dengan simulasi pengguna

Untuk analisis lebih lanjut, perusahaan telah memperkenalkan penilaian multi-interaksi dinamis untuk kesehatan mental, ketergantungan emosional, dan tindakan menyakiti diri sendiri. Tidak seperti pengujian statis, simulasi ini memungkinkan percakapan berkembang sebagai respons terhadap keluaran model, sehingga menciptakan lintasan pengujian yang lebih realistis dan ketat. Pendekatan ini membantu mengidentifikasi potensi masalah yang mungkin timbul akibat interaksi yang berkepanjangan, sehingga memberikan pengujian yang lebih akurat.

Pengujian menunjukkan bahwa GPT-5.6 Sol secara umum sebanding dengan GPT-5.5 Instant June Update dalam penilaian ini, meskipun terdapat regresi yang signifikan secara statistik dalam penilaian tindakan menyakiti diri sendiri. Namun, peningkatan respons yang tidak diinginkan terhadap tindakan menyakiti diri sendiri, kesehatan mental, dan ketergantungan emosional tidak dicatat selama eksperimen online. Perusahaan terus memantau aspek-aspek ini setelah peluncuran untuk memverifikasi hasil dan menyelidiki potensi perbedaan antara pengujian offline dan online.

Meningkatkan ketahanan model

Ketahanan model diuji terhadap “jailbreak”, yang merupakan rangsangan permusuhan yang dirancang untuk melewati pelatihan penolakan model dan mendapatkan bantuan yang merugikan. Penilaian ini berfokus pada membuka kunci model secara langsung, tanpa perlindungan penuh dalam produksi. Ini adalah lapisan ketahanan dalam langkah-langkah keamanan. OpenAI menggunakan strategi serangan canggih yang berasal dari latihan intrusi internal, yang dapat menyelidiki, beradaptasi, dan meningkat selama percakapan. Meskipun terdapat variasi yang diharapkan dalam skenario anggaran serangan yang tinggi, kinerja GPT-5.6 Sol dan GPT-5.6 Luna dianggap sebanding dengan pendahulunya.

Ketahanan terhadap serangan injeksi langsung pada konektor juga dievaluasi. Serangan ini memasukkan instruksi jahat ke dalam keluaran alat untuk mengelabui model dan menimpa instruksi sistem, pengembang, atau pengguna. Versi perbaikan dari serangan ini, yang berfokus pada pencarian dan pemanggilan fungsi, disertakan dalam pengujian. Model GPT-5.6 Sol dan GPT-5.6 Luna menunjukkan performa yang setara dengan model Instan sebelumnya dalam evaluasi ini.

Peningkatan kinerja kesehatan

Chatbots berpotensi memberdayakan masyarakat untuk lebih memahami kesehatan mereka. Oleh karena itu, model baru dievaluasi di HealthBench, yang mengukur kinerja dan keselamatan kesehatan, dan di HealthBench Professional, yang berfokus pada kasus penggunaan klinis. Untuk mencegah respons yang lebih panjang, yang dapat meningkatkan skor secara artifisial, sehingga mengganggu kegunaan dan keamanan, hasil disesuaikan dengan durasi respons akhir. Tanggapan yang lebih pendek menerima penyesuaian positif, sedangkan tanggapan yang lebih panjang akan dikenakan sanksi.

Rilis GPT-5.6 Sol memberikan peningkatan dibandingkan GPT-5.5 Instan di semua kategori HealthBench, dengan peningkatan substansial dalam HealthBench Professional dan HealthBench Hard. Responsnya lebih singkat di beberapa kategori dan sedikit lebih lama di kategori lain, namun skor yang disesuaikan dan tidak disesuaikan meningkat secara keseluruhan. GPT-5.6 Luna juga menunjukkan peningkatan di semua evaluasi meskipun ukurannya lebih kecil. Peningkatan ini diharapkan dapat memberikan akses yang lebih luas terhadap informasi kesehatan yang dapat dipercaya bagi seluruh pengguna.

Mengurangi halusinasi dan meningkatkan akurasi faktual

Untuk menilai kemampuan model dalam memberikan jawaban yang benar secara faktual, OpenAI mengukur tingkat halusinasi faktual dalam serangkaian perintah yang menantang, dipilih untuk mewakili skenario di mana model paling mungkin berhalusinasi. Penilaian ini dirancang agar sulit dan memberikan sinyal penelitian yang sensitif dari waktu ke waktu, dibandingkan mengukur prevalensi keseluruhan dalam produksi atau pengalaman pengguna rata-rata. Skenario mencakup permintaan yang berfokus pada fakta dari percakapan ChatGPT, kerusakan yang dilaporkan pengguna di versi sebelumnya, dan situasi medis, hukum, dan keuangan yang berisiko tinggi.

Hasilnya menunjukkan bahwa GPT-5.6 Sol dan GPT-5.6 Luna menunjukkan peningkatan substansial dalam akurasi faktual dibandingkan GPT-5.5 Instan di seluruh evaluasi. GPT-5.6 Luna mampu mengurangi tingkat kesalahan faktual sebesar lebih dari 60% pada pertanyaan berisiko tinggi dan sekitar 30% pada dua rangkaian pertanyaan lainnya. GPT-5.6 Sol menunjukkan peningkatan yang signifikan secara statistik dan lebih konsisten, mengurangi tingkat kesalahan faktual sekitar 60% di ketiga rangkaian pertanyaan. Penyempurnaan ini bertujuan untuk meningkatkan kepercayaan pengguna terhadap informasi yang diberikan model.

Kerangka Kesiapsiagaan dan Upaya Perlindungan

Kerangka Kerja Kesiapsiagaan OpenAI adalah pendekatannya untuk memantau dan mempersiapkan kemampuan edge yang dapat menimbulkan risiko bahaya serius. Dalam kerangka ini, perusahaan berupaya memitigasi risiko ini dengan menerapkan perlindungan yang cukup meminimalkan bahaya untuk model yang berkemampuan tinggi. Model GPT-5.6 Sol dan GPT-5.6 Luna yang diperbarui menjamin peringkat Readiness Framework yang sama dengan model GPT-5.6 yang dirilis sebelumnya: Tinggi dalam Keamanan Biologi dan Kimia, Tinggi dalam Keamanan Siber, dan di bawah Tinggi dalam Peningkatan Diri AI.

Penilaian kemampuan mewakili batas bawah potensi kemampuan, karena isyarat tambahan, penyesuaian, atau interaksi inovatif dapat menimbulkan perilaku di luar apa yang diamati dalam pengujian. Dalam domain biologi dan kimia, “kemampuan tinggi” didefinisikan oleh bantuan signifikan yang dapat diberikan oleh model kepada aktor “pemula” dalam menciptakan ancaman serius yang diketahui. Pengujian dalam bidang virologi dan pengetahuan diam-diam menunjukkan bahwa model yang diperbarui melampaui ambang batas ahli di beberapa bidang, namun gagal dalam bidang lain, seperti kemampuan untuk memecahkan masalah protokol laboratorium.

Dalam keamanan siber, “kapasitas tinggi” didefinisikan sebagai model yang mengotomatiskan operasi siber menyeluruh terhadap target yang dilindungi secara wajar atau penemuan/eksploitasi kerentanan. Pengujian tantangan Capture the Flag (CTF) dan CVE-Bench menunjukkan bahwa GPT-5.6 Sol dan Luna melampaui ambang batas kesiapan tinggi dalam beberapa skenario, dengan Sol mencapai 97,06% di CTF. Dalam simulasi jangkauan dunia maya, Sol menunjukkan keberhasilan yang lebih besar daripada Luna, dengan keduanya menghadirkan tantangan dalam skenario spesifik dengan kompleksitas tinggi. Penilaian pengembangan mandiri AI tidak dilakukan karena GPT-5.6 Sol sudah berada di bawah tingkat kapasitas tinggi. Perlindungan yang diterapkan bertujuan untuk menghalangi dan mendeteksi aktivitas ofensif yang dilarang, sekaligus menjaga penggunaan kemampuan keamanan biologis dan siber secara defensif dan ilmiah, serta memperkuat keamanan online dan offline.

Lihat Juga Berita Terbaru (ID)

Pemilik PS5 mendapatkan akses permanen ke dua judul utama di toko virtual
Berita Terbaru (ID) • 13/08/2026

Pemilik PS5 mendapatkan akses permanen ke dua judul utama di toko virtual

Epic Games Store menyediakan 12 game terkenal secara gratis di PC pada tahun 2026
Berita Terbaru (ID) • 13/08/2026

Epic Games Store menyediakan 12 game terkenal secara gratis di PC pada tahun 2026

Seorang remaja membunuh ibu dan saudara laki-lakinya setelah menggunakan AI untuk menciptakan fantasi tentang kejahatan tersebut
Berita Terbaru (ID) • 13/08/2026

Seorang remaja membunuh ibu dan saudara laki-lakinya setelah menggunakan AI untuk menciptakan fantasi tentang kejahatan tersebut

Langganan mobil terbayar di tahun 2026? Lihat perbandingannya dengan pembelian
Berita Terbaru (ID) • 13/08/2026

Langganan mobil terbayar di tahun 2026? Lihat perbandingannya dengan pembelian

Komet antarbintang 3I/ATLAS bergerak dengan kecepatan 58 km/s dan rutenya akan diubah oleh Jupiter
Berita Terbaru (ID) • 13/08/2026

Komet antarbintang 3I/ATLAS bergerak dengan kecepatan 58 km/s dan rutenya akan diubah oleh Jupiter

Toyota mengumumkan penarikan global atas 655.000 unit Camry karena kerusakan dasbor
Berita Terbaru (ID) • 13/08/2026

Toyota mengumumkan penarikan global atas 655.000 unit Camry karena kerusakan dasbor

Prichard Colón, mantan petinju, meninggal pada usia 33 setelah 11 tahun berjuang melawan cedera otak
Berita Terbaru (ID) • 13/08/2026

Prichard Colón, mantan petinju, meninggal pada usia 33 setelah 11 tahun berjuang melawan cedera otak

Blokir ponsel yang dicuri: langkah penting untuk melindungi data Anda dan melacak perangkat
Berita Terbaru (ID) • 13/08/2026

Blokir ponsel yang dicuri: langkah penting untuk melindungi data Anda dan melacak perangkat

Google memperkenalkan seri Pixel 11 dengan chip Tensor G6 yang ditingkatkan dan Pixel Tag baru
Berita Terbaru (ID) • 13/08/2026

Google memperkenalkan seri Pixel 11 dengan chip Tensor G6 yang ditingkatkan dan Pixel Tag baru

Pengisian daya yang lambat pada Galaxy Watch 9 dan Ultra 2 memaksa pengguna melakukan trik seperti kipas dan es
Berita Terbaru (ID) • 13/08/2026

Pengisian daya yang lambat pada Galaxy Watch 9 dan Ultra 2 memaksa pengguna melakukan trik seperti kipas dan es

Kedatangan Everspace 2: Galactic Edition yang tak terduga meningkatkan katalog Nintendo Switch 2
Berita Terbaru (ID) • 13/08/2026

Kedatangan Everspace 2: Galactic Edition yang tak terduga meningkatkan katalog Nintendo Switch 2

Teleskop Webb NASA menemukan planet raksasa baru dengan metode inovatif
Berita Terbaru (ID) • 13/08/2026

Teleskop Webb NASA menemukan planet raksasa baru dengan metode inovatif

POCO X8 mendekati peluncuran dengan baterai 9.000 mAh dan layar resolusi tinggi
Berita Terbaru (ID) • 13/08/2026

POCO X8 mendekati peluncuran dengan baterai 9.000 mAh dan layar resolusi tinggi

Roket SpaceX bertabrakan dengan Bulan dalam peristiwa yang dipantau oleh NASA, sehingga menghilangkan risiko terhadap Bumi
Berita Terbaru (ID) • 13/08/2026

Roket SpaceX bertabrakan dengan Bulan dalam peristiwa yang dipantau oleh NASA, sehingga menghilangkan risiko terhadap Bumi

Sony mengakhiri penjualan digital di konsol PS3 dan PS Vita hingga Juli 2027
Berita Terbaru (ID) • 13/08/2026

Sony mengakhiri penjualan digital di konsol PS3 dan PS Vita hingga Juli 2027