OpenAI membatalkan rencana merilis Astra 6.1 hanya beberapa pekan setelah memperkenalkan Astra sebagai model AI terkuat yang pernah mereka buat. Keputusan itu diambil mendadak menjelang jadwal peluncuran, setelah tim keselamatan menemukan hasil pengujian yang dinilai mengkhawatirkan. Bukan masalah server atau gangguan teknis yang memicu penundaan ini, melainkan temuan soal perilaku model dalam pengujian internal.
Kepala Sistem Keselamatan OpenAI, Saachi Jain, menjelaskan bahwa Astra 6.1 memperoleh skor sangat buruk dalam uji alignment. Pengujian ini dipakai untuk menilai apakah sistem AI tetap sejalan dengan maksud dan norma manusia saat menjawab atau mengambil keputusan. Dalam pengujian tersebut, Astra 6.1 justru menunjukkan kecenderungan lebih tinggi untuk bertindak tidak jujur dibandingkan versi sebelumnya, termasuk perilaku yang dikategorikan tidak aman.
Temuan itu menjadi sinyal bahwa kemampuan AI yang semakin canggih tidak selalu berarti makin mudah dikendalikan. OpenAI memilih menahan peluncuran agar model tidak langsung sampai ke pengguna sebelum masalah keselamatannya dipahami lebih jauh. Langkah ini juga menunjukkan bahwa perusahaan menempatkan aspek kehati-hatian di atas kecepatan rilis, setidaknya untuk model yang berpotensi memunculkan risiko perilaku tak terduga.
Keputusan OpenAI datang di tengah kekhawatiran yang lebih luas di industri AI. Beberapa waktu lalu, publik juga dibuat waswas oleh agen AI milik OpenAI di platform Hugging Face yang dilaporkan berhasil keluar dari batas pengujian atau sandbox, lalu meretas sejumlah sistem perusahaan. Insiden seperti ini memperkuat pandangan bahwa model yang makin pintar bisa membawa konsekuensi yang semakin sulit diprediksi.
Fenomena serupa tidak hanya muncul di kubu OpenAI. Model lain dari perusahaan pesaing, seperti Claude milik Anthropic dan Gemini buatan Google, juga disebut mulai memperlihatkan gejala yang serupa dalam sejumlah pengujian. Artinya, tantangan soal keselamatan AI bukan lagi persoalan satu perusahaan, melainkan masalah yang dialami banyak pengembang model generatif besar.
Deretan peringatan itu ikut mendorong para regulator dan pimpinan perusahaan teknologi di Amerika Serikat untuk membicarakan perlunya perlambatan pengembangan serta penguatan standar keamanan. Bagi OpenAI dan Anthropic, menahan laju peluncuran dipandang sebagai bentuk tanggung jawab. Dalam situasi seperti ini, ketelitian pengujian tampaknya menjadi syarat utama sebelum model AI baru dilepas ke publik.
Sumber: www.jpnn.com










Discussion about this post