OpenAI Bakal Sematkan Watermark Tak Terlihat di Teks ChatGPT, Deteksi Karya AI Kini Makin Mudah
OpenAI akan menambahkan watermark tak terlihat bernama textGrain pada teks yang dihasilkan ChatGPT dan Codex. Langkah ini untuk mematuhi EU AI Act dan memudahkan identifikasi konten AI. Watermark mulai diterapkan di Uni Eropa dalam beberapa minggu ke depan, sementara opsi untuk pelanggan API sudah tersedia global. Deteksi masih punya keterbatasan, terutama pada teks pendek atau yang telah diedit.
OpenAI resmi mengumumkan rencana menyematkan tanda air atau watermark tak terlihat pada setiap teks yang dihasilkan oleh ChatGPT dan Codex. Watermark ini tidak akan terlihat secara kasatmata, tetapi hadir melalui pola pemilihan kata dan struktur kalimat yang dihasilkan AI. Langkah ini diambil untuk memenuhi ketentuan Undang-undang AI Uni Eropa (EU AI Act) yang mewajibkan perusahaan AI menandai konten agar dapat diidentifikasi sistem lain demi transparansi.
Teknologi bernama textGrain ini bekerja dengan menambahkan sinyal statistik tak terlihat pada pilihan kata model. Detektor khusus kemudian mencari sinyal tersebut untuk menilai apakah suatu teks mengandung tanda air OpenAI. "Teknologi penanda air teks kami, textGrain, menambahkan sinyal statistik tak terlihat pada pilihan kata model. Detektor kami mencari sinyal tersebut untuk menilai apakah suatu bagian teks berisi tanda air OpenAI," tulis OpenAI di laman resminya pada Senin (5/10).
OpenAI mengklaim kemampuan textGrain dalam mendeteksi tulisan AI telah menyamai atau bahkan melampaui kinerja detektor lain, termasuk SynthID yang dikembangkan Google DeepMind. Meski demikian, keandalan dalam evaluasi internal dan uji coba tidak menjamin deteksi yang andal untuk penggunaan sehari-hari. OpenAI mengakui masih ada sejumlah kekurangan, terutama jika teks yang dihasilkan terlalu pendek atau telah mengalami sedikit penyuntingan.
Selama pengujian, ditemukan kesalahan berupa pelaporan adanya watermark padahal tidak ada (false positive) atau melewatkan watermark yang sebenarnya ada (false negative). Konten dengan teks pendek lebih sulit dideteksi dibandingkan teks panjang. Selain itu, konten yang memiliki sedikit fleksibilitas dalam pemilihan diksi, seperti matematika, juga lebih sulit untuk dideteksi.
Hasil pengujian menunjukkan penggantian sekitar 10 persen pilihan kata mampu menurunkan akurasi deteksi dari sekitar 92 persen menjadi 66 persen. Sementara penggantian sekitar 25 persen kata dapat menurunkan akurasi hingga 17 persen. Meski begitu, OpenAI menegaskan pemberian watermark tidak akan memengaruhi akurasi dan kinerja jawaban yang dihasilkan. Teknologi ini hanya membuat teks yang dihasilkan memiliki pola pemilihan kata yang dapat dideteksi.
Watermark ini nantinya memungkinkan pihak-pihak yang membutuhkan, seperti organisasi ahli atau akademisi, mengetahui apakah suatu teks dibuat oleh AI atau benar-benar karya orisinal. Hal ini berguna dalam pengungkapan penyalahgunaan dan penegakan hukum lainnya sesuai kebijakan yang berlaku.
Dalam beberapa minggu mendatang, watermark akan diterapkan untuk pengguna ChatGPT dan Codex secara lokal di Uni Eropa. Sementara itu, bagi pelanggan Application Programming Interface (API), opsi penambahan watermark ini sudah tersedia secara global. OpenAI belum merilis fitur ini secara menyeluruh karena kelemahan yang masih ditemukan dalam uji coba awal.
Ke depannya, perusahaan akan terus meningkatkan fungsi watermark dan kemampuan deteksi tersebut. "Keterbatasan ini berkontribusi pada keputusan kami untuk hanya memberikan akses awal ke detektor kepada peneliti dan organisasi ahli yang disetujui, yang dapat membantu kami mengevaluasi keandalan dan penggunaan yang bertanggung jawab," kata perusahaan.
What's Your Reaction?
Like
0
Dislike
0
Love
0
Funny
0
Wow
0
Sad
0
Angry
0
Comments (0)