AI · 9 Oktober 2026

OpenAI menerapkan watermark tersembunyi pada teks ChatGPT dan Codex di Uni Eropa

Close-up of a green circuit board with components
Akshat Sharma / Unsplash

OpenAI mengumumkan penerapan watermark tersembunyi pada teks yang dihasilkan oleh ChatGPT dan Codex. Langkah ini diterapkan secara khusus untuk memenuhi regulasi Uni Eropa dan tidak berlaku secara global. Perusahaan menyatakan bahwa watermark akan aktif pada semua paket layanan di Uni Eropa dalam beberapa minggu ke depan. OpenAI menegaskan bahwa fitur ini tidak akan menjadi standar default untuk pengguna di seluruh dunia pada saat peluncuran di Uni Eropa. Untuk pelanggan API, watermark dapat diaktifkan secara opsional pada beberapa model mulai hari ini, dengan pengaturan default tetap nonaktif. Dukungan watermark juga akan segera tersedia untuk model yang disediakan melalui mitra cloud.

Penerapan ini merupakan respons terhadap ketentuan transparansi dalam Undang-Undang Kecerdasan Buatan Uni Eropa yang berlaku sejak 2 Agustus. Regulasi tersebut mewajibkan penyedia kecerdasan buatan generatif untuk menandai konten buatan mesin agar dapat diidentifikasi oleh sistem lain. Sebelumnya, Anthropic telah menerapkan watermark secara global pada output Claude sejak Agustus, sebuah langkah yang memicu reaksi dari sebagian pengguna.

Teknologi yang digunakan OpenAI disebut textGrain. Metode ini tidak menyisipkan tanda visual yang dapat dilihat manusia, melainkan menanamkan sinyal statistik yang tidak terlihat dalam proses pemilihan kata oleh model. Sinyal ini tetap ada saat teks disalin dan ditempelkan, dan dapat dideteksi oleh alat khusus. Laporan teknis menunjukkan bahwa textGrain memiliki performa yang setara atau lebih baik dibandingkan metode lain, termasuk teknologi SynthID milik Google untuk teks. Evaluasi pada model terbaru Astra menunjukkan tidak ada perbedaan performa yang signifikan antara mode watermark aktif dan nonaktif.

Meskipun demikian, akurasi deteksi watermark bervariasi tergantung pada panjang dan jenis teks. Pada teks sepanjang 200 token, tingkat deteksi sekitar 80 persen dengan tingkat positif palsu 1 persen, meningkat menjadi 95 persen pada teks 400 token. Deteksi lebih rendah pada bidang dengan pilihan kata terbatas seperti matematika. Modifikasi teks juga melemahkan sinyal; mengganti 10 persen kata dengan sinonim menurunkan deteksi dari 92 persen menjadi 66 persen, dan 25 persen menjadi 17 persen. Teks pendek atau terjemahan juga sulit dideteksi. Oleh karena itu, alat deteksi hanya tersedia untuk peneliti dan lembaga yang disetujui, dan tidak mengidentifikasi pengguna atau konten percakapan. OpenAI juga menekankan bahwa watermark tidak menentukan tingkat campur tangan manusia, kepemilikan, atau kebenaran fakta. Teknologi verifikasi sumber juga sudah diterapkan pada gambar dan audio menggunakan standar C2PA. OpenAI berencana membuka sumber kode textGrain untuk pengembangan lebih lanjut.