Dari Watermark Tak Kasat Mata Claude Meninjau Penyembunyian Informasi di Era GenAI: Bagaimana Watermark Tersemat Menjamin Tanpa Kerusakan?

marsbitPublished on 2026-08-17Last updated on 2026-08-17

Abstract

Pada 11 Agustus 2026, Anthropic mengumumkan bahwa model Claude versi baru akan menyematkan watermark tak kasat mata dalam teks yang dihasilkannya untuk memungkinkan identifikasi dan penelusuran konten AI. Langkah ini, didorong oleh regulasi seperti EU AI Act, mencerminkan tren global menuju transparansi konten buatan AI. Inti dari penelitian watermark era GenAI adalah "kinerja tanpa kerugian yang dapat dibuktikan," yang berakar pada teori steganografi aman terbukti. Secara tradisional, steganografi hanya mengandalkan keamanan empiris. Teori aman terbukti mensyaratkan bukti matematis bahwa data yang berisi pesan tersembunyi tidak dapat dibedakan dari data normal dalam hal distribusinya. Perkembangan model generatif AI, yang mempelajari dan mengambil sampel dari distribusi data alami, akhirnya memberikan landasan yang diperlukan untuk konstruksi teoretis ini. Penelitian perintis dari Universitas Sains dan Teknologi Tiongkok (2018) mengusulkan steganografi aman terbukti berbasis model generatif, membuka jalan bagi bidang ini. Perkembangannya meliputi evolusi dari skema kunci simetris ke asimetris (kunci publik), dan dari ekstraksi "white-box" (bergantung pada model) menuju "black-box" atau "grey-box" yang lebih praktis, serta mengatasi ambiguitas token. Prinsip yang sama diterapkan pada watermarking. Dengan menjamin bahwa distribusi sampel model tidak berubah setelah penyematan watermark, watermark "tanpa kerugian kinerja yang dapat dibuktikan" menjadi mungkin. Teknik seperti...

Pada 11 Agustus 2026, Anthropic mengumumkan: mulai dari tanggal 2 Agustus, model Claude versi baru yang dirilis akan secara langsung menyematkan watermark tak kasat mata (tidak terlihat oleh mata manusia namun dapat dibaca mesin) ke dalam teks yang dihasilkan, sehingga konten yang dihasilkan AI tetap dapat diidentifikasi dan ditelusuri asal-usulnya oleh perangkat lunak setelah disalin dan disebarluaskan.

Dokumentasi resmi menuliskan: "Ketika model Claude yang didukung menghasilkan teks, ia akan menyematkan watermark yang sulit disadari langsung ke dalam teks tersebut. Anda tidak akan melihatnya, dan watermark ini tidak akan mengubah semantik, kualitas jawaban Claude, maupun memengaruhi keterbacaannya."

Mekanisme ini mencakup seluruh lini produk: antarmuka web Claude, API, dan Claude Code, berlaku untuk pengguna global dan tidak dapat dinonaktifkan; gambar dan file lainnya yang dihasilkan juga akan dilengkapi dengan metadata penelusuran asal-usul (provenance) berupa tanda tangan digital yang sesuai dengan standar C2PA.

Ini adalah langkah ikonis Anthropic setelah menandatangani Kode Etik Transparansi Pasal 50 dari “EU Artificial Intelligence Act” (Undang-Undang AI Uni Eropa).

Memberi 'watermark' pada konten yang dihasilkan AI sedang bergerak dari inisiatif perusahaan menuju konsensus global. Pada Juni 2025, World Economic Forum (Forum Ekonomi Dunia) merilis "10 Teknologi Muncul Teratas 2025" pada Summer Davos di Tianjin, di mana "Watermark Generatif" menempati posisi kedua; Futuris Kevin Kelly dalam bukunya "2049: Kemungkinan 10.000 Hari Mendatang" meramalkan bahwa era kecerdasan buatan memerlukan "mendefinisikan ulang realitas", membutuhkan "penanda untuk membedakan keaslian seperti watermark pada gambar dan video yang dihasilkan AI".

Gambar 1 Forum Summer Davos dan Ramalan Kevin Kelly

Tapi membuat watermark yang "tepat" tidaklah mudah.

Di hari pengumuman Anthropic, keraguan utama dari pengguna adalah: apakah watermark akan merusak model? Apakah akan menurunkan kualitas generasi?

"Kinerja tanpa kerusakan yang dapat dibuktikan" (Provable Performance Losslessness), dengan demikian menjadi proposisi inti penelitian penyembunyian informasi di era GenAI. Dan untuk memahami proposisi ini, kita perlu kembali ke sumber teoretisnya—Steganografi Aman Terbukti (Provably Secure Steganography).

Steganografi Aman Terbukti, Menunggu Model Generatif Dua Puluh Tahun

Steganografi dan watermark sama-sama termasuk dalam penyembunyian informasi. Steganografi tradisional selama bertahun-tahun tetap berada pada tingkat "keamanan empiris": menggunakan algoritma deteksi steganografi untuk menguji kekuatan keamanan steganografi, tetapi tidak dapat memberikan jaminan matematis. Steganografi Aman Terbukti menuntut pembuktian yang ketat: bahwa data yang membawa rahasia tidak dapat dibedakan dari data normal dalam hal distribusi.

Jalur teoretis ini sudah lama ada.

Pada 1949, Shannon menyoroti kesulitan membangun teori komunikasi tersembunyi; pada 1998, Cachin memperkenalkan entropi relatif, memberikan definisi keamanan dalam arti teori informasi; pada 2002, penerima Turing Award Manuel Blum membimbing Hopper dkk. untuk membangun kerangka kerja steganografi keamanan komputasi, yang pada 2004 dikembangkan lagi menjadi steganografi kunci publik dan negosiasi kunci tersembunyi.

Namun, semua konstruksi steganografi aman terbukti bergantung pada satu prasyarat ketat—distribusi pembawa (carrier) dapat di-sampel secara tepat. Distribusi data alami tidak dapat dikendalikan, sehingga teori ini lama terpendam.

Gambar 2 Garis Waktu Singkat Perkembangan Steganografi Aman Terbukti

Pada 2018, model generatif AI membawa titik balik: model pertama-tama mempelajari distribusi, kemudian melakukan sampling sesuai distribusi, secara alami menyediakan "distribusi eksplisit atau sampler sempurna".

Tim dari University of Science and Technology of China (USTC) adalah yang pertama di dunia mengusulkan gagasan steganografi aman terbukti generatif, memberikan dua set kerangka kerja: "sampling kotak hitam" (black-box sampling) dan "sampling kompresi-reversibel" (compression-reversible sampling) (IWDW 2018, arXiv 2018), mereduksi keamanan steganografi ke keamanan algoritma enkripsi—mengenkripsi pesan menjadi ciphertext pseudorandom, menggunakan ciphertext untuk menggerakkan sampling menghasilkan konten, dan penerima memulihkan ciphertext melalui sampling terbalik.

Saat itu, AI generatif belum meledak, ide ini tampak "terlalu maju", dan sempat sulit mendapat pengakuan dari rekan sejawat akademik. Seiring dengan peningkatan kualitas model generatif seperti suara, hasil terkait secara bertahap diakui. International Workshop on Digital Watermarking (IWDW) mengundang tim USTC untuk memberikan laporan utama berjudul "When Provably Secure Steganography Meets Generative Models".

Gambar 3 Artikel Steganografi Aman Terbukti Generatif Pertama

Sekitar tahun 2021, data yang dihasilkan AI secara bertahap menjadi bentuk utama konten jaringan, dan steganografi aman terbukti mendapat perhatian luas secara global: Universitas Tsinghua mengusulkan steganografi bahasa aman terbukti berbasis pengelompokan sampel (grouping-based) (Findings of ACL 2021); Boston University dan Johns Hopkins University mengusulkan steganografi aman kriptografi yang berorientasi pada distribusi nyata, Meteor (ACM CCS 2021); Universitas Oxford mengusulkan steganografi aman sempurna berbasis kopling entropi minimum (minimum entropy coupling) (ICLR 2023).

Tim USTC mengusulkan konstruksi Discop berbasis "replika distribusi" (distribution replica) (IEEE S&P 2023), yang secara signifikan meningkatkan laju muatan tersemat (embedding payload rate). Pada tahun yang sama, Quanta Magazine memasukkan "menyembunyikan informasi rahasia secara sempurna dalam data generatif" sebagai salah satu dari tujuh terobosan ilmu komputer internasional tahun itu, menandai masuknya era "terbukti" (provable) dalam penyembunyian informasi.

Dari Simetris ke Asimetris, dari "Ber-Kotak" ke "Tanpa Kotak"

Steganografi aman terbukti generatif awal semuanya menggunakan sistem "kunci simetris", di mana pengirim dan penerima harus berbagi kunci terlebih dahulu, dan bergantung pada ekstraksi kotak putih (white-box), sehingga penerapannya terbatas.

Selain itu, ambiguitas sub-kata (subword ambiguity) dapat menyebabkan ekstraksi gagal. Tim USTC mendorong arah teknologi menuju steganografi kunci publik, skenario tanpa kotak/kotak abu-abu, serta menghilangkan ambiguitas sub-kata, membuat penyembunyian generatif menuju kepraktisan.

Steganografi Kunci Publik (IEEE TIFS 2024): Mengusulkan skema steganografi kunci publik aman terbukti yang menggabungkan Elliptic Curve Cryptography (ECC) dengan model generatif, dan mengusulkan protokol pertukaran kunci steganografi. Memecahkan masalah negosiasi kunci steganografi dan ekstraksi informasi tersembunyi yang "asimetris".

Steganografi Tanpa Kotak (IEEE TMM 2026): Metode tradisional bergantung pada ekstraksi "kotak putih", penerima harus memiliki model bahasa yang persis sama dengan pengirim. Tim mengusulkan Disreo, yang melalui randomisasi posisi token dan penggabungan ulang probabilitas output (output probability recombination) mencapai "ekstraksi tanpa kotak", memungkinkan penerima memulihkan pesan tanpa perlu mengakses model dasar, memberikan kemudahan lebih besar untuk penerapan nyata.

Steganografi Kotak Abu-abu (ACM CCS 2026): Antara kotak putih dan tanpa kotak, ada skenario "kotak abu-abu"—sumber daya pengirim dan penerima tidak setara, penerima mungkin hanya memiliki kemampuan menjalankan model kecil (misalnya perangkat seluler). SpecStega berbasis speculative sampling: model kecil yang dibagi kedua belah pihak menyelesaikan penyematan dan ekstraksi pesan, kemudian menggunakan model besar target untuk memurnikan output, sehingga teks pembawa rahasia akhir selaras dengan distribusi output model besar, mempertahankan kualitas dan keamanan tinggi, sekaligus dapat didekode secara efisien oleh pihak penerima hanya dengan model kecil, meningkatkan laju muatan hingga 20 kali lipat dibandingkan skema kotak hitam yang ada—menyediakan jalur ketiga antara "ber-kotak" dan "tanpa kotak" untuk steganografi aman terbukti.

Memecahkan Ambiguitas Sub-kata (IEEE TDSC): Steganografi berbasis model bahasa besar umumnya menghadapi ambiguitas dekode token—teks yang sama dapat dipotong menjadi urutan sub-kata yang berbeda, menyebabkan ekstraksi gagal. Tim mengusulkan SyncPool, yang mengelompokkan token yang memiliki hubungan prefiks sebelum penyematan, menghilangkan ambiguitas dari prinsipnya, mencapai ekstraksi andal untuk steganografi aman terbukti.

Dari Steganografi ke Watermark, Membawa "Tanpa Kerusakan Terbukti" Menuju Industri

Model besar AIGC pertama-tama mempelajari distribusi data alami, kemudian melakukan sampling sesuai distribusi untuk menghasilkan teks, gambar, audio, video, dll. Jika dapat dilakukan: menyematkan watermark dalam konten yang dihasilkan tanpa memengaruhi distribusi sampling, maka itu berarti penyematan watermark tidak memengaruhi kualitas generasi.

Steganografi Aman Terbukti secara teori menjamin bahwa data pembawa rahasia tidak dapat dibedakan dari data generasi normal, artinya penyematan informasi tidak mengubah distribusi sampling model—inilah definisi "Watermark Tanpa Kerusakan Kualitas Generasi Terbukti" (Provably Lossless Generation Quality Watermark). Watermark tidak memerlukan kapasitas sebesar steganografi, sehingga juga dapat menukar kapasitas untuk mendapatkan ketahanan (robustness).

Di bidang teks, sistem watermark tanpa kerusakan kualitas generasi terbukti yang dikembangkan tim USTC, bersifat plug-and-play, tidak perlu memodifikasi parameter model, mendukung identifikasi ketahanan bit tunggal dan atribusi model multi-bit, telah diterapkan pada platform seperti model besar Spark (星火) dan model GPT aman, melayani 13 ribu pengembang.

Sementara itu, penelitian watermark teks generasi tanpa kerusakan terbukti juga berkembang pesat di tingkat internasional:

2024, tim dari University of Maryland dkk. dengan "Unbiased Watermark for Large Language Models" (ICLR 2024 Spotlight) mendefinisikan watermark tanpa bias (unbiased) dan memberikan konstruksi umum;

Tahun yang sama, Stanford University mengusulkan watermark tanpa bias yang tahan distorsi (TMLR 2024);

2025, watermark tanpa bias multi-saluran MCmark (ACL 2025) meningkatkan ketahanan ekstraksi watermark sambil tetap mempertahankan ketidakbiasan yang ketat.

Di bidang gambar, tim USTC mengusulkan Gaussian Shading (CVPR 2024), yang memetakan watermark yang diacak secara kriptografis menjadi variabel laten Gaussian yang tidak dapat dibedakan dari generasi normal, kemudian melalui proses difusi bekerja pada seluruh ruang laten, tidak perlu pelatihan, plug-and-play, kinerja tanpa kerusakan dapat dibuktikan;

Gaussian Shading++ dan T2SMark (NeurIPS 2025) lebih lanjut memecahkan masalah ketahanan, perubahan parameter generasi, dan keanekaragaman generasi dalam penerapan nyata;

TAG-WM (ICCV 2025) memperkenalkan mekanisme ganda "watermark template + watermark informasi", yang secara simultan mencapai pelokalan pemalsuan (tamper localization) dan konfirmasi kepemilikan (ownership verification) dalam kondisi tanpa kerusakan;

SemBind (ICML 2026) mengikat watermark dengan semantik gambar melalui semantik masker, melindungi dari serangan pemalsuan kotak hitam.

Gambar 4 Watermark Gambar Generatif Tanpa Kerusakan Terbukti Gaussian Shading (CVPR 2024)

Dari Watermark Konten ke Watermark Model. Model itu sendiri juga merupakan aset digital penting yang memerlukan bukti kepemilikan yang andal, dan watermark model selalu menghadapi satu keraguan: apakah akan memengaruhi penggunaan normal model?

Berdasarkan konstruksi "Backdoor Tak Terdeteksi Terbukti" (Provably Undetectable Backdoor) yang diusulkan oleh penerima Turing Award Shafi Goldwasser dkk. di FOCS 2022, tim USTC mengusulkan protokol watermark model kotak hitam tanpa kerusakan kinerja terbukti (IEEE TDSC 2026): menggunakan message authentication code yang tidak dapat dipalsukan untuk membangun indikator cabang, sehingga probabilitas pengguna normal memicu cabang watermark dapat diabaikan secara komputasi, sehingga mereduksi sifat tanpa kerusakan kinerja ke keamanan kriptografi.

"Tanpa Kerusakan Terbukti" dengan demikian diperluas dari konten generasi ke model itu sendiri.

Dari "Keamanan Empiris" ke "Keamanan Terbukti"

Watermark tak kasat mata Anthropic menimbulkan kontroversi di hari pertama peluncurannya: penulis khawatir tentang atribusi kepenulisan, pengembang khawatir "apakah watermark akan menurunkan kualitas generasi". Pelopor industri memilih "lari cepat secara rekayasa" (engineering fast run), sementara tujuan "tepat sasaran, tidak merusak, tahan terhadap penulisan ulang dan penghapusan, dan mampu memberikan bukti yang pasti" membutuhkan dukungan teori yang kokoh.

Dari visi Shannon yang mengajukan masalah tantangan hingga kerangka teori Blum dkk., dari algoritma steganografi aman terbukti generatif pertama tahun 2018 hingga watermark model besar Spark dan watermark Claude, penyembunyian informasi telah berjalan selama tujuh puluh tujuh tahun, akhirnya melompat dari "keamanan empiris" ke "keamanan terbukti", mengubah "kekhawatiran watermark merusak model" menjadi "pembuktian tanpa kerusakan secara matematis"—baik untuk konten yang dihasilkan, maupun untuk model itu sendiri—menyediakan dukungan teknologi dengan jaminan teoretis untuk tata kelola konten AI.

Serangan dan Pertahanan Watermark

Merancang watermark sulit, menghapus watermark mudah. Sebenarnya, tidak juga. Merancang watermark harus mengejar tanpa kerusakan kualitas dan ketahanan secara bersamaan, sementara penyerang juga perlu menghapus watermark dengan kendala kualitas.

Tanpa kendala, watermark mudah dihapus. Menulis ulang kalimat demi kalimat untuk menghapus watermark, apakah itu masih dianggap sebagai konten yang dihasilkan oleh model asli? Mungkin lebih baik langsung menggunakan model open source lainnya untuk menghasilkan.

Seperti bidang keamanan lainnya, pihak penyerang dan bertahan berpermainan di bawah kendala masing-masing, dengan adanya serangan dan pertahanan, arah teknologi ini baru memiliki daya hidup.

Dan "tanpa kerusakan" (losslessness) adalah kendala dan tujuan bagi kedua belah pihak.

Pihak bertahan tidak ingin mengorbankan kualitas generasi karena menyematkan watermark; pihak penyerang juga tidak ingin menurunkan kualitas karena menghapus watermark.

Tidak pernah ada keamanan mutlak, makna pertahanan adalah menciptakan biaya sebesar mungkin bagi penyerangan. Esensi serangan dan pertahanan adalah permainan biaya, begitu juga dengan watermark.

Artikel ini berasal dari akun WeChat publik "XinZhiYuan" (新智元), penulis: XinZhiYuan

Trending Cryptos

Related Questions

QApa yang diumumkan Anthropic pada Agustus 2026 terkait model Claude?

APada 11 Agustus 2026, Anthropic mengumumkan bahwa mulai 2 Agustus, model Claude versi baru akan secara langsung menyematkan tanda air tak kasat mata yang tidak terlihat oleh mata manusia tetapi dapat dibaca oleh mesin ke dalam teks yang dihasilkannya. Ini memungkinkan konten yang dihasilkan AI untuk tetap dapat diidentifikasi dan dilacak sumbernya bahkan setelah disalin dan disebarluaskan.

QApa inti dari 'steganografi yang dapat dibuktikan keamanannya' (provably secure steganography) yang dibahas dalam artikel?

AInti dari steganografi yang dapat dibuktikan keamanannya adalah untuk secara matematis membuktikan bahwa data yang membawa pesan tersembunyi tidak dapat dibedakan dari data normal dalam hal distribusinya. Ini adalah lompatan dari keamanan 'empiris' atau pengalaman ke keamanan yang dapat dibuktikan secara teoritis, dengan prasyarat keras bahwa distribusi pembawa (carrier) dapat di-sampling secara tepat.

QMengapa kemunculan model generatif AI pada 2018 menjadi titik balik penting bagi penelitian steganografi?

AKemunculan model generatif AI menjadi titik balik karena model-model ini pertama-tama mempelajari distribusi data alami, lalu menghasilkan konten dengan melakukan sampling dari distribusi tersebut. Proses ini secara alami menyediakan 'distribusi eksplisit atau sampler yang sempurna', yang merupakan prasyarat yang sebelumnya sulit dipenuhi untuk membangun steganografi yang dapat dibuktikan keamanannya.

QApa saja perkembangan penting yang disebutkan untuk membuat steganografi generatif dapat digunakan secara praktis?

APerkembangan penting untuk kepraktisan meliputi: 1) Steganografi kunci publik, yang memungkinkan ekstraksi informasi asimetris tanpa perlu berbagi kunci rahasia terlebih dahulu. 2) Steganografi tanpa-kotak (boxless), di mana penerima tidak perlu memiliki akses ke model yang sama dengan pengirim untuk mengekstrak pesan. 3) Steganografi kotak-abu (greybox), yang memungkinkan ekstraksi dengan model yang lebih kecil di sisi penerima. 4) Penyelesaian ambiguitas sub-kata (token), memastikan ekstraksi pesan yang andal.

QBagaimana konsep 'steganografi yang dapat dibuktikan keamanannya' berkaitan dengan 'tanda air yang dapat dibuktikan tidak merusak kinerja' (provably performance无损 watermark) untuk konten AI?

AKonsepnya terkait erat. Steganografi yang dapat dibuktikan keamanannya menjamin bahwa data yang membawa pesan tidak dapat dibedakan dari data normal hasil generasi model, yang berarti penyematan pesan tidak mengubah distribusi sampling model. Konsep ini diterapkan pada tanda air dengan kapasitas yang lebih kecil (karena tanda air tidak membutuhkan kapasitas sebesar pesan rahasia). Jika penyematan tanda air tidak mengubah distribusi, maka secara teori kualitas generasi model tidak terpengaruh - inilah inti dari 'tanda air yang dapat dibuktikan tidak merusak kinerja' (provably performance无损 watermark).

Related Reads

Trump Hosts Leaders of Major Cryptocurrency Companies at White House Amid US Discussions on Bitcoin Purchases

On August 19, President Donald Trump hosted a meeting at the White House with leaders from major cryptocurrency companies and traditional financial institutions, placing digital asset regulation on his administration's agenda. The gathering included executives from Coinbase, Ripple, Robinhood, Kraken, Nasdaq, Intercontinental Exchange, and Chainlink. Trump criticized the previous Biden administration's regulatory approach for driving innovation overseas and declared an end to the "war on crypto." He highlighted actions like an executive order prohibiting U.S. federal agencies from promoting a central bank digital currency and emphasized the strategic importance of Bitcoin reserves. When asked about the U.S. government purchasing significant amounts of Bitcoin, Trump stated the idea is under consideration, relying on SEC Chairman Paul Atkins and others for a recommendation. Regulators like CFTC Chairman Mike Selig advocated for clear rules to foster trust and investment. SEC Chairman Paul Atkins discussed proposed "Crypto Asset Rules" to facilitate capital raises using digital assets. Industry leaders called for modernizing regulations and tokenization while protecting investors. Coinbase CEO Brian Armstrong urged Senators to pass the "Digital Asset Market Transparency Act" (CLARITY Act), with a key procedural vote scheduled for September 15. The meeting occurred amid ongoing Senate debates and ethical concerns regarding digital asset rules for federal officials.

cryptonews.ru34m ago

Trump Hosts Leaders of Major Cryptocurrency Companies at White House Amid US Discussions on Bitcoin Purchases

cryptonews.ru34m ago

Trading

Spot

Hot Articles

Discussions

Welcome to the HTX Community. Here, you can stay informed about the latest platform developments and gain access to professional market insights. Users' opinions on the price of S (S) are presented below.

活动图片