Anthropic-এর AI ওয়াটারমার্ক মুছতে টুল, ডেভেলপারদের সঙ্গে শুরু নতুন লড়াই

বেঙ্গালুরু: AI দিয়ে তৈরি লেখা শনাক্ত করতে প্রযুক্তি সংস্থাগুলি যখন অদৃশ্য ওয়াটারমার্ক ব্যবহারের দিকে এগোচ্ছে, তখন সেই চিহ্ন মুছে ফেলার জন্যও একের পর এক টুল…

anthropic-ai-watermark-removal-tools-developer-cat-and-mouse-game

বেঙ্গালুরু: AI দিয়ে তৈরি লেখা শনাক্ত করতে প্রযুক্তি সংস্থাগুলি যখন অদৃশ্য ওয়াটারমার্ক ব্যবহারের দিকে এগোচ্ছে, তখন সেই চিহ্ন মুছে ফেলার জন্যও একের পর এক টুল তৈরি করছেন ডেভেলপাররা। ফলে AI-জেনারেটেড কনটেন্ট শনাক্ত করা নিয়ে কার্যত একটি নতুন cat-and-mouse game শুরু হয়েছে। সম্প্রতি Anthropic জানিয়েছে, ভবিষ্যতের Claude মডেলগুলির তৈরি কনটেন্টে অদৃশ্য ও মেশিন-পাঠযোগ্য ওয়াটারমার্ক যুক্ত করা হবে। ঘোষণার কয়েক দিনের মধ্যেই ডেভেলপারদের একাংশ সেই ওয়াটারমার্ক এড়ানো বা পরিবর্তনের দাবি করা টুল প্রকাশ করতে শুরু করেছেন।

Advertisements

GitHub-এ জনপ্রিয় ওয়াটারমার্ক রিমুভাল টুল

ডেভেলপার Guillaume Meyer-এর তৈরি একটি টুল GitHub-এ দ্রুত জনপ্রিয় হয়েছে। Wired-এর রিপোর্ট অনুযায়ী, প্রকল্পটিতে ইতিমধ্যেই ১০০-র বেশি কনট্রিবিউটর যুক্ত হয়েছেন। এর পাশাপাশি AI-জেনারেটেড লেখার অদৃশ্য ওয়াটারমার্ক পরিবর্তন বা মুছে ফেলার দাবি করা আরও কিছু টুল অনলাইনে দেখা যাচ্ছে। এগুলির কার্যকারিতা এখনও নিশ্চিত নয়। কারণ Anthropic নিজস্ব ওয়াটারমার্ক শনাক্ত করার প্রযুক্তি প্রকাশ না করা পর্যন্ত কোনও তৃতীয় পক্ষের টুল সত্যিই ওয়াটারমার্ক সম্পূর্ণভাবে সরাতে পারছে কি না, তা স্বাধীনভাবে যাচাই করা কঠিন।

   

Claude-এর ওয়াটারমার্ক কীভাবে কাজ করবে?

Anthropic-এর পদ্ধতিটি Google DeepMind-এর SynthID-Text প্রযুক্তির সঙ্গে সম্পর্কিত। এই ধরনের প্রযুক্তিতে লেখার মধ্যে মানুষের চোখে ধরা না পড়া একটি নির্দিষ্ট প্যাটার্ন তৈরি করা হয়। মূলত মডেল কোন শব্দ বা বাক্যাংশ বেছে নিচ্ছে, সেই সম্ভাব্যতার মধ্যে নির্দিষ্ট ধরনের পরিসংখ্যানগত সংকেত রাখা হয়। সাধারণ পাঠকের কাছে লেখা স্বাভাবিকই দেখাবে। কিন্তু সংশ্লিষ্ট শনাক্তকরণ ব্যবস্থা জানবে কী ধরনের প্যাটার্ন খুঁজতে হবে। Anthropic জানিয়েছে, এই ওয়াটারমার্ক লেখার অর্থ, গুণমান বা পাঠযোগ্যতা পরিবর্তন করবে না।

কেন ওয়াটারমার্ক নিয়ে বিতর্ক?

সমস্যা হল, ওয়াটারমার্ক থাকলেই সবসময় প্রমাণ করা যাবে না যে পুরো লেখাটি Claude তৈরি করেছে। Anthropic-এর নিজের বক্তব্য অনুযায়ী, তাদের ওয়াটারমার্ক শুধু ইঙ্গিত করতে পারে যে Claude কোনও পর্যায়ে কনটেন্টটি প্রক্রিয়া করেছে। এটি আলাদা করে বলতে পারে না:
• Claude পুরো লেখাটি তৈরি করেছে কি না
• Claude শুধু লেখাটি সম্পাদনা করেছে কি না
• লেখাটি সম্পূর্ণ মানব-রচিত কি না
• অন্য কোনও AI মডেল লেখাটি তৈরি করেছে কি না

Advertisements

ফলে AI detection প্রযুক্তি ব্যাপকভাবে ব্যবহৃত হলে false positive-এর ঝুঁকি তৈরি হতে পারে। এর প্রভাব চাকরির আবেদন, শিক্ষার্থী, গবেষক বা পেশাদার লেখকদের উপর পড়তে পারে। কোনও মানুষ নিজে লেখা তৈরি করলেও detector ভুলভাবে AI ব্যবহারের সংকেত দিলে অন্যায়ভাবে সন্দেহ বা প্রত্যাখ্যানের পরিস্থিতি তৈরি হতে পারে।

EU AI Act-এর সঙ্গে সম্পর্ক

Anthropic-এর এই উদ্যোগের অন্যতম কারণ ইউরোপীয় ইউনিয়নের AI Act। আইনের Article 50(2)-এর অধীনে AI-উৎপাদিত synthetic content যাতে মেশিনের মাধ্যমে শনাক্ত করা যায়, সে বিষয়ে transparency requirements রয়েছে। এই নিয়ম অনুযায়ী AI-নির্মিত অডিও, ছবি, ভিডিও এবং টেক্সট চিহ্নিত করার ব্যবস্থা প্রয়োজন। নিয়ম লঙ্ঘনের ক্ষেত্রে কোম্পানিগুলির উপর বড় অঙ্কের জরিমানার বিধানও রয়েছে। Anthropic জানিয়েছে, Claude-এর আউটপুটে marking যুক্ত করার পাশাপাশি তারা একটি text-detection API চালু করার পরিকল্পনাও করছে।

কীভাবে ওয়াটারমার্ক এড়ানোর চেষ্টা হচ্ছে?

অনলাইনে প্রকাশিত কিছু পদ্ধতিতে AI-জেনারেটেড লেখাকে অন্য মডেলের মাধ্যমে বারবার rewrite করা, synonym পরিবর্তন করা এবং বাক্যের গঠন সামান্য বদলে দেওয়ার চেষ্টা করা হচ্ছে। কিছু টুল আবার invisible বা look-alike characters পরিবর্তন, paragraph-এর মধ্যে sentence-এর ক্রম বদল এবং শব্দের বিকল্প ব্যবহার করার মতো পদ্ধতির দাবি করছে। আরও একটি আলোচিত পদ্ধতিতে Claude-এর লেখা সংক্ষিপ্ত করে অন্য ভাষা বা dialect-এ অনুবাদ করে আবার ইংরেজিতে ফিরিয়ে আনার কথা বলা হয়েছে। এসব পদ্ধতি নিশ্চিতভাবে Anthropic-এর ওয়াটারমার্ক সরিয়ে ফেলতে পারে, এমন প্রমাণ এখনও নেই।

সামনে আরও কঠিন হতে পারে AI শনাক্তকরণ

Anthropic-এর মতো সংস্থাগুলি যদি ওয়াটারমার্কিংকে ব্যাপকভাবে ব্যবহার করে এবং একই সঙ্গে ডেভেলপাররা সেগুলি পরিবর্তন বা নষ্ট করার নতুন পদ্ধতি তৈরি করতে থাকেন, তাহলে AI-generated content শনাক্তকরণ আরও জটিল হয়ে উঠতে পারে। একদিকে থাকবে AI content watermarking ও detection, অন্যদিকে থাকবে সেই সংকেত পরিবর্তনের চেষ্টা। এর মধ্যে সবচেয়ে বড় প্রশ্ন হয়ে দাঁড়াবে, কোনও লেখায় AI-এর ভূমিকা কতটা ছিল এবং সেটি কতটা নির্ভরযোগ্যভাবে প্রমাণ করা সম্ভব।

Advertisements