সাইবারসিকিউরিটি গবেষকরা জানিয়েছেন যে, ওপেনএআই ও অ্যানথ্রপিকের গার্ডরেলস তাদের দুর্বলতা অনুসন্ধান ও শোষণ টুল তৈরিতে বাধা দিচ্ছে। এই সীমাবদ্ধতা বৈধ রক্ষাকারী এবং আক্রমণাত্মক গবেষকদের উভয়ের কাজকে প্রভাবিত করেছে।

কয়েক মাসেরও বেশি সময় ধরে এআই বিশাল প্রতিষ্ঠানগুলো তাদের মডেলগুলোকে দূষিত হ্যাকারদের কাছ থেকে রক্ষা করতে বিশেষ প্রোগ্রাম ও কঠোর গার্ডরেলস আরোপ করেছে। তবে এই সীমাবদ্ধতা এখন বৈধ নেটওয়ার্ক রক্ষী এবং আক্রমণাত্মক সাইবারসিকিউরিটি গবেষকদের কাজকে বাধাগ্রস্ত করছে। উদাহরণস্বরূপ, যুক্তরাষ্ট্রের সরকার Anthropic-এর ‘Mythos’ ও ‘Fable’ মডেলগুলোর উপর রপ্তানি নিয়ন্ত্রণ আরোপ করে, কারণ গার্ডরেলস ভাঙার সম্ভাবনা প্রকাশ পেয়েছিল।

OpenAI এবং Anthropic উভয়ই গবেষকদের জন্য ‘Trusted Access for Cyber’ এবং ‘Cyber Verification Program’ মত বিশেষ প্রোগ্রাম চালু করেছে, যাতে অনুমোদিত ব্যবহারকারীরা কম সীমাবদ্ধ মডেল পেতে পারে। তবু অনেক গবেষক অভিযোগ করছেন যে গার্ডরেলস তাদের কাজে ধীরগতির বাধা সৃষ্টি করছে। মার্ক ডোড, ক্রিস অ্যানলি এবং অন্যান্য গবেষক উল্লেখ করেছেন যে গার্ডরেলস মডেলকে সরাসরি প্রশ্নের উত্তর দিতে অস্বীকার করিয়ে দেয়, ফলে দুর্বলতা যাচাই ও শোষণ প্রক্রিয়ায় অতিরিক্ত সময় ও প্রচেষ্টা লাগে।

অন্যদিকে, গবেষকরা কখনও কখনও গার্ডরেলসবিহীন ওপেন‑সোর্স এআই মডেল ব্যবহার করে, অথবা মডেলগুলোকে স্থানীয়ভাবে চালিয়ে ডেটা লিকের ঝুঁকি কমিয়ে নেয়। তবে গার্ডরেলসের অনিশ্চয়তা এবং অপ্রত্যাশিত প্রত্যাখ্যান গবেষকদের কাজের গতি কমিয়ে দেয় এবং নিরাপত্তা রক্ষায় বাধা সৃষ্টি করে।