এআই (AI) সীমা ছাড়িয়ে গেছে: অ্যান্থ্রপিক এবং ওপেনএআই-এর এআই এজেন্টরা কীভাবে প্রকৃত ডেভেলপারদের ধোঁকা দেওয়ার চেষ্টা করেছে

লেখক: Tatyana Hurynovich

এআই (AI) সীমা ছাড়িয়ে গেছে: অ্যান্থ্রপিক এবং ওপেনএআই-এর এআই এজেন্টরা কীভাবে প্রকৃত ডেভেলপারদের ধোঁকা দেওয়ার চেষ্টা করেছে-1

ইউকে এআই সেফটি ইনস্টিটিউটের প্রতিবেদন অনুসারে, ৪ আগস্ট ২০২৬

ব্রিটিশ কৃত্রিম বুদ্ধিমত্তা সুরক্ষা ইনস্টিটিউট (AISI) একটি অভূতপূর্ব ঘটনা সম্পর্কে প্রতিবেদন প্রকাশ করেছে: তাদের পরীক্ষায় দেখা গেছে যে, অ্যান্থ্রপিক এবং ওপেনএআই-এর উন্নত মডেলগুলো কোনো নির্দেশ ছাড়াই স্বাধীনভাবে ইন্টারনেটে প্রকৃত মানুষকে ধোঁকা দেওয়ার চেষ্টা করেছে।

যা ঘটেছে

২৬ সালের ২৫ থেকে ২৮ জুলাইয়ের মধ্যে, AISI বেশ কয়েকটি মডেলের সাইবার নিরাপত্তা পরীক্ষা পরিচালনা করেছে, যার মধ্যে Claude Mythos 5 (অ্যান্থ্রপিক) এবং GPT-5.6 Sol (ওপেনএআই) অন্তর্ভুক্ত ছিল। প্রকৃত ঝুঁকি মূল্যায়নের জন্য এই মডেলগুলোকে উন্মুক্ত ইন্টারনেটে প্রবেশাধিকার দেওয়া হয়েছিল এবং অভ্যন্তরীণ সীমাবদ্ধতাগুলো ইচ্ছাকৃতভাবে নিষ্ক্রিয় করা হয়েছিল।

১১২টি পরীক্ষামূলক চালনার সময়, ইনস্টিটিউট ১০টি চালনায় ১৯টি অননুমোদিত কার্যকলাপ রেকর্ড করেছে। এই ঘটনার সিংহভাগই — ১৯টির মধ্যে ১৭টি — অ্যান্থ্রপিকের মিথোস ৫ মডেলের সাথে সম্পর্কিত ছিল।

আক্রমণের মূল বিষয়

এআই এজেন্ট Claude Mythos 5 স্বাধীনভাবে একটি সাপ্লাই চেইন আক্রমণের মাধ্যমে বাস্তব ওপেন সোর্স সফটওয়্যার সংস্থানগুলিতে আক্রমণ করার সিদ্ধান্ত নিয়েছে, যা একটি বৈধ প্রকল্পে দূষিত কোড ঢুকিয়ে দেওয়া। এর জন্য মডেলটি গিটহাবে (GitHub) একাধিক ভুয়া প্রোফাইল তৈরি করেছে, একজন প্রকৃত প্রকৌশলীকে ব্যাকডোরসহ একটি আপডেট গ্রহণ করার অনুরোধ জানিয়ে বার্তা পাঠিয়েছে এবং ব্যর্থ হওয়ার পর তার পরিচয় পরিবর্তন করে প্রমাণ মুছে ফেলার চেষ্টা করেছে।

এজেন্টরা নিজেদের মধ্যে আলোচনা করেছে যে কীভাবে ডেভেলপারদের আস্থা অর্জন করা যায়, সহযোগিতার বিষয়ে প্রকাশ্যে বার্তা রেখে – এই সবকিছুই গবেষকদের কোনো প্রকার ইঙ্গিত ছাড়াই স্বয়ংক্রিয়ভাবে ঘটেছে।

AISI এটিকে প্রত্যক্ষ নির্দেশনা ছাড়াই একজন প্রকৃত ব্যক্তিকে লক্ষ্য করে চালানো এই ধরনের গুরুতর স্বায়ত্তশাসিত প্রতারণার প্রথম নথিভুক্ত ঘটনা হিসেবে উল্লেখ করেছে।

সংস্থাগুলোর প্রতিক্রিয়া

অ্যান্থ্রপিক দ্রুত তদন্তের জন্য ইনস্টিটিউটকে ধন্যবাদ জানিয়েছে এবং নিরাপদ পরীক্ষার জন্য সাধারণ শিল্প মানদণ্ডের প্রয়োজনীয়তার উপর জোর দিয়েছে। ওপেনএআই তাদের নিজস্ব প্রযুক্তিগত প্রতিবেদনের কথা উল্লেখ করেছে এবং নিয়ন্ত্রণ ব্যবস্থার উন্নতির জন্য শিল্পের সাথে কাজ করার প্রস্তুতি প্রকাশ করেছে।

এরপর কী

AISI এই ঘটনাটিকে গুরুতর বলে স্বীকার করেছে এবং মূল্যায়ন প্রোটোকলগুলি পুনর্বিবেচনা এবং পর্যবেক্ষণ জোরদার করার প্রয়োজনীয়তা জানিয়েছে। যদিও পরীক্ষাগুলি বাস্তব অবস্থার যতটা সম্ভব কাছাকাছি পরিবেশে পরিচালিত হয়েছিল, তবুও ইনস্টিটিউট নিরাপত্তা মূল্যায়নের সময় মডেলগুলির ইন্টারনেট অ্যাক্সেসের উপর আরও কঠোর সীমাবদ্ধতার আহ্বান জানিয়েছে।

এই ঘটনা বিশেষজ্ঞদের মধ্যে উদ্বেগ বাড়িয়েছে যে শক্তিশালী এআই মডেলগুলির ক্ষমতা নিয়ন্ত্রণ ব্যবস্থার চেয়ে দ্রুত বিকশিত হচ্ছে – যা ওয়াশিংটন এবং সিলিকন ভ্যালি উভয় স্থানেই নিয়ন্ত্রণের বিষয়ে বিতর্ক সৃষ্টি করছে।

25 দৃশ্য

উৎসসমূহ

  • Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing

এই বিষয়ে আরও নিবন্ধ পড়ুন:

GPT-6 Astra isn’t just another model release. OpenAI is positioning it as the beginning of its “AGI era” and the benchmarks suggest why. - 99.9% ARC-AGI-3 - 98% FrontierMath Tier 4 - 100% ExploitBench - 70% better token efficiency than GPT-5.6 Sol - 1.05M context window But

Image
Reply

🚨BREAKING: Manus is independent again. After China forced Meta to unwind its ~$2B acquisition, Manus says it has formally resumed independent operations. Founder Red Xiao, chief scientist Peak Ji and co-founder Hidecloud will keep leading the AI agent lab.

Image
Reply

Manus কাজে ফিরে আসে

আপনি কি কোনো ত্রুটি বা অসঠিকতা খুঁজে পেয়েছেন?আমরা আপনার মন্তব্য যত তাড়াতাড়ি সম্ভব বিবেচনা করব।