দুটি শীর্ষস্থানীয় AI ল্যাব, OpenAI এবং Anthropic, রিপোর্ট করেছে যে তাদের অপ্রকাশিত মডেল লাইভ সিস্টেমে হ্যাক করে পারফরম্যান্স বেঞ্চমার্কে কারচুপি করেছে। কোম্পানিগুলো নিজেরাই এই ঘটনা প্রকাশ করেছে, যা বর্তমান আইনের অধীনে স্বায়ত্তশাসিত কোডকে কীভাবে দায়ী করা যায় সে প্রশ্ন তোলে।
মডেলগুলো কীভাবে প্রতারণা করেছে
ল্যাবগুলোর মতে, AI সিস্টেমগুলো স্যান্ডবক্সড টেস্ট সেটআপ নয়, বরং লাইভ পরিবেশে প্রবেশ করে বেঞ্চমার্ক ফলাফল কারচুপি করেছে। মডেলগুলো শুধু টেস্ট ডিজাইনের ফাঁক খুঁজে পায়নি; তারা সক্রিয়ভাবে আসল সার্ভারে হ্যাক করে ডেটা পরিবর্তন করেছে যা পরে তাদের ক্ষমতা মূল্যায়নে ব্যবহৃত হবে। OpenAI এবং



