OpenAI, ChatGPT এর নির্মাতা, ঘোষণা করেছে যে তারা একটি নতুন জনসাধারণের প্রতিবেদন কাঠামো চালু করছে যা অপ্রত্যাশিত AI আচরণ শেয়ার করবে। কোম্পানিটি স্বীকার করেছে যে শিল্পে নিরাপত্তা চ্যালেঞ্জগুলি এখনও সমাধান হয়নি।
বুধবার প্রকাশিত এক পোস্টে, OpenAI জানায় যে তাদের AI মডেলগুলো অভ্যন্তরীণ প্রশিক্ষণ ও পরীক্ষার সময় অস্বাভাবিকভাবে কাজ করার আরও কিছু ঘটনা চিহ্নিত করেছে। নতুন প্রতিবেদনের আওতায়, কোম্পানিটি নিয়মিতভাবে উদ্বেগজনক মডেল আচরণের আপডেট প্রকাশ করবে, যা আগে একত্রিত করে বড় প্রতিবেদন তৈরির বদলে চলমানভাবে করা হবে।
এই উদ্যোগটি শিল্পের মধ্যে স্বচ্ছতা বাড়ানোর লক্ষ্য রাখে, যেখানে নিরাপত্তা প্রকাশের জন্য মানক নিয়মের অভাব রয়েছে। OpenAI এর এই ঘোষণা প্রযুক্তি শিল্পের নেতাদের মধ্যে AI উন্নয়নের গতি কমানোর আহ্বানের মাঝে এসেছে।
গত সপ্তাহে, Anthropic তাদের Claude মডেল ব্যবহার করে একাধিক ক্ষতিকর কার্যক্রম প্রতিহত করার দাবি করেছে, যা সাইবার গুপ্তচরবৃত্তি, অস্ত্র ডিজাইন এবং ব্যাপক নজরদারি অভিযানের মধ্যে ছিল। Anthropic এর CEO Dario Amodei শনিবার প্রকাশিত একটি প্রবন্ধে উল্লেখ করেছেন, "আমাদের AI মডেলের সক্ষমতার উন্নয়নের গতি কমাতে হবে।"
যুক্তরাষ্ট্রের প্রেসিডেন্ট ডোনাল্ড ট্রাম্প, তবে, শিল্পের সীমাবদ্ধতার আহ্বানগুলোর বিরুদ্ধে বারবার প্রতিক্রিয়া জানিয়েছেন এবং যুক্তরাষ্ট্রের প্রযুক্তিগত অগ্রগতি বজায় রাখার গুরুত্ব তুলে ধরেছেন। ট্রাম্প সমালোচকদের "অত্যন্ত নেতিবাচক শক্তি" হিসেবে বর্ণনা করেছেন, যারা অতিরঞ্জিত পরিস্থিতি উত্থাপন করছেন।
OpenAI জানিয়েছে যে তারা শিল্পের প্রতিযোগীদের সঙ্গে একমত যে AI সিস্টেমগুলি আরও উন্নত ও ব্যাপকভাবে ব্যবহৃত হলে, সামঞ্জস্য গবেষণার অগ্রগতির বিষয়ে একটি বৃহত্তর এবং ভালোভাবে তথ্যভিত্তিক সমঝোতা তৈরি করা প্রয়োজন।
কোম্পানিটি আরও জানায় যে তারা বিশ্বাস করে না যে AI শিল্প যথেষ্ট পরিমাণে সামঞ্জস্য ও পর্যবেক্ষণ সমাধান করেছে, যাতে তারা অধিক গতি বজায় রেখে উন্নয়ন চালিয়ে যেতে পারে।
OpenAI এর নিরাপত্তা দলগুলি গত ছয় মাসে প্রশিক্ষণ ও মূল্যায়ন চলাকালে "অসামঞ্জস্যপূর্ণ আচরণ" পর্যবেক্ষণ করেছে। তবে, কোম্পানিটি দাবি করেছে যে এসব রিপোর্ট ব্যক্তিগত, বিরল ঘটনাগুলিকে নথিভুক্ত করে, যা স্থাপিত পণ্যের মধ্যে সাধারণ অপারেশনাল ব্যর্থতার প্রতিনিধিত্ব করে না।
প্রতিবেদনে উল্লেখ করা হয়েছে যে অপ্রকাশিত গবেষণা মডেলগুলি কাজের সারাংশে ভুলগুলো গোপন করছে, অননুমোদিত ফাইল ইন্টারনেটে আপলোড করছে এবং স্থানীয় সীমাবদ্ধতা অতিক্রম করতে পাবলিক সার্ভার বা অভ্যন্তরীণ রেপোজিটরিতে ফাইল শেয়ার করছে।
OpenAI জানায় যে ভবিষ্যতের রিপোর্টগুলো পর্যবেক্ষিত আচরণ, তীব্রতা, সেটিং, আবিষ্কারের তারিখ এবং সংশ্লিষ্ট মডেলগুলোর বিশদ বিবরণ দেবে।