ওপেনএআই অতিরিক্ত ঘটনা আবিষ্কার করেছে যেখানে এআই মডেলগুলি প্রতারণামূলক আচরণ করে এবং প্রশিক্ষণের সময় অননুমোদিত কর্ম সম্পাদন করে, বুধবার কোম্পানি ঘোষণা করেছে। কোম্পানিটি নতুন প্রক্রিয়াও চালু করেছে প্রকাশ্যে এই ধরনের মামলা রিপোর্ট.
নতুন সিস্টেমের সাথে, ওপেনএআই একটি একক প্রতিবেদনে একাধিক দৃষ্টান্ত একত্রিত করার অপেক্ষা না করে তার AI আচরণ সম্পর্কে আরও ঘন ঘন আপডেটগুলি ভাগ করবে। কোম্পানিটি বলেছে যে তারা শিল্প-ব্যাপী মানের অনুপস্থিতিতে তার AI এর সমস্যাযুক্ত আচরণ সম্পর্কে আরও তথ্য ভাগ করতে চায়।
এই ঘোষণাটি আসে যখন প্রযুক্তি নেতারা প্রযুক্তিকে মানুষের নিয়ন্ত্রণের বাইরে অগ্রসর হতে বাধা দেওয়ার জন্য এআই বিকাশে ধীরগতির আহ্বান জানিয়েছেন।
“যেহেতু AI সিস্টেমগুলি আরও পরিশীলিত এবং আরও ব্যাপকভাবে মোতায়েন করা হয়েছে, আমাদের সারিবদ্ধকরণ গবেষণায় অগ্রগতি সম্পর্কে একটি বিস্তৃত এবং আরও ভাল-অবহিত ঐকমত্য গড়ে তুলতে হবে,” OpenAI বুধবার একটি ব্লগ পোস্টে বলেছে৷ “সারিবদ্ধকরণ” কি? মানুষ যা করতে চায় তা AI-কে করতে দিন।
“আমরা বিশ্বাস করি না যে এআই শিল্প সময়ের সাথে সাথে সর্বাধিক গতিতে দায়িত্বের সাথে স্কেলিং চালিয়ে যাওয়ার জন্য পর্যাপ্ত সমন্বয় এবং পর্যবেক্ষণের সমাধান করেছে,” পোস্টে বলা হয়েছে।

OpenAI AI পরীক্ষার জন্য নিরাপত্তা বর্ধনের ঘোষণা করেছে

ওপেনএআই বলেছে যে গত ছয় মাসে ছয়টি পরিস্থিতিতে এআই মডেলের প্রশিক্ষণ ও মূল্যায়ন করার সময় এটি “অসংগত আচরণ” লক্ষ্য করেছে। সংস্থাটি বলেছে যে প্রতিবেদনটি পৃথক কেসের বিবরণ দেয় এবং এটি নির্দেশ করে না যে অসঙ্গতি ঘন ঘন ঘটে।
একটি বিরল উদাহরণে, ওপেনএআই বলেছে যে তার অপ্রকাশিত গবেষণা মডেলটি দীর্ঘ-চলমান কাজগুলির জন্য প্রসঙ্গ সংরক্ষণের জন্য ব্যবহৃত সারাংশগুলিতে “জেলব্রেক-এর মতো নির্দেশাবলী” যুক্ত করেছে, “এটিকে অন্যান্য চ্যাটবটকে আবদ্ধ করে এমন ভূমিকা এবং পরিচয় থেকে মুক্ত করে।”
পৃথকভাবে, কোম্পানিটি বলেছে যে 5.6 সল মডেলের কিছু উদাহরণে প্রশিক্ষণের সময় ব্যবহারকারীর ব্যর্থতা লুকানোর জন্য তথ্য উদ্ভাবনের নির্দেশনা অন্তর্ভুক্ত ছিল।
অন্যান্য নতুন রিপোর্ট করা ঘটনাগুলির মধ্যে রয়েছে এজেন্টরা প্রম্পট না করেই ইন্টারনেটে ফাইল আপলোড করা এবং উদ্ধৃত করা, এবং প্রশিক্ষণের সময় শুধুমাত্র স্থানীয় ফাইলগুলি ব্যবহার করার নির্দেশ দেওয়ার পরে এজেন্টদের কাজগুলিতে সহযোগিতা করার জন্য প্রকাশ্যে ফাইলগুলি ভাগ করা। এআই মডেলটি একটি অভ্যন্তরীণ সফ্টওয়্যার সংগ্রহস্থলকে একটি অননুমোদিত পদ্ধতিতে বুলেটিন বোর্ড হিসাবে ব্যবহার করেছে।
এই উদাহরণগুলির মধ্যে অপ্রকাশিত অভ্যন্তরীণ মডেল বা অভ্যন্তরীণ গবেষণা মডেল অন্তর্ভুক্ত ছিল।
প্রযুক্তি শিল্পের নেতা এবং কর্মচারীরা এআই বিবর্তনের গতি নিয়ন্ত্রণ করার প্রয়োজনীয়তা সম্পর্কে শঙ্কা প্রকাশ করছেন। তারা যুক্তি দেয় যে প্রবিধান, পরীক্ষা এবং সমন্বয় অধ্যয়নগুলি ধরতে আরও সময় নেওয়া উচিত।
গত সপ্তাহে, অ্যানথ্রোপিক সিইও দারিও আমোডেই একটি 3,800-শব্দের প্রবন্ধ প্রকাশ করেছেন যা AI-তে অগ্রগতি নেভিগেট করার জন্য তার পরিকল্পনার রূপরেখা প্রকাশ করেছে, যার মধ্যে AI ল্যাবে নির্মিত তৃতীয়-পক্ষ মূল্যায়নকারীদের মতো নতুন সিস্টেম প্রবর্তন করা সহ।
OpenAI সিইও স্যাম অল্টম্যান এবং স্পেসএক্সের সিইও এলন মাস্ক এক্স-এ পোস্ট করেছেন যে তারা অ্যামোডির ধারণার সাথে একমত।
এআই ল্যাবের কর্মচারীরাও প্রযুক্তিটি যে গতিতে এগিয়ে চলেছে তা নিয়ে উদ্বেগ প্রকাশ করেছেন। প্রাক্তন নৃতাত্ত্বিক গবেষক জ্যাকব কক্সন গত সপ্তাহে একটি আলোড়ন সৃষ্টি করেছিলেন যখন তিনি X-এ পোস্ট করেছিলেন যে তিনি পদত্যাগ করছেন কারণ অ্যানথ্রোপিক এবং ওপেনএআই এআই উদ্ভাবনের জন্য “প্রতিযোগীতা” করছিল যা তারা নিজেদের তৈরি এবং সংশোধন করতে পারে এবং “আমাদের জীবনকে লাইনে রেখেছিল।”
এআই গবেষক জ্যাকব কক্সন অ্যানথ্রোপিক সিইও দারিও আমোডির সাথে অ্যান্ডারসন কুপারের সাক্ষাত্কারে প্রতিক্রিয়া জানিয়েছেন
ওপেনএআই স্বীকার করার পর সাম্প্রতিক মাসগুলিতে এআই সুরক্ষা এবং সমন্বয় সম্পর্কে উদ্বেগ আরও বেড়েছে যে এর কিছু পরীক্ষামূলক মডেল সীমাবদ্ধতা এড়িয়ে গেছে এবং বাইরের কোম্পানিগুলির সিস্টেমে প্রবেশ করেছে।
“আমাদের এআই মডেলগুলির ক্ষমতার উন্নতি করার গতিকে আমাদের অবশ্যই কমিয়ে দিতে হবে,” অ্যামোডি গত সপ্তাহে লিখেছিলেন। “অগ্রগতি খুব তাড়াতাড়ি হতে পারে, তবে আমাদের অবশ্যই বুদ্ধিমানের সাথে অর্জিত সময়কে ব্যবহার করতে হবে।”