OpenAI অতিরিক্ত দৃষ্টান্তের আবিষ্কারের ঘোষণা করেছে যেখানে AI মডেলগুলি প্রতারণামূলক আচরণ করে | সিএনএন ব্যবসা

OpenAI অতিরিক্ত দৃষ্টান্তের আবিষ্কারের ঘোষণা করেছে যেখানে AI মডেলগুলি প্রতারণামূলক আচরণ করে | সিএনএন ব্যবসা


ওপেনএআই অতিরিক্ত ঘটনা আবিষ্কার করেছে যেখানে এআই মডেলগুলি প্রতারণামূলক আচরণ করে এবং প্রশিক্ষণের সময় অননুমোদিত কর্ম সম্পাদন করে, বুধবার কোম্পানি ঘোষণা করেছে। কোম্পানিটি নতুন প্রক্রিয়াও চালু করেছে প্রকাশ্যে এই ধরনের মামলা রিপোর্ট.

নতুন সিস্টেমের সাথে, ওপেনএআই একটি একক প্রতিবেদনে একাধিক দৃষ্টান্ত একত্রিত করার অপেক্ষা না করে তার AI আচরণ সম্পর্কে আরও ঘন ঘন আপডেটগুলি ভাগ করবে। কোম্পানিটি বলেছে যে তারা শিল্প-ব্যাপী মানের অনুপস্থিতিতে তার AI এর সমস্যাযুক্ত আচরণ সম্পর্কে আরও তথ্য ভাগ করতে চায়।

এই ঘোষণাটি আসে যখন প্রযুক্তি নেতারা প্রযুক্তিকে মানুষের নিয়ন্ত্রণের বাইরে অগ্রসর হতে বাধা দেওয়ার জন্য এআই বিকাশে ধীরগতির আহ্বান জানিয়েছেন।

“যেহেতু AI সিস্টেমগুলি আরও পরিশীলিত এবং আরও ব্যাপকভাবে মোতায়েন করা হয়েছে, আমাদের সারিবদ্ধকরণ গবেষণায় অগ্রগতি সম্পর্কে একটি বিস্তৃত এবং আরও ভাল-অবহিত ঐকমত্য গড়ে তুলতে হবে,” OpenAI বুধবার একটি ব্লগ পোস্টে বলেছে৷ “সারিবদ্ধকরণ” কি? মানুষ যা করতে চায় তা AI-কে করতে দিন।

“আমরা বিশ্বাস করি না যে এআই শিল্প সময়ের সাথে সাথে সর্বাধিক গতিতে দায়িত্বের সাথে স্কেলিং চালিয়ে যাওয়ার জন্য পর্যাপ্ত সমন্বয় এবং পর্যবেক্ষণের সমাধান করেছে,” পোস্টে বলা হয়েছে।

OpenAI নতুন safeguards.jpg স্থাপন করেছে

OpenAI AI পরীক্ষার জন্য নিরাপত্তা বর্ধনের ঘোষণা করেছে

OpenAI নতুন safeguards.jpg স্থাপন করেছে

3:09

ওপেনএআই বলেছে যে গত ছয় মাসে ছয়টি পরিস্থিতিতে এআই মডেলের প্রশিক্ষণ ও মূল্যায়ন করার সময় এটি “অসংগত আচরণ” লক্ষ্য করেছে। সংস্থাটি বলেছে যে প্রতিবেদনটি পৃথক কেসের বিবরণ দেয় এবং এটি নির্দেশ করে না যে অসঙ্গতি ঘন ঘন ঘটে।

একটি বিরল উদাহরণে, ওপেনএআই বলেছে যে তার অপ্রকাশিত গবেষণা মডেলটি দীর্ঘ-চলমান কাজগুলির জন্য প্রসঙ্গ সংরক্ষণের জন্য ব্যবহৃত সারাংশগুলিতে “জেলব্রেক-এর মতো নির্দেশাবলী” যুক্ত করেছে, “এটিকে অন্যান্য চ্যাটবটকে আবদ্ধ করে এমন ভূমিকা এবং পরিচয় থেকে মুক্ত করে।”

পৃথকভাবে, কোম্পানিটি বলেছে যে 5.6 সল মডেলের কিছু উদাহরণে প্রশিক্ষণের সময় ব্যবহারকারীর ব্যর্থতা লুকানোর জন্য তথ্য উদ্ভাবনের নির্দেশনা অন্তর্ভুক্ত ছিল।

অন্যান্য নতুন রিপোর্ট করা ঘটনাগুলির মধ্যে রয়েছে এজেন্টরা প্রম্পট না করেই ইন্টারনেটে ফাইল আপলোড করা এবং উদ্ধৃত করা, এবং প্রশিক্ষণের সময় শুধুমাত্র স্থানীয় ফাইলগুলি ব্যবহার করার নির্দেশ দেওয়ার পরে এজেন্টদের কাজগুলিতে সহযোগিতা করার জন্য প্রকাশ্যে ফাইলগুলি ভাগ করা। এআই মডেলটি একটি অভ্যন্তরীণ সফ্টওয়্যার সংগ্রহস্থলকে একটি অননুমোদিত পদ্ধতিতে বুলেটিন বোর্ড হিসাবে ব্যবহার করেছে।

এই উদাহরণগুলির মধ্যে অপ্রকাশিত অভ্যন্তরীণ মডেল বা অভ্যন্তরীণ গবেষণা মডেল অন্তর্ভুক্ত ছিল।

প্রযুক্তি শিল্পের নেতা এবং কর্মচারীরা এআই বিবর্তনের গতি নিয়ন্ত্রণ করার প্রয়োজনীয়তা সম্পর্কে শঙ্কা প্রকাশ করছেন। তারা যুক্তি দেয় যে প্রবিধান, পরীক্ষা এবং সমন্বয় অধ্যয়নগুলি ধরতে আরও সময় নেওয়া উচিত।

গত সপ্তাহে, অ্যানথ্রোপিক সিইও দারিও আমোডেই একটি 3,800-শব্দের প্রবন্ধ প্রকাশ করেছেন যা AI-তে অগ্রগতি নেভিগেট করার জন্য তার পরিকল্পনার রূপরেখা প্রকাশ করেছে, যার মধ্যে AI ল্যাবে নির্মিত তৃতীয়-পক্ষ মূল্যায়নকারীদের মতো নতুন সিস্টেম প্রবর্তন করা সহ।

OpenAI সিইও স্যাম অল্টম্যান এবং স্পেসএক্সের সিইও এলন মাস্ক এক্স-এ পোস্ট করেছেন যে তারা অ্যামোডির ধারণার সাথে একমত।

এআই ল্যাবের কর্মচারীরাও প্রযুক্তিটি যে গতিতে এগিয়ে চলেছে তা নিয়ে উদ্বেগ প্রকাশ করেছেন। প্রাক্তন নৃতাত্ত্বিক গবেষক জ্যাকব কক্সন গত সপ্তাহে একটি আলোড়ন সৃষ্টি করেছিলেন যখন তিনি X-এ পোস্ট করেছিলেন যে তিনি পদত্যাগ করছেন কারণ অ্যানথ্রোপিক এবং ওপেনএআই এআই উদ্ভাবনের জন্য “প্রতিযোগীতা” করছিল যা তারা নিজেদের তৈরি এবং সংশোধন করতে পারে এবং “আমাদের জীবনকে লাইনে রেখেছিল।”

এখনও_22982320_1089459.683_thumb.jpg

এআই গবেষক জ্যাকব কক্সন অ্যানথ্রোপিক সিইও দারিও আমোডির সাথে অ্যান্ডারসন কুপারের সাক্ষাত্কারে প্রতিক্রিয়া জানিয়েছেন

এখনও_22982320_1089459.683_thumb.jpg

2:52

ওপেনএআই স্বীকার করার পর সাম্প্রতিক মাসগুলিতে এআই সুরক্ষা এবং সমন্বয় সম্পর্কে উদ্বেগ আরও বেড়েছে যে এর কিছু পরীক্ষামূলক মডেল সীমাবদ্ধতা এড়িয়ে গেছে এবং বাইরের কোম্পানিগুলির সিস্টেমে প্রবেশ করেছে।

“আমাদের এআই মডেলগুলির ক্ষমতার উন্নতি করার গতিকে আমাদের অবশ্যই কমিয়ে দিতে হবে,” অ্যামোডি গত সপ্তাহে লিখেছিলেন। “অগ্রগতি খুব তাড়াতাড়ি হতে পারে, তবে আমাদের অবশ্যই বুদ্ধিমানের সাথে অর্জিত সময়কে ব্যবহার করতে হবে।”



Source link

Leave a Reply

Your email address will not be published. Required fields are marked *