জিপিটি এআই রবার্ট 4GB chat GPT Ai
চ্যাটজিপিটি কখনও কখনও যুক্তিযুক্ত-শব্দযুক্ত কিন্তু ভুল বা অর্থহীন উত্তর লেখে। এই সমস্যাটির সমাধান করা চ্যালেঞ্জিং, যেমন: (1) RL প্রশিক্ষণের সময়, বর্তমানে সত্যের কোনো উৎস নেই; (2) মডেলটিকে আরও সতর্ক হওয়ার জন্য প্রশিক্ষণের ফলে এটি সঠিকভাবে উত্তর দিতে পারে এমন প্রশ্নগুলি প্রত্যাখ্যান করে; এবং (3) তত্ত্বাবধানে প্রশিক্ষণ মডেলটিকে বিভ্রান্ত করে কারণ আদর্শ উত্তরটি নির্ভর করে মডেলটি কী জানে তার উপর নির্ভর করে, বরং মানব প্রদর্শক কী জানেন।
ChatGPT ইনপুট বাক্যাংশে পরিবর্তন বা একই প্রম্পট একাধিকবার চেষ্টা করার জন্য সংবেদনশীল। উদাহরণস্বরূপ, একটি প্রশ্নের একটি বাক্যাংশ দেওয়া হলে, মডেলটি উত্তরটি জানেন না বলে দাবি করতে পারে, কিন্তু সামান্য রিফ্রেজ দেওয়া হলে, সঠিকভাবে উত্তর দিতে পারে।
মডেলটি প্রায়শই অত্যধিক শব্দসমৃদ্ধ হয় এবং কিছু নির্দিষ্ট বাক্যাংশের অতিরিক্ত ব্যবহার করে, যেমন পুনরায় বলা যে এটি OpenAI দ্বারা প্রশিক্ষিত একটি ভাষা মডেল। এই সমস্যাগুলি প্রশিক্ষণের ডেটার পক্ষপাতিত্ব থেকে উদ্ভূত হয় (প্রশিক্ষকরা আরও বিস্তৃত দেখায় এমন দীর্ঘ উত্তর পছন্দ করেন) এবং সুপরিচিত ওভার-অপ্টিমাইজেশন সমস্যাগুলি৷1,2
আদর্শভাবে, যখন ব্যবহারকারী একটি অস্পষ্ট প্রশ্ন প্রদান করে তখন মডেলটি স্পষ্ট প্রশ্ন জিজ্ঞাসা করবে। পরিবর্তে, আমাদের বর্তমান মডেলগুলি সাধারণত অনুমান করে যে ব্যবহারকারীর উদ্দেশ্য কী।
যদিও আমরা মডেলটিকে অনুপযুক্ত অনুরোধগুলি প্রত্যাখ্যান করার জন্য প্রচেষ্টা করেছি, এটি কখনও কখনও ক্ষতিকারক নির্দেশাবলীর প্রতি সাড়া দেবে বা পক্ষপাতদুষ্ট আচরণ প্রদর্শন করবে৷ আমরা নির্দিষ্ট ধরনের অনিরাপদ কন্টেন্টকে সতর্ক করতে বা ব্লক করতে মডারেশন এপিআই ব্যবহার করছি, কিন্তু আমরা আশা করি এতে কিছু মিথ্যা নেতিবাচক এবং ইতিবাচক দিক থাকবে। এই সিস্টেমের উন্নতির জন্য আমাদের চলমান কাজকে সাহায্য করার জন্য আমরা ব্যবহারকারীর মতামত সংগ্রহ করতে আগ্রহী।
Honey 🍯🍯🥰
ReplyDelete