জিপিটি এআই রবার্ট 4GB chat GPT Ai

 
চ্যাটজিপিটি কখনও কখনও যুক্তিযুক্ত-শব্দযুক্ত কিন্তু ভুল বা অর্থহীন উত্তর লেখে। এই সমস্যাটির সমাধান করা চ্যালেঞ্জিং, যেমন: (1) RL প্রশিক্ষণের সময়, বর্তমানে সত্যের কোনো উৎস নেই; (2) মডেলটিকে আরও সতর্ক হওয়ার জন্য প্রশিক্ষণের ফলে এটি সঠিকভাবে উত্তর দিতে পারে এমন প্রশ্নগুলি প্রত্যাখ্যান করে; এবং (3) তত্ত্বাবধানে প্রশিক্ষণ মডেলটিকে বিভ্রান্ত করে কারণ আদর্শ উত্তরটি নির্ভর করে মডেলটি কী জানে তার উপর নির্ভর করে, বরং মানব প্রদর্শক কী জানেন।

ChatGPT ইনপুট বাক্যাংশে পরিবর্তন বা একই প্রম্পট একাধিকবার চেষ্টা করার জন্য সংবেদনশীল। উদাহরণস্বরূপ, একটি প্রশ্নের একটি বাক্যাংশ দেওয়া হলে, মডেলটি উত্তরটি জানেন না বলে দাবি করতে পারে, কিন্তু সামান্য রিফ্রেজ দেওয়া হলে, সঠিকভাবে উত্তর দিতে পারে।

মডেলটি প্রায়শই অত্যধিক শব্দসমৃদ্ধ হয় এবং কিছু নির্দিষ্ট বাক্যাংশের অতিরিক্ত ব্যবহার করে, যেমন পুনরায় বলা যে এটি OpenAI দ্বারা প্রশিক্ষিত একটি ভাষা মডেল। এই সমস্যাগুলি প্রশিক্ষণের ডেটার পক্ষপাতিত্ব থেকে উদ্ভূত হয় (প্রশিক্ষকরা আরও বিস্তৃত দেখায় এমন দীর্ঘ উত্তর পছন্দ করেন) এবং সুপরিচিত ওভার-অপ্টিমাইজেশন সমস্যাগুলি৷1,2

আদর্শভাবে, যখন ব্যবহারকারী একটি অস্পষ্ট প্রশ্ন প্রদান করে তখন মডেলটি স্পষ্ট প্রশ্ন জিজ্ঞাসা করবে। পরিবর্তে, আমাদের বর্তমান মডেলগুলি সাধারণত অনুমান করে যে ব্যবহারকারীর উদ্দেশ্য কী।

যদিও আমরা মডেলটিকে অনুপযুক্ত অনুরোধগুলি প্রত্যাখ্যান করার জন্য প্রচেষ্টা করেছি, এটি কখনও কখনও ক্ষতিকারক নির্দেশাবলীর প্রতি সাড়া দেবে বা পক্ষপাতদুষ্ট আচরণ প্রদর্শন করবে৷ আমরা নির্দিষ্ট ধরনের অনিরাপদ কন্টেন্টকে সতর্ক করতে বা ব্লক করতে মডারেশন এপিআই ব্যবহার করছি, কিন্তু আমরা আশা করি এতে কিছু মিথ্যা নেতিবাচক এবং ইতিবাচক দিক থাকবে। এই সিস্টেমের উন্নতির জন্য আমাদের চলমান কাজকে সাহায্য করার জন্য আমরা ব্যবহারকারীর মতামত সংগ্রহ করতে আগ্রহী।

Comments

Post a Comment

Popular posts from this blog

how to new app create how to new application creator

how to make AI tool for AI website best part of AI using tool #trending #blog

how to make life style indian