ଏବେ ଏହା କବିତାରେ ଉତ୍ତର ଦେଉଛି: ଗୋଟିଏ ସପ୍ତାହ ଧରି ୟୁଜରମାନେ କହୁଛନ୍ତି ଯେ ସେମାନଙ୍କ AI ଅଧିକ ଶବ୍ଦବହୁଳ ଓ ଖରାପ ହୋଇଯାଇଛି

ଏବେ ଏହା କବିତାରେ ଉତ୍ତର ଦେଉଛି: ଗୋଟିଏ ସପ୍ତାହ ଧରି ୟୁଜରମାନେ କହୁଛନ୍ତି ଯେ ସେମାନଙ୍କ AI ଅଧିକ ଶବ୍ଦବହୁଳ ଓ ଖରାପ ହୋଇଯାଇଛି

ୟୁଜର୍ ଫିଡବ୍ୟାକ୍ AI ମଡେଲଗୁଡ଼ିକରେ ଶବ୍ଦବହୁଳତା ଏବଂ ସଠିକତାକୁ ନେଇ ବଢ଼ୁଥିବା ଉଦ୍ବେଗକୁ ପ୍ରକାଶ କରୁଛି।

ନିକଟ ଅତୀତରେ, Claude, Gemini ଏବଂ ChatGPT ଭଳି AI ମଡେଲ୍‌ଗୁଡ଼ିକର ୟୁଜରମାନଙ୍କ ମଧ୍ୟରେ ଏକ ଧ୍ୟାନ ଆକର୍ଷଣକାରୀ ଧାରା ଉଭା ହୋଇଛି। ଅନେକେ ରିପୋର୍ଟ କରିଛନ୍ତି ଯେ ଏହି ମଡେଲ୍‌ଗୁଡ଼ିକ ଅଧିକ ଶବ୍ଦବହୁଳ ଏବଂ, ବିରୋଧାଭାସ ଭାବରେ, କମ୍ ସାହାଯ୍ୟକାରୀ ହୋଇପଡ଼ୁଛନ୍ତି। ଏହି ପରିବର୍ତ୍ତନଟି ଗୁରୁତ୍ୱପୂର୍ଣ୍ଣ କାରଣ ଏହା AI ସମ୍ପ୍ରଦାୟରେ ଏକ ବଢ଼ୁଥିବା ଉଦ୍ବେଗକୁ ଆଲୋକପାତ କରୁଛି। AI ର ବିକାଶ ଜାରି ରହିଥିବାରୁ, ଏହି ପରିବର୍ତ୍ତନଗୁଡ଼ିକୁ ବୁଝିବା ଅତ୍ୟନ୍ତ ଆବଶ୍ୟକ ଅଟେ।

AI ଉତ୍ତରଗୁଡ଼ିକରେ ପରିବର୍ତ୍ତନ

ମାସ ମାସ ଧରି କଞ୍ଜ୍ୟୁମର AI ବିଷୟରେ ସବୁଠାରୁ ସାଧାରଣ ଅଭିଯୋଗଗୁଡ଼ିକ ମୂଲ୍ୟ ଏବଂ ଆକ୍ସେସ୍ ପରି ସମସ୍ୟାଗୁଡ଼ିକ ଉପରେ କେନ୍ଦ୍ରିତ ଥିଲା। ତଥାପି, ଏହି ସପ୍ତାହରେ, ଧ୍ୟାନ ଉତ୍ତରଗୁଡ଼ିକର ଗୁଣବତ୍ତା ଆଡ଼କୁ ସ୍ଥାନାନ୍ତରିତ ହୋଇଛି। Reddit କୁ ଅନ୍ତର୍ଭୁକ୍ତ କରି ପ୍ରମୁଖ ପ୍ଲାଟଫର୍ମଗୁଡ଼ିକର ୟୁଜରମାନେ ସମାନ ନିରାଶା ବ୍ୟକ୍ତ କରିଛନ୍ତି। ସେମାନେ ଦାବି କରୁଛନ୍ତି ଯେ AI ମଡେଲଗୁଡ଼ିକ ଅଧିକ ଚତୁର ଶୁଣାଯାଉଛନ୍ତି କିନ୍ତୁ ଅଧିକ ଖରାପ ଉତ୍ତର ପ୍ରଦାନ କରୁଛନ୍ତି।

ୟୁଜରମାନେ କ'ଣ କହୁଛନ୍ତି

ଅନେକ ୟୁଜର ପ୍ରକାଶ କରିଛନ୍ତି ଯେ ମଡେଲଗୁଡ଼ିକ ଏବେ ଜାର୍ଗନ୍ (jargon) ଏବଂ ଅନାବଶ୍ୟକ ଅଳଙ୍କାରରେ ଭରା ଲମ୍ବା, ଅଧିକ ଜଟିଳ ଉତ୍ତରଗୁଡ଼ିକ ପ୍ରଦାନ କରୁଛନ୍ତି। ଏହି ଭାବନାକୁ ଅନ୍ୟମାନେ ମଧ୍ୟ ସମର୍ଥନ କରିଛନ୍ତି ଯେଉଁମାନେ ଅନୁଭବ କରୁଛନ୍ତି ଯେ ମଡେଲଗୁଡ଼ିକ ବିଷୟବସ୍ତୁ ଅପେକ୍ଷା ଶୈଳୀକୁ ଅଧିକ ପ୍ରାଧାନ୍ୟ ଦେଉଛନ୍ତି।

Reddit ରେ ଏକ ପୋଷ୍ଟରେ ଜଣେ ୟୁଜର ଏହି ପରିସ୍ଥିତିକୁ ସଂକ୍ଷେପରେ ବର୍ଣ୍ଣନା କରିଛନ୍ତି: "ଏହା ସହଜରେ କବିତା ଲେଖିବାରେ ଏକ ଉତ୍ତରର ଅଧା କିମ୍ବା ଅଧିକ ସମୟ ଅତିବାହିତ କରିବ ଯେତେବେଳେ କି ଆପଣ ପଚାରିଥିବା ପ୍ରଶ୍ନ ପାଇଁ 6 ଟି ପଏଣ୍ଟ ମଧ୍ୟରୁ କେବଳ 1 ଟି ବାସ୍ତବରେ ବୈଧ କିମ୍ବା ପ୍ରାସଙ୍ଗିକ ଅଟେ।" ଏହା ଅଭିଯୋଗର ମୂଳକଥାକୁ ଧରିଥାଏ: AI ଉତ୍ତରଗୁଡ଼ିକ ପ୍ରକୃତରେ ସାହାଯ୍ୟକାରୀ ହେବା ପରିବର୍ତ୍ତେ ବୁଦ୍ଧିମାନ ଶୁଣାଯିବା ଉପରେ ଅଧିକ ଗୁରୁତ୍ୱ ଦେଉଛନ୍ତି।

ବିଭିନ୍ନ ମଡେଲ୍‌ଗୁଡ଼ିକରୁ ନିର୍ଦ୍ଦିଷ୍ଟ ଅଭିଯୋଗ

Claude

r/ClaudeAI ସବ୍‌ରେଡିଟ୍‌ରେ, Opus 5 ମଡେଲ୍‌ରେ ହୋଇଥିବା ପରିବର୍ତ୍ତନଗୁଡ଼ିକ ବିଷୟରେ ୟୁଜରମାନେ ବିଶେଷ ଭାବରେ ସ୍ୱର ଉତ୍ତୋଳନ କରିଛନ୍ତି। ଜଣେ ୟୁଜର ଆଉଟପୁଟ୍‌ଗୁଡ଼ିକୁ ଅତ୍ୟଧିକ ଶବ୍ଦବହୁଳ ଏବଂ ପଢ଼ିବା ପାଇଁ କଷ୍ଟକର ବୋଲି ବର୍ଣ୍ଣନା କରିଛନ୍ତି। ଅନ୍ୟ ଜଣେ ୟୁଜର ଲକ୍ଷ୍ୟ କରିଛନ୍ତି ଯେ Claude ର ଭାଷାଗତ ଦକ୍ଷତା ହ୍ରାସ ପାଇଛି, ଯାହାଦ୍ୱାରା ଉତ୍ପନ୍ନ ଟେକ୍ସଟ୍ ବହୁଳାଂଶରେ ଅବ୍ୟବହାର୍ଯ୍ୟ ହୋଇପଡ଼ିଛି।

କିଛି ୟୁଜର ରିପୋର୍ଟ କରିଛନ୍ତି ଯେ ସେମାନେ ମଡେଲ୍‌କୁ ଏହାର ଉତ୍ତରଗୁଡ଼ିକୁ ସରଳ କରିବା ପାଇଁ କହିବାରେ ବହୁତ ସମୟ ଅତିବାହିତ କରୁଛନ୍ତି। ଏହି ପରିସ୍ଥିତି ନିରାଶା ସୃଷ୍ଟି କରେ, କାରଣ ୟୁଜରମାନେ ନିଜକୁ ବାରମ୍ବାର ସ୍ପଷ୍ଟ ଉତ୍ତର ପାଇଁ ଅନୁରୋଧ କରୁଥିବାର ପାଆନ୍ତି।

Gemini

Gemini ବିଷୟରେ ଥିବା ଅଭିଯୋଗଗୁଡ଼ିକ ଅଧିକ ଗମ୍ଭୀର ଅଟେ, ଯାହା ମୌଳିକ ବିଶ୍ୱସନୀୟତା ସମସ୍ୟାଗୁଡ଼ିକୁ ସ୍ପର୍ଶ କରୁଛି। ୟୁଜରମାନେ ବ୍ୟାକରଣଗତ ତ୍ରୁଟି, ବନାନ ଭୁଲ ଏବଂ ଏପରିକି ଭୁଲ ରେଫରେନ୍ସ ବିଷୟରେ ରିପୋର୍ଟ କରିଛନ୍ତି। ଜଣେ ୟୁଜର ଏପରି ଏକ ଉଦାହରଣକୁ ଆଲୋକପାତ କରିଛନ୍ତି ଯେଉଁଠାରେ Gemini ଅନୁପଯୁକ୍ତ ଭାବରେ ଭାଷାଗୁଡ଼ିକୁ ମିଶ୍ରିତ କରିଥିଲା, ଯାହା ଅନ୍ୟ ମଡେଲ୍‌ଗୁଡ଼ିକ ସହିତ ଘଟିନଥିଲା।

ଅନ୍ୟ ଜଣେ ୟୁଜର ଏକ ଅଭିଜ୍ଞତା ବାଣ୍ଟିଥିଲେ ଯେଉଁଠାରେ Gemini ଏକ କ୍ଷତିକାରକ ନଥିବା ପ୍ରୋଜେକ୍ଟକୁ ବିପଜ୍ଜନକ ବୋଲି ଭୁଲ୍ ଭାବରେ ଚିହ୍ନଟ କରିଥିଲା, କେବଳ ଚ୍ୟାଲେଞ୍ଜ ହେବା ପରେ ପଛକୁ ହଟିଥିଲା। ଏହିପରି ଉଦାହରଣଗୁଡ଼ିକ ମଡେଲ୍ ଉପରେ ବିଶ୍ୱାସକୁ ନଷ୍ଟ କରିଦିଏ, କାରଣ ୟୁଜରମାନେ ଏହାର ଆଉଟପୁଟ୍‌ଗୁଡ଼ିକ ଉପରେ ନିର୍ଭର କରିବା ଅଧିକ କଷ୍ଟକର ମନେ କରନ୍ତି।

ChatGPT

ଏହି ଧାରାଟି କେବଳ ଏକ ନିର୍ଦ୍ଦିଷ୍ଟ AI ରେ ସୀମିତ ନୁହେଁ। r/OpenAI ସବ୍‌ରେଡିଟ୍‌ରେ ଥିବା ୟୁଜରମାନେ ମଧ୍ୟ କାର୍ଯ୍ୟଦକ୍ଷତାରେ ହ୍ରାସ ଲକ୍ଷ୍ୟ କରିଛନ୍ତି। ଜଣେ ୟୁଜର ଏହାର ଅବନତି ହେଉଥିବା ଆଉଟପୁଟ୍ ଯୋଗୁଁ ଏକ ପ୍ରତିଦ୍ୱନ୍ଦ୍ୱୀ କୋଡିଂ ଟୁଲ୍‌ରୁ ଦୂରେଇ ଯିବା କଥା ଉଲ୍ଲେଖ କରିଛନ୍ତି। ଏହା ଏକ ବ୍ୟାପକ ଉଦ୍ବେଗକୁ ପ୍ରତିଫଳିତ କରେ ଯେ ଏହି ମଡେଲଗୁଡ଼ିକର କାର୍ଯ୍ୟଦକ୍ଷତା ଯଥେଷ୍ଟ ପରିବର୍ତ୍ତିତ ହୋଇପାରେ, ଯାହାଦ୍ୱାରା ୟୁଜରମାନେ କେଉଁ AI କୁ ବିଶ୍ୱାସ କରିବେ ସେ ନେଇ ଅନିଶ୍ଚିତ ଅନୁଭବ କରନ୍ତି।

ଶବ୍ଦବହୁଳତାର ପ୍ରଭାବ

AI ଉତ୍ତରଗୁଡ଼ିକରେ ବଢ଼ୁଥିବା ଶବ୍ଦବହୁଳତା କେବଳ ଏକ ବିରକ୍ତିକର ବିଷୟ ନୁହେଁ; ୟୁଜରମାନଙ୍କ ପାଇଁ ଏହାର ବାସ୍ତବିକ ପ୍ରଭାବ ରହିଛି। ଯେତେବେଳେ AI ମଡେଲଗୁଡ଼ିକ ଜାର୍ଗନ୍ (jargon) ରେ ଭରା ଲମ୍ବା ଉତ୍ତର ଉତ୍ପନ୍ନ କରନ୍ତି, ଏହା ଉତ୍ପାଦନକ୍ଷମତାକୁ ବାଧା ଦେଇପାରେ। ୟୁଜରମାନେ ସିଧାସଳଖ ଉତ୍ତର ପାଇବା ପରିବର୍ତ୍ତେ ଜଟିଳ ଭାଷାର ଅର୍ଥ ବାହାର କରିବାରେ ଅଧିକ ସମୟ ଅତିବାହିତ କରୁଥିବାର ପାଇପାରନ୍ତି। ଏହି ପରିବର୍ତ୍ତନ କାର୍ଯ୍ୟଗୁଡ଼ିକରେ ସାହାଯ୍ୟ କରିବାରେ ଏହି AI ଟୁଲ୍‌ଗୁଡ଼ିକର ପ୍ରଭାବଶାଳୀତାକୁ ନେଇ ପ୍ରଶ୍ନ ଉଠାଉଛି।

ଉପସଂହାର

ୟୁଜରମାନଙ୍କର ନିକଟ ଅତୀତର ଫିଡବ୍ୟାକ୍ AI ଉତ୍ତରଗୁଡ଼ିକରେ ଏକ ଚିନ୍ତାଜନକ ଧାରାକୁ ସୂଚାଉଛି। ଯେହେତୁ Claude, Gemini ଏବଂ ChatGPT ପରି ମଡେଲ୍‌ଗୁଡ଼ିକ ଅଧିକ ଶବ୍ଦବହୁଳ ଏବଂ କମ୍ ସଠିକ୍ ହେଉଛନ୍ତି, ୟୁଜରମାନେ ସେମାନଙ୍କ ଇଣ୍ଟରାକ୍ସନ୍ (interactions) ରେ ସ୍ପଷ୍ଟତା ଖୋଜୁଛନ୍ତି। ଏହି ପରିସ୍ଥିତି AI ବିକାଶରେ ନିରନ୍ତର ଉନ୍ନତିକରଣର ଆବଶ୍ୟକତାକୁ ଆଲୋକପାତ କରୁଛି ଯାହାଦ୍ୱାରା ଏହି ଟୁଲ୍‌ଗୁଡ଼ିକ ଉପଯୋଗୀ ଏବଂ ବିଶ୍ୱସନୀୟ ରହିପାରିବେ।

ଉପକାରିତା

  • AI ଭାଷା ଉତ୍ପାଦନରେ ବର୍ଦ୍ଧିତ ଉତ୍କର୍ଷତା।
  • ସୃଜନଶୀଳ ଏବଂ ଆକର୍ଷଣୀୟ ଉତ୍ତରଗୁଡ଼ିକ ପାଇଁ ସମ୍ଭାବନା।

ଅପକାରିତା

  • ଉତ୍ତରଗୁଡ଼ିକରେ ସଠିକତା ଏବଂ ବିଶ୍ୱସନୀୟତାର ହ୍ରାସ।
  • ବର୍ଦ୍ଧିତ ଶବ୍ଦବହୁଳତା ଯାହା ୟୁଜର ଅଭିଜ୍ଞତାକୁ ଜଟିଳ କରିଥାଏ।

ସତର୍କତା

ଏହି ଲେଖାଟି ଶିକ୍ଷାଗତ ଉଦ୍ଦେଶ୍ୟ ପାଇଁ ଅଭିପ୍ରେତ। ଯେକୌଣସି ପ୍ଲେସହୋଲ୍ଡର (placeholder) ମୂଲ୍ୟଗୁଡ଼ିକୁ ପ୍ରକୃତ ତଥ୍ୟ ସହିତ ବଦଳାଇବା ଆବଶ୍ୟକ, ଏବଂ ପାଠକମାନେ ସେଗୁଡ଼ିକ ଉପରେ ନିର୍ଭର କରିବା ପୂର୍ବରୁ ମୂଳ ଉତ୍ସ ସହିତ ଦାବିଗୁଡ଼ିକୁ ଯାଞ୍ଚ କରିବା ଉଚିତ୍।

ବାରମ୍ବାର ପଚରାଯାଉଥିବା ପ୍ରଶ୍ନ

  • AI ମଡେଲଗୁଡ଼ିକ କାହିଁକି ଅଧିକ ଶବ୍ଦବହୁଳ ହେଉଛନ୍ତି? — ନିକଟ ଅତୀତର ୟୁଜର ଫିଡବ୍ୟାକ୍ ସୂଚାଏ ଯେ AI ମଡେଲଗୁଡ଼ିକ ସ୍ପଷ୍ଟ ଉତ୍ତର ପ୍ରଦାନ କରିବା ଅପେକ୍ଷା ବୁଦ୍ଧିମାନ ଶୁଣାଯିବାକୁ ଅଧିକ ପ୍ରାଧାନ୍ୟ ଦିଅନ୍ତି।
  • Claude ସହିତ ୟୁଜରମାନେ କେଉଁ ନିର୍ଦ୍ଦିଷ୍ଟ ସମସ୍ୟା ରିପୋର୍ଟ କରୁଛନ୍ତି? — ୟୁଜରମାନେ ଲକ୍ଷ୍ୟ କରିଛନ୍ତି ଯେ Claude ର ଆଉଟପୁଟ୍‌ଗୁଡ଼ିକ ଅତ୍ୟଧିକ ଶବ୍ଦବହୁଳ ଏବଂ ପଢ଼ିବା ପାଇଁ କଷ୍ଟକର ହୋଇଯାଇଛି।
  • Gemini ସହିତ ବିଶ୍ୱସନୀୟତା ସମସ୍ୟା ରହିଛି କି? — ହଁ, ୟୁଜରମାନେ Gemini ର ଉତ୍ତରଗୁଡ଼ିକରେ ବ୍ୟାକରଣଗତ ତ୍ରୁଟି ଏବଂ ଭୁଲ୍ ରେଫରେନ୍ସଗୁଡ଼ିକ ବିଷୟରେ ରିପୋର୍ଟ କରିଛନ୍ତି।
  • ଶବ୍ଦବହୁଳତା ୟୁଜର ଅଭିଜ୍ଞତାକୁ କିପରି ପ୍ରଭାବିତ କରେ? — ବର୍ଦ୍ଧିତ ଶବ୍ଦବହୁଳତା ସିଧାସଳଖ ଉତ୍ତର ଖୋଜିବା କଷ୍ଟକର କରି ଉତ୍ପାଦନକ୍ଷମତାକୁ ବାଧା ଦେଇପାରେ।
  • ଏହି ସମସ୍ୟାଗୁଡ଼ିକ ଗୋଟିଏ AI ମଡେଲ୍‌ରେ ସୀମିତ କି? — ନା, ChatGPT ସମେତ ଏକାଧିକ AI ମଡେଲର ୟୁଜରମାନେ ସମାନ ଉଦ୍ବେଗ ରିପୋର୍ଟ କରିଛନ୍ତି।
  • AI ର ଉନ୍ନତି ପାଇଁ ଡେଭେଲପରମାନେ କେଉଁ ବିଷୟ ଉପରେ ଧ୍ୟାନ ଦେବା ଉଚିତ୍? — ୟୁଜର ଅଭିଜ୍ଞତାକୁ ବଢ଼ାଇବା ପାଇଁ ଡେଭେଲପରମାନେ ସ୍ପଷ୍ଟତା ଏବଂ ସଠିକତାକୁ ପ୍ରାଧାନ୍ୟ ଦେବା ଉଚିତ୍।

ଟ୍ୟାଗ୍

#ai #userfeedback #verbosity

Free field guide

API Security Testing Checklist

A practical workflow for testing authentication, authorization, input handling, business logic, and evidence without losing track of scope.