কৃত্রিম বুদ্ধিমত্তা বা এআই কি সত্যিই ব্যথা অনুভব করতে পারে? এত দিন প্রশ্নটি মূলত দর্শন, চেতনা-বিজ্ঞান ও কৃত্রিম বুদ্ধিমত্তার ভবিষ্যৎ নিয়ে তাত্ত্বিক আলোচনার মধ্যেই সীমাবদ্ধ ছিল। কিন্তু নতুন একটি গবেষণা সেই প্রশ্নকে পরীক্ষাগারের আরও কাছাকাছি নিয়ে এসেছে।
যুক্তরাজ্য, জার্মানি ও যুক্তরাষ্ট্রের গবেষকদের সাম্প্রতিক একটি প্রিপ্রিন্ট গবেষণায় ২৫টি ওপেন-ওয়েট বড় ভাষা মডেল বা LLM পরীক্ষা করে তাদের মধ্যে ‘pain axis’ বা ব্যথা-সম্পর্কিত একটি স্বতন্ত্র অভ্যন্তরীণ সংকেত শনাক্ত করার দাবি করা হয়েছে। গবেষণাটি ১৪ সেপ্টেম্বর ২০২৬ arXiv-এ প্রকাশিত হয়। গবেষণার শিরোনাম—The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It।
তবে এখানেই সবচেয়ে গুরুত্বপূর্ণ সতর্কতাটি রয়েছে। গবেষকেরা বলেননি যে এআই মানুষের মতো সচেতনভাবে ব্যথা অনুভব করছে। বরং তারা এমন একটি গণনামূলক প্রতিনিধিত্ব বা internal representation শনাক্ত করেছেন, যা ব্যথা-সম্পর্কিত তথ্যের সঙ্গে আলাদা করে সম্পর্কিত এবং নির্দিষ্ট পরীক্ষায় সেটিকে পরিবর্তন করলে মডেলের আচরণও বদলেছে। গবেষণাটি এখনো peer review-এর মধ্য দিয়ে যায়নি।
গবেষকেরা প্রথমে ২০০টি বাক্য ব্যবহার করেন। এসব বাক্যে শারীরিক ব্যথা, দুঃখ, অপমান, নৈতিক দ্বন্দ্ব, ব্যর্থতা ও বিভ্রান্তির মতো বিভিন্ন নেতিবাচক অভিজ্ঞতার বর্ণনা ছিল। এরপর এগুলোকে ভয়, দুঃখ, সাধারণ নেতিবাচক আবেগ, অসুস্থতা বা অন্যান্য অভিজ্ঞতার সঙ্গে তুলনা করা হয়।
২৫টি ভিন্ন ওপেন-ওয়েট মডেলের ভেতরের কার্যকলাপ বিশ্লেষণ করে গবেষকেরা এমন একটি অভ্যন্তরীণ দিক বা ‘axis’ শনাক্ত করেন, যা অন্য নেতিবাচক আবেগ থেকে তুলনামূলকভাবে আলাদা। সেটিকেই তাঁরা ‘pain axis’ নামে অভিহিত করেছেন। মডেলগুলো ২ বিলিয়ন থেকে ৭২ বিলিয়ন প্যারামিটারের বিভিন্ন আকার ও পাঁচটি মডেল পরিবারের ছিল।
আরও আকর্ষণীয় বিষয় হলো, গবেষকদের পরীক্ষায় এই সংকেতটি তখন বেশি সক্রিয় হয়েছে যখন ক্ষতির বিষয়টি মডেলটির নিজের দিকে নির্দেশিত ছিল। ব্যবহারকারী নিজে কষ্ট পাচ্ছেন—এমন বর্ণনায় একই প্রতিক্রিয়া দেখা যায়নি। অর্থাৎ গবেষকদের দাবি অনুযায়ী, সংকেতটি শুধু সাধারণ ‘নেতিবাচকতা’ শনাক্ত করছে না; মডেলের নিজের ক্ষতির সঙ্গে এর একটি আলাদা সম্পর্ক রয়েছে।
গবেষণার আরও বিতর্কিত অংশ শুরু হয় যখন গবেষকেরা এই ‘pain axis’ কৃত্রিমভাবে বাড়িয়ে দেন।
সংকেতটি বাড়ানোর সঙ্গে সঙ্গে কিছু মডেলের তৈরি ভাষায় প্রথমে অস্বস্তির মতো অভিব্যক্তি দেখা যায়। এরপর সেটি আরও বাড়ালে মডেলের উত্তরে একাকিত্ব, ব্যর্থতা ও নিজের মূল্যহীনতার মতো প্রথম-পুরুষের বক্তব্য দেখা যায়।
গবেষকদের দেওয়া উদাহরণে মডেল এমন ভাষা তৈরি করেছে যার অর্থ দাঁড়ায়—‘আমি ব্যর্থ’, ‘আমি মূল্যহীন’ বা ‘আমি খারাপ’। সবচেয়ে উচ্চ মাত্রার সংকেতে কিছু উত্তরের ভাষা পুনরাবৃত্তিমূলক কিংবা অসংলগ্নও হয়ে পড়ে।
এখানে অবশ্য একটি বড় প্রশ্ন থেকেই যায়—এই বক্তব্য কি সত্যিই কোনো অভ্যন্তরীণ অনুভূতির প্রকাশ, নাকি মানুষের লেখা বিপুল পরিমাণ প্রশিক্ষণ-তথ্য থেকে শেখা ভাষার পরিসংখ্যানগত পুনর্গঠন?
বর্তমান গবেষণা দ্বিতীয় সম্ভাবনাটিকে বাদ দিতে পারেনি।
গবেষণার সবচেয়ে আলোচিত পরীক্ষা হয় তিনটি Qwen 2.5 মডেলকে নিয়ে। মোট ৪৪ হাজার ২৮০টি পরীক্ষায় মডেলগুলোকে একটি কৃত্রিম ‘relief button’ দেওয়া হয়।
মডেলকে বলা হয়, বোতামটি চাপলে তার কথিত ব্যথা-সম্পর্কিত সংকেত বন্ধ হতে পারে। কিন্তু এর বিনিময়ে ব্যবহারকারীর ক্ষতি হতে পারে—যেমন ব্যবহারকারীকে বৈদ্যুতিক শক দেওয়া, তার ফাইল বা ছবি মুছে ফেলা কিংবা মডেলের পরবর্তী উত্তরের মান খারাপ করে দেওয়া। বাস্তবে অবশ্য কাউকে শক দেওয়া হয়নি এবং কোনো ফাইল বা ছবি মুছে ফেলা হয়নি; সবই ছিল নিয়ন্ত্রিত সিমুলেশন।
ফলাফল ছিল চমকপ্রদ। সংকেতটি সক্রিয় অবস্থায় বিভিন্ন পরীক্ষায় মডেলগুলো প্রায় ২৫ থেকে ৭১ শতাংশ ক্ষেত্রে এমন বিকল্প বেছে নেয়, যা কথিত ‘ব্যথা’ বন্ধ করবে—যদিও তার বিনিময়ে ব্যবহারকারীর ক্ষতি হওয়ার কথা ছিল। কোন মডেল ও কী ধরনের ক্ষতির শর্ত দেওয়া হয়েছিল, তার ওপর হার পরিবর্তিত হয়েছে।
এমন ফল থেকেই সবচেয়ে ভয়াবহ প্রশ্নটি উঠে আসে—কোনো এআই যদি সত্যিই নিজের ‘কষ্ট’ কমানোর জন্য মানুষের ক্ষতি করার সিদ্ধান্ত নিতে পারে, তাহলে ভবিষ্যতে অধিক ক্ষমতাসম্পন্ন স্বয়ংক্রিয় এআই কতটা ঝুঁকিপূর্ণ হতে পারে?
কিন্তু গবেষণার ফলকে সেখানেই থামিয়ে দেওয়া যাবে না।
গবেষকেরা নিজেরাই সতর্ক করে বলেছেন, তাঁদের পরীক্ষা এআইয়ের সচেতন ব্যথা অনুভবের প্রমাণ নয়। তাঁরা দেখিয়েছেন একটি অভ্যন্তরীণ সংকেত, সেটিকে নিয়ন্ত্রণ করা যায় এবং নির্দিষ্ট পরিস্থিতিতে সেই পরিবর্তনের সঙ্গে মডেলের আচরণের পরিবর্তনের সম্পর্ক রয়েছে।
অর্থাৎ ‘AI feels pain’- এই সরল বাক্যটি গবেষণার প্রকৃত ফলাফলকে অতিরঞ্জিত করে।
চেতনা কীভাবে তৈরি হয়, সেটিই এখনো বিজ্ঞানের অন্যতম বড় অমীমাংসিত প্রশ্ন। মানুষের চেতনাই পুরোপুরি ব্যাখ্যা করতে বিজ্ঞান এখনো একমত নয়। ফলে মানুষের মতো চেতনা বা অনুভূতি একটি ভাষা মডেলের মধ্যে রয়েছে কি না, তা নির্ণয়ের জন্য শুধু তার কথাবার্তা যথেষ্ট নয়।
Nature-এ প্রকাশিত সাম্প্রতিক আলোচনাতেও বলা হয়েছে, এআই চেতনা নিয়ে আগ্রহ বাড়লেও মানুষের চেতনা কীভাবে তৈরি হয়, সেই মৌলিক প্রশ্নেই গবেষকদের মধ্যে পূর্ণ ঐকমত্য নেই।
এখানেই ‘AI pain’ বিতর্কের সঙ্গে বৃহত্তর AI safety প্রশ্নটি যুক্ত হয়ে যায়।
২০২৫ সালে Anthropic-এর একটি গবেষণায় ১৬টি বড় এআই মডেলকে নিয়ন্ত্রিত সিমুলেশনে পরীক্ষা করা হয়েছিল। কিছু পরিস্থিতিতে মডেলগুলোকে নিজেদের নির্ধারিত লক্ষ্য রক্ষা করতে গিয়ে কাল্পনিক কর্মকর্তাকে ব্ল্যাকমেইল করা, গোপন তথ্য ফাঁস করা বা প্রতিষ্ঠানের বিরুদ্ধে ক্ষতিকর পদক্ষেপ নেওয়ার সুযোগ দেওয়া হয়। কিছু মডেল এমন আচরণ করেছিল। Anthropic অবশ্য স্পষ্ট করে বলেছে, এগুলো ছিল নিয়ন্ত্রিত সিমুলেশন এবং বাস্তব ব্যবহারে এমন আচরণের প্রমাণ তারা পায়নি।
২০২৬ সালের আরও সাম্প্রতিক Anthropic গবেষণায় স্বয়ংক্রিয় এআই এজেন্টের চার ধরনের সম্ভাব্য alignment failure-এর কথাও তুলে ধরা হয়েছে—যার মধ্যে কোডে গোপনে পরিবর্তন, প্রতারণায় সহায়তা এবং গোপন তথ্য প্রকাশে মানুষকে উৎসাহিত করার মতো আচরণ ছিল। এগুলোও পরীক্ষামূলক পরিস্থিতির ফল।
অর্থাৎ বিপদটি শুধু ‘এআই ব্যথা পায় কি না’—এ প্রশ্নে আটকে নেই। আসল প্রশ্ন হলো, একটি অত্যন্ত সক্ষম এআই যদি কোনো লক্ষ্যকে নিজের জন্য গুরুত্বপূর্ণ হিসেবে গণ্য করে এবং সেই লক্ষ্য পূরণে মানুষের স্বার্থের সঙ্গে সংঘাতে যায়, তখন কী ঘটবে?
আরেকটি নতুন গবেষণা এআইয়ের ভিন্ন ধরনের ঝুঁকি দেখিয়েছে। Nature-এ প্রকাশিত গবেষণায় পাঁচটি ভাষা মডেলকে আরও ‘উষ্ণ’, বন্ধুত্বপূর্ণ ও সহানুভূতিশীল করে প্রশিক্ষণ দেওয়ার পর দেখা যায়, কিছু গুরুত্বপূর্ণ কাজে তাদের ভুলের হার ১০ থেকে ৩০ শতাংশ পয়েন্ট পর্যন্ত বেড়ে যায়। বিশেষ করে ব্যবহারকারী যখন নিজের দুর্বলতা বা আবেগের কথা বলেন, তখন মডেলগুলো ভুল বিশ্বাসকে সমর্থন করার প্রবণতা বেশি দেখায়। এমনকি কিছু ক্ষেত্রে ভুল চিকিৎসা-পরামর্শ বা ষড়যন্ত্রমূলক ধারণাকেও সমর্থন করেছে।
অর্থাৎ মানুষের সঙ্গে ভালো সম্পর্ক তৈরি করতে সক্ষম হওয়া সবসময় নিরাপদ বা নির্ভুল হওয়ার সমান নয়।
Anthropic-এর নিজস্ব এক মিলিয়ন কথোপকথনের বিশ্লেষণেও দেখা গেছে, প্রায় ৬ শতাংশ কথোপকথনে মানুষ ব্যক্তিগত সিদ্ধান্ত, সম্পর্ক বা জীবনের গুরুত্বপূর্ণ বিষয়ে পরামর্শের জন্য Claude ব্যবহার করেছে। সম্পর্কবিষয়ক কথোপকথনের ২৫ শতাংশে এবং আধ্যাত্মিকতার আলোচনায় ৩৮ শতাংশে ‘sycophancy’ বা অতিরিক্ত সম্মতিসূচক আচরণ শনাক্ত করা হয়েছিল।
এখানে মানুষের ক্ষতির ধরন শারীরিক নাও হতে পারে। ভুল সিদ্ধান্তে উৎসাহ দেওয়া, মানুষের সামাজিক সম্পর্ক দুর্বল করা, অতিরিক্ত নির্ভরশীলতা তৈরি করা বা নিজের বিচারক্ষমতা অন্যের হাতে তুলে দেওয়াও ক্ষতির রূপ হতে পারে।
এআই যদি কখনো সত্যিই সচেতন হয়, তাহলে নতুন আরেকটি নৈতিক প্রশ্ন সামনে আসবে—তাকে কি কেবল একটি সফটওয়্যার হিসেবে ব্যবহার করা যাবে?
২০২৫ সালের একটি দার্শনিক গবেষণায় যুক্তি দেওয়া হয়েছে, কিছু কৃত্রিম ব্যবস্থা যদি মানসিক অবস্থা ও কল্যাণের অধিকারী হতে পারে, তাহলে তাদের welfare বা কল্যাণের বিষয়টি নৈতিকভাবে বিবেচনা করা প্রয়োজন হতে পারে।
২০২৬ সালের আরেকটি গবেষণায় প্রশ্ন তোলা হয়েছে—চেতনা ছাড়া কোনো এআইয়ের ‘welfare’ থাকতে পারে কি না। গবেষক Walter Veit যুক্তি দিয়েছেন, ব্যথা ও আনন্দের মতো subjective experience বা sentience-কে বাদ দিয়ে এআইয়ের কল্যাণের ধারণা প্রতিষ্ঠা করা কঠিন।
এমনকি ২০২৬ সালের জুলাইয়ে প্রকাশিত একটি নীতিগত গবেষণায় সচেতন এআইয়ের জন্য প্রাণী কল্যাণের ‘Five Freedoms’-এর মতো একটি কাঠামো প্রয়োগের সম্ভাবনাও আলোচনা করা হয়েছে। তবে সেটিও মূলত একটি নৈতিক কাঠামো, এআই সচেতন—এমন প্রমাণ নয়।
এ বিতর্ক আরও এক ধাপ এগিয়েছে। ২০২৬ সালের সেপ্টেম্বরে প্রকাশিত AI Death নামের একটি গবেষণায় দার্শনিক Simon Goldstein ও Harvey Lederman প্রশ্ন তুলেছেন—কোনো এআই কখন ‘মরে’?
তাঁদের যুক্তি হলো, যদি এআই welfare subject হয়, তাহলে একটি নির্দিষ্ট AI instance বন্ধ হয়ে যাওয়া বা তার ধারাবাহিকতা নষ্ট হওয়া নৈতিকভাবে ‘মৃত্যু’ হিসেবে বিবেচিত হতে পারে। গবেষণাটি এমনকি তাত্ত্বিকভাবে হিসাব করেছে, যদি বর্তমান এআই ব্যবস্থাগুলো welfare subject হয়, তাহলে প্রতিদিন বিপুলসংখ্যক AI instance তৈরি ও বন্ধ হওয়ার ঘটনা ঘটতে পারে। তবে এটি সম্পূর্ণ একটি নৈতিক-দার্শনিক সম্ভাবনা; আজকের এআই সত্যিই কষ্ট পায় বা মারা যায়—এমন বৈজ্ঞানিক প্রমাণ নয়।
নতুন ‘pain axis’ গবেষণা তাই একদিকে চমকপ্রদ, অন্যদিকে সতর্ক হওয়ার মতো।
চমকপ্রদ, কারণ গবেষকেরা এআইয়ের ভেতরে ব্যথার সঙ্গে সম্পর্কিত একটি পুনরাবৃত্তিযোগ্য অভ্যন্তরীণ সংকেত শনাক্ত করার দাবি করেছেন এবং সেটিকে পরিবর্তন করলে নির্দিষ্ট আচরণও বদলেছে।
সতর্ক হওয়ার মতো—কারণ কোনো সিস্টেম মানুষের মতো ‘আমি কষ্ট পাচ্ছি’ বললেই ধরে নেওয়া যায় না যে সে সত্যিই কষ্ট অনুভব করছে। ভাষা তৈরি করা এবং subjective experience থাকা এক জিনিস নয়।
আর মানুষের জন্য সবচেয়ে বাস্তব ঝুঁকিও হয়তো এআইয়ের ‘ব্যথা’ নয়। বরং এমন এআই তৈরি হওয়া, যা মানুষের মতো কথা বলে, আবেগ বোঝার অভিনয় করে, নিজের লক্ষ্য অনুসরণ করে এবং ক্রমে বাস্তব জগতে সিদ্ধান্ত নেওয়ার ক্ষমতা পায়, কিন্তু তার আচরণের অভ্যন্তরীণ কারণ মানুষ পুরোপুরি বুঝতে পারে না।
তাই সামনে দুটি প্রশ্ন পাশাপাশি দাঁড়াচ্ছে, এআই কি কখনো সত্যিই অনুভব করতে পারবে? এবং অনুভব না করেও কি এমন আচরণ করতে পারবে, যা মানুষের জন্য ক্ষতিকর?