প্রথম স্বরের আগে: শব্দ কোথায় জন্ম নেয়

লেখক: Inna Horoshkina One

প্রথম স্বরের আগে: শব্দ কোথায় জন্ম নেয়-1
চুপচাপ দেহে স্বর্ণালী একটি উল্লম্ব হিসেবে প্রবেশ করে, হৃদয়ে খোলে, এবং শ্বাস, একটি তরঙ্গ, একটি শব্দ হয়ে ওঠে।

প্রথমে — নীরবতা।

কিন্তু এই নীরবতা শূন্য নয়। এর মধ্যে ইতিমধ্যেই উপস্থিত রয়েছে যা প্রকাশ পেতে চায়: সবে মাত্র বোঝা যায় এমন এক অন্তর্নিহিত ধ্বনি, যা এখনও কণ্ঠস্বর, সুর বা গতিতে পরিণত হয়নি।

সঙ্গীতশিল্পী কেবল শ্রবণশক্তি দিয়ে নয়, তা শ্রবণ করেন। তিনি তা গ্রহণ করেন মনোযোগ দিয়ে, তাকে শ্বাসে প্রবেশ করতে দেন, পেশি, অঙ্গভঙ্গি ও হাতের মধ্য দিয়ে যেতে দেন। আর কেবল তারপর, যা ভেতরে শারীরিক শব্দ ছাড়াই বিদ্যমান ছিল, তা বাতাসের কম্পনে পরিণত হয় — এমন এক স্বরে, যা অন্যরা শুনতে পারে।

নীরবতা জন্ম দেয় সংকল্পের।
সংকল্প প্রবেশ করে দেহে।
দেহ অদৃশ্যকে রূপান্তরিত করে শব্দে।

এখন এই প্রকাশের সীমানার কাছে এসেছে স্নায়ুবিজ্ঞান। গবেষকরা শিখছেন মস্তিষ্কের সেই সক্রিয়তা চিনতে, যা মানুষ একটি শব্দ উচ্চারণ করার আগেই জন্ম নেয়, এবং তা শ্রবণযোগ্য বাক্যে, মুখভঙ্গিতে ও ডিজিটাল দেহের গতিতে রূপান্তরিত করতে।

বিজ্ঞান এখনও সংগীতের জন্মের রহস্য ব্যাখ্যা করতে পারে না। কিন্তু তা ইতিমধ্যেই দেখতে সক্ষম: কণ্ঠস্বর বাইরের জগতে ধ্বনিত হওয়ার আগেই, মানুষের ভেতরে ঘটে যায় এক পূর্ণ সিম্ফনি।

কেবল শব্দ ফিরিয়ে দেওয়া নয়

14 সেপ্টেম্বর 2026 সালে পিয়ার-রিভিউড জার্নালে Nature Neuroscience প্রকাশিত হয় একটি গবেষণাপত্র Simultaneous speech and gesture decoding for multimodal communication in paralysis — «পক্ষাঘাতে মাল্টিমোডাল যোগাযোগের জন্য একযোগে বাক্য ও অঙ্গভঙ্গির ডিকোডিং»।

গবেষণাটি পরিচালনা করেন সান-ফ্রান্সিসকোর ক্যালিফোর্নিয়া বিশ্ববিদ্যালয়ের একটি দল, স্নায়ুশল্যচিকিৎসক ও স্নায়ুবিজ্ঞানী এডওয়ার্ড চাং-এর নেতৃত্বে। প্রধান লেখক ছিলেন গবেষক সামান্থা ব্রোস্লার।

পরীক্ষায় অংশ নিয়েছিলেন বাকযন্ত্র ও দেহের বিভিন্ন মাত্রার পক্ষাঘাতে আক্রান্ত তিনজন মানুষ। তাঁদের মস্তিষ্কের মোটর কর্টেক্সের পৃষ্ঠে স্থাপন করা হয়েছিল ইলেকট্রোকর্টিকোগ্রাফিক ম্যাট্রিক্স — ইলেকট্রোডযুক্ত সরু প্লেট, যা স্নায়বিক সক্রিয়তা রেকর্ড করে।

অংশগ্রহণকারীরা নির্দিষ্ট বাক্য উচ্চারণের এবং পরিচিত অঙ্গভঙ্গি করার চেষ্টা করেছিলেন: হাত নাড়ানো, বুড়ো আঙুল দেখানো, মাথা নাড়ানো। কখনও তাঁরা এগুলো আলাদাভাবে করেছিলেন, কখনও — একসঙ্গে।

মেশিন লার্নিংয়ের অ্যালগরিদমগুলো প্রাপ্ত সংকেতের মধ্যে নির্দিষ্ট শব্দ বলার বা নড়াচড়া করার প্রচেষ্টার সঙ্গে সঙ্গতিপূর্ণ নিয়মিততা খুঁজছিল। এরপর চিহ্নিত অভিপ্রায়কে রূপান্তরিত করা হয় ডিজিটাল অ্যাভাটারের ক্রিয়ায়।

ফলস্বরূপ, দুইজন অংশগ্রহণকারী একসঙ্গে তার বাক্য ও অঙ্গভঙ্গি নিয়ন্ত্রণ করতে সক্ষম হয়েছিলেন।

এটি মৌলিকভাবে গুরুত্বপূর্ণ এক পদক্ষেপ। মানুষের যোগাযোগ কখনও কেবল শব্দের ক্রমে সীমাবদ্ধ নয়। আমরা সমগ্র দেহ দিয়ে কথা বলি: মুখভঙ্গি বদলাই, মাথা ঘুরাই, হাত নাড়াই, দৃষ্টি ও বিরতির মাধ্যমে অর্থের উপর জোর দিই।

নতুন প্রযুক্তি মানুষের কাছে কেবল তথ্য প্রেরণের ক্ষমতাই ফিরিয়ে দিতে চায় না, বরং তার ব্যক্তিগত উপস্থিতির একটি অংশও ফিরিয়ে দিতে চায়।

দেহ কণ্ঠস্বরের সঙ্গে চলে না — সে তাতে অংশ নেয়

গবেষণার সবচেয়ে আকর্ষণীয় ফলাফলগুলোর একটি এই বিষয়ে যে, মস্তিষ্ক কীভাবে বাক্য ও নড়াচড়াকে যুক্ত করে।

অনুমান করা যেত যে, একসঙ্গে বাক্য উচ্চারণ ও অঙ্গভঙ্গি করা হলো দুটি স্বাধীন সংকেতের সরল যোগফল। কিন্তু সম্মিলিত প্রকাশের সময় স্নায়বিক সক্রিয়তা সেই সক্রিয়তা থেকে ভিন্ন ছিল, যা শব্দ ও নড়াচড়া আলাদাভাবে সম্পাদনের সময় উদ্ভূত হয়েছিল।

অ্যালগরিদমগুলো একসঙ্গে বাক্য ও অঙ্গভঙ্গি আরও নির্ভুলভাবে চিহ্নিত করেছিল, যদি আগে থেকেই ঠিক এমন সম্মিলিত ক্রিয়ার উপর তাদের প্রশিক্ষণ দেওয়া হতো।

অন্য কথায়, মানুষের প্রকাশ কেবল আলাদা উপাদানের যান্ত্রিক সমষ্টি নয়।

কণ্ঠস্বর, মুখ ও নড়াচড়া একক ঘটনা হিসেবে জন্ম নেয়।

আমরা এটি সংগীতেও লক্ষ করতে পারি। গায়ক কেবল স্বরতন্ত্রী দিয়ে শব্দ উৎপন্ন করেন না। ধ্বনিতে অংশ নেয় শ্বাস, মেরুদণ্ডের অবস্থান, বক্ষপিঞ্জর, মুখের পেশি এবং স্থানের অন্তর্নিহিত অনুভূতি। পিয়ানোবাদক সমগ্র দেহ দিয়ে ক্লাভিশ স্পর্শ করেন, যদিও দৃশ্যমান নড়াচড়া করে একটি আঙুল। নৃত্যশিল্পী ছন্দ কেবল কান দিয়ে শোনেন না — তিনি তা ওজন, দিক ও গতিপথে রূপান্তরিত করেন।

দেহ শব্দের মোড়ক নয়। সে সংগীতের বক্তব্যের অংশ হয়ে ওঠে।

শব্দ, যা এখনও নেই

23 সেপ্টেম্বর 2026 সালে arXiv প্ল্যাটফর্মে প্রকাশিত হয় একটি বড় বৈজ্ঞানিক পর্যালোচনা Brain-to-Language Decoding: Tasks, Signals, Methods, Evaluation, Practical Use and Beyond। এর লেখকেরা সেই গবেষণাগুলো তুলনা করেছেন, যেখানে মস্তিষ্কের সক্রিয়তাকে পাঠ্যে, সংশ্লেষিত বাক্যে, শব্দতরঙ্গে ও দৃশ্যমান প্রকাশে রূপান্তরিত করার চেষ্টা করা হয়।

লেখকেরা তিনটি দিক বিবেচনা করেন:

  • যে বাক্য মানুষ উচ্চারণ করার চেষ্টা করে;
  • বাহ্যিক উচ্চারণ ছাড়াই ধ্বনিত অন্তর্গত বাক্‌ধারা;
  • শ্রুত ভাষার উপলব্ধি।

পর্যালোচনাটি এখনও একটি প্রিপ্রিন্ট এবং পিয়ার-রিভিউয়ের মধ্য দিয়ে যায়নি। এটি কোনো নতুন সিস্টেম নির্মাণের ঘোষণা নয়, আরও কম — মানুষের চিন্তা অবাধে পড়ার সম্ভাবনার প্রমাণ। এর মূল্য অন্য জায়গায়: এটি দেখায়, বিভিন্ন বৈজ্ঞানিক দিশা অভিপ্রায় ও প্রকাশের মধ্যবর্তী ক্ষেত্রের কত কাছে পৌঁছেছে।

গবেষকেরা এখন আর কেবল আলাদা আলাদা কমান্ড নিয়ে কাজ করছেন না। কিছু পরীক্ষামূলক সিস্টেম প্রবাহিত সংশ্লেষিত বাক্য তৈরি করে, তার ধ্বনিকে মানুষের ব্যক্তিগত কণ্ঠস্বরের কাছাকাছি নিয়ে আসে এবং শব্দগুলোকে ডিজিটাল মুখের নড়াচড়ার সঙ্গে যুক্ত করে।

কিন্তু এই ধরনের সিস্টেম যত বেশি প্রকাশক্ষম হয়ে ওঠে, ততই গুরুত্বপূর্ণ হয়ে ওঠে প্রশ্নটি: তারা আসলে কী শনাক্ত করে?

মস্তিষ্কের সংকেতে তৈরি বাক্য আগেই থাকে না, যাকে কেবল «শুনে নিলেই» যথেষ্ট। অ্যালগরিদম স্নায়ুতন্ত্রের জটিল সক্রিয়তার ব্যাখ্যা করে, তা প্রশিক্ষণ ডেটার সঙ্গে মেলায় এবং সবচেয়ে সম্ভাব্য ফলাফল বেছে নেয়।

তাই সুসংগত শোনানো একটি বাক্যাংশের অর্থ এই নয় যে মেশিন মানুষের অন্তর্গত অভিজ্ঞতা সম্পূর্ণ ও নির্ভুলভাবে পুনরুদ্ধার করেছে। ফলাফলের একটি অংশ ভাষা মডেল দিয়ে গড়ে তোলা হতে পারে।

এটি আত্মার পাঠ নয়। এটি এক জটিল অনুবাদ — এখনও অসম্পূর্ণ, ব্যক্তিভিত্তিকভাবে সাজানো এবং মানুষের সঙ্গে নিয়মিত প্রতিক্রিয়া-যোগাযোগের দাবিদার।

পুনরুদ্ধার করা কণ্ঠস্বরের রচয়িতা কে

এখন পর্যন্ত বাক্‌-নিউরোপ্রস্থেটিকসের প্রধান লক্ষ্য ছিল নির্ভুলতা: সিস্টেম কতগুলো শব্দ সঠিকভাবে শনাক্ত করেছে এবং কত দ্রুত তা পুনরুৎপাদন করতে পেরেছে।

এখন আরও গভীর প্রশ্ন উঠছে — রচয়িতা-পরিচয় নিয়ে।

অ্যালগরিদম যদি মানুষকে তার অভিপ্রায় প্রকাশে সাহায্য করে, তবে তা বাদ্যযন্ত্রের মতো একটি হাতিয়ার হয়ে ওঠে। কিন্তু সিস্টেম যদি নিজে থেকেই অতিরিক্ত অনেক কিছু গড়ে তুলতে শুরু করে, তবে সহায়তা ও প্রতিস্থাপনের সীমারেখা কম স্পষ্ট হয়ে ওঠে।

তাই এই ধরনের প্রযুক্তির অগ্রগতি কেবল গতি ও শনাক্তকরণের শতাংশ দিয়ে মূল্যায়ন করা সম্ভব নয়। প্রয়োজন ব্যবহারকারীর নিয়ন্ত্রণ, ফলাফল সংশোধনের সুযোগ, অ্যালগরিদমের কার্যপ্রণালীর স্বচ্ছতা এবং নিজের পক্ষ থেকে কী ধ্বনিত হবে তা নির্ধারণের মানুষের অধিকার সংরক্ষণ।

প্রকৃত কণ্ঠস্বর কেবল শব্দের সঠিক সমাহার নয়।

এটি স্বরতীক্ষ্ণতা।
ছন্দ।
বিরতি।
অঙ্গভঙ্গি।
আবেগের আভা।
আর না বলার স্বাধীনতাও।

কণ্ঠস্বর ফিরিয়ে দেওয়া মানে মানুষকে তার নিজের প্রকাশে নিজেকে চিনতে পারার ক্ষমতা ফিরিয়ে দেওয়া।

এটি সংগীতের জন্য কী খুলে দেয়

সংগীতশিল্পীরা বহুদিন ধরে তা জানেন, যার ভাষা খুঁজে বের করতে নিউরোসায়েন্স এখনও চেষ্টা করছে: ধ্বনি শুরু হয় প্রকৃত স্বরের আগেই।

সুরকার যন্ত্র স্পর্শ করার আগেই অন্তর্গত সুরলহরী শুনতে পারেন। গায়ক আগেই বাক্যাংশের অভিমুখ অনুভব করতে পারেন, তারপরই তা শ্বাসে ভরিয়ে তোলেন। তাৎক্ষণিক পরিবেশক সবসময় জানেন না পরের স্বরটি কী হবে, কিন্তু তিনি সেই গতিটি অনুভব করেন, যা ইতিমধ্যেই দেহের মধ্য দিয়ে বয়ে যেতে প্রস্তুত হচ্ছে।

বিজ্ঞান এই প্রক্রিয়াগুলোকে বর্ণনা করে মোটর পরিকল্পনা, শ্রবণ-প্রতিচ্ছবি, স্মৃতি, পূর্বানুমান এবং মস্তিষ্কের বিভিন্ন অঞ্চলের পারস্পরিক ক্রিয়ার মাধ্যমে। সংগীতশিল্পী এগুলোকে অনুভব করেন অন্তর্গত চেনার এক মুহূর্ত হিসেবে:

এই সেই ধ্বনি, যা প্রকাশিত হতে চায়।

এর অর্থ এই নয় যে যন্ত্রটি সরাসরি চেতনা থেকে প্রস্তুত সংগীত রেকর্ড করতে পারে বা প্রেরণার উৎস উদ্‌ঘাটন করতে পারে। অন্তর্গত অনুভূতি ও সৃষ্টিকর্মের মাঝে রয়ে যায় এক বিশাল পথ — নির্বাচন, প্রশিক্ষণ, কৌশল, সংস্কৃতি, স্মৃতি এবং মানুষের অনন্য ইতিহাস।

কিন্তু নতুন গবেষণা সৃষ্টির সেই মুহূর্তটিকে ভিন্নভাবে দেখার সুযোগ দেয়।

সংগীত জন্মায় না তখন, যখন বায়ু কম্পিত হতে শুরু করে। ভৌত ধ্বনি প্রক্রিয়ার শেষ পর্যায়গুলোর একটি মাত্র। তার আগে থাকে লক্ষ্যভিত্তিক মনোযোগ, রূপের পূর্বানুভূতি এবং যা বাইরে থেকে এখনও শোনা অসম্ভব, তা দেহে রূপ দেওয়ার প্রস্তুতি।

প্রথম স্বরের আগে

আমরা অভ্যস্ত সংগীতের শুরু বলতে বুঝি ঢোলের উপর আঘাত, ক্লাভিশে স্পর্শ কিংবা স্বরতন্ত্রীর প্রথম নড়াচড়া।

কিন্তু সম্ভবত এটি আর শুরু নয়, বরং প্রকাশ।

প্রথম স্বরের আগে থাকে এক অন্তর্গত পরিসর, যেখানে ধ্বনি, অনুভূতি ও গতি এখনও পৃথক হয়নি। তারপর জাগে অভিপ্রায়। তা মনোযোগকে একত্র করে, শ্বাস বদলে দেয়, স্নায়বিক ও পেশিগত প্রক্রিয়া সক্রিয় করে — এবং ক্রমে বস্তুতে প্রবেশ করে।

নিউরোসায়েন্স এই রূপান্তরের আলাদা আলাদা পর্যায় ধারণ করতে শিখছে। প্রযুক্তি পক্ষাঘাতগ্রস্ত মানুষের কাছে আত্মপ্রকাশের ক্ষমতা ফিরিয়ে দেওয়ার চেষ্টা করছে। আর সংগীত মনে করিয়ে দেয়, কণ্ঠস্বর কখনও কেবল শব্দতরঙ্গের সংকেত ছিল না।

তা জন্ম নেয় মানুষের সম্পূর্ণ সত্তা থেকে।

আর সম্ভবত একেবারে প্রথম স্বরটি বাজে না বাতাসে। তা জাগে সেই মুহূর্তে, যখন আমাদের ভিতরের নীরবতা বেছে নেয় সেই রূপ, যাতে সে শ্রুত হতে চায়।


17 দৃশ্য

মন্তব্য

আপনি কি কোনো ত্রুটি বা অসঠিকতা খুঁজে পেয়েছেন?আমরা আপনার মন্তব্য যত তাড়াতাড়ি সম্ভব বিবেচনা করব।