Trước hết — là sự im lặng.
Nhưng sự im lặng ấy không trống rỗng. Trong đó đã hiện diện điều đang khao khát được bộc lộ: một âm vang nội tâm khó nhận ra, chưa trở thành giọng nói, giai điệu hay chuyển động.
Người nhạc sĩ lắng nghe nó không chỉ bằng thính giác. Họ đón nhận nó bằng sự chú tâm, để nó đi vào hơi thở, đi qua các bắp thịt, cử chỉ và đôi tay. Và chỉ sau đó, điều từng tồn tại bên trong mà không có âm thanh vật lý mới trở thành dao động của không khí — một nốt nhạc mà người khác có thể nghe được.
Sự im lặng sinh ra ý định.
Ý định đi vào cơ thể.
Cơ thể chuyển hóa điều vô hình thành âm thanh.
Giờ đây, khoa học thần kinh đã tiến đến gần ranh giới bộc lộ ấy. Các nhà nghiên cứu đang học cách nhận diện hoạt động của não bộ xuất hiện trước cả khi con người có thể thốt ra một từ, và biến nó thành lời nói nghe được, nét mặt và chuyển động của một cơ thể số.
Khoa học vẫn chưa lý giải được điều bí ẩn về sự ra đời của âm nhạc. Nhưng nó đã có thể nhìn thấy: trước khi giọng nói vang lên ở thế giới bên ngoài, bên trong con người đã diễn ra cả một bản giao hưởng.
Trả lại không chỉ những lời
14 tháng Chín 2026 năm trên tạp chí bình duyệt Nature Neuroscience một công trình đã được công bố Giải mã đồng thời lời nói và cử chỉ cho giao tiếp đa phương thức ở người bị liệt — «Giải mã đồng thời lời nói và cử chỉ cho giao tiếp đa phương thức ở người bị liệt».
Nghiên cứu do nhóm của Đại học California tại San Francisco thực hiện dưới sự chỉ đạo của bác sĩ phẫu thuật thần kinh kiêm nhà thần kinh học Edward Chang. Tác giả chính là nhà nghiên cứu Samantha Brosler.
Trong thí nghiệm có sự tham gia của ba người với mức độ tê liệt cơ quan phát âm và cơ thể khác nhau. Trên bề mặt vỏ não vận động của họ, các ma trận điện vỏ não — những tấm mỏng gắn điện cực ghi lại hoạt động thần kinh — đã được đặt vào.
Những người tham gia cố gắng phát âm các cụm từ được yêu cầu và thực hiện những cử chỉ quen thuộc: vẫy tay, giơ ngón tay cái, lắc đầu. Đôi khi họ làm những điều này riêng lẻ, đôi khi — cùng lúc.
Các thuật toán học máy tìm kiếm trong những tín hiệu thu được các quy luật tương ứng với nỗ lực nói những từ nhất định hoặc thực hiện một động tác. Sau đó, ý định được nhận diện sẽ được chuyển thành hành động của hình đại diện kỹ thuật số.
Kết quả là hai người tham gia đã có thể đồng thời điều khiển lời nói và cử chỉ của nó.
Đây là một bước tiến có ý nghĩa nguyên tắc. Giao tiếp của con người không bao giờ chỉ giới hạn ở chuỗi từ ngữ. Chúng ta nói bằng cả cơ thể: thay đổi nét mặt, quay đầu, cử động tay, nhấn mạnh ý nghĩa bằng ánh nhìn và khoảng lặng.
Công nghệ mới nỗ lực trả lại cho con người không chỉ khả năng truyền đạt thông tin mà còn cả một phần sự hiện diện cá nhân của họ.
Cơ thể không chỉ đi kèm với giọng nói — nó tham gia vào chính giọng nói
Một trong những kết quả thú vị nhất của nghiên cứu liên quan đến cách bộ não kết nối lời nói và chuyển động.
Có thể giả định rằng việc đồng thời phát âm một cụm từ và cử chỉ chỉ là sự cộng gộp đơn giản của hai tín hiệu độc lập. Tuy nhiên, hoạt động thần kinh khi biểu đạt kết hợp lại khác với hoạt động xuất hiện khi lời nói và chuyển động được thực hiện riêng rẽ.
Các thuật toán nhận diện lời nói và cử chỉ đồng thời chính xác hơn nếu trước đó được huấn luyện đúng trên những hành động kết hợp như vậy.
Nói cách khác, sự biểu đạt của con người hóa ra không phải là tổng số máy móc của những yếu tố riêng lẻ.
Giọng nói, khuôn mặt và chuyển động sinh ra như một sự kiện duy nhất.
Chúng ta có thể quan sát điều này cả trong âm nhạc. Ca sĩ không chỉ tạo ra âm thanh bằng dây thanh quản. Hơi thở, tư thế cột sống, lồng ngực, các cơ trên khuôn mặt và cảm nhận nội tại về không gian đều tham gia vào âm thanh. Nghệ sĩ dương cầm chạm vào phím đàn bằng cả cơ thể, dù động tác nhìn thấy được chỉ do một ngón tay thực hiện. Vũ công nghe nhịp điệu không chỉ bằng tai — họ chuyển nó thành trọng lượng, hướng và quỹ đạo chuyển động.
Cơ thể không phải là lớp vỏ bọc cho âm thanh. Nó trở thành một phần của phát ngôn âm nhạc.
Âm thanh chưa hề tồn tại
23 tháng Chín năm 2026, trên nền tảng arXiv đã xuất hiện một bài tổng quan khoa học lớn Brain-to-Language Decoding: Tasks, Signals, Methods, Evaluation, Practical Use and BeyondCác tác giả của nó đã đối chiếu các nghiên cứu trong đó người ta cố gắng chuyển hoạt động não bộ thành văn bản, lời nói tổng hợp, âm thanh âm học và biểu đạt thị giác.
Các tác giả xem xét ba hướng:
- lời nói mà con người cố gắng phát ra;
- lời nói nội tâm vang lên mà không cần phát âm ra bên ngoài;
- sự tiếp nhận ngôn ngữ được nghe.
Bài tổng quan hiện vẫn là bản thảo chưa qua bình duyệt. Đây không phải là thông báo về việc tạo ra một hệ thống mới, càng không phải là bằng chứng về khả năng đọc suy nghĩ của con người một cách tự do. Giá trị của nó nằm ở chỗ khác: nó cho thấy các hướng nghiên cứu khoa học khác nhau đã tiến gần đến mức nào vùng không gian giữa ý định và sự biểu hiện.
Các nhà nghiên cứu đã không chỉ làm việc với những mệnh lệnh riêng lẻ. Một số hệ thống thử nghiệm tạo ra dòng lời nói tổng hợp, đưa âm thanh của nó đến gần giọng nói riêng của mỗi người và gắn kết các từ với chuyển động của một khuôn mặt số.
Nhưng những hệ thống như vậy càng trở nên biểu cảm bao nhiêu, thì câu hỏi sau càng trở nên quan trọng bấy nhiêu: chính xác thì chúng nhận diện điều gì?
Tín hiệu não không chứa sẵn một câu hoàn chỉnh mà chỉ cần «nghe» là đủ. Thuật toán diễn giải hoạt động phức tạp của hệ thần kinh, đối chiếu nó với dữ liệu huấn luyện và chọn ra kết quả có khả năng nhất.
Vì vậy, một câu nghe có vẻ mạch lạc vẫn chưa có nghĩa là cỗ máy đã phục dựng được trải nghiệm nội tâm của con người một cách trọn vẹn và không sai sót. Một phần kết quả có thể được mô hình ngôn ngữ bổ sung thêm.
Đây không phải là việc đọc tâm hồn. Đây là một sự chuyển dịch phức tạp — hiện vẫn chưa hoàn hảo, được điều chỉnh riêng cho từng người và đòi hỏi sự phản hồi liên tục với chính người đó.
Ai là tác giả của giọng nói được phục dựng
Cho đến nay, mục tiêu chính của các bộ phận giả thần kinh hỗ trợ lời nói vẫn là độ chính xác: hệ thống nhận diện đúng bao nhiêu từ và có thể tái tạo chúng nhanh đến mức nào.
Giờ đây, một câu hỏi sâu sắc hơn xuất hiện — về quyền tác giả.
Nếu thuật toán giúp con người diễn đạt ý định, nó trở thành một công cụ, giống như một nhạc cụ. Nhưng nếu hệ thống bắt đầu tự mình bổ sung quá nhiều, ranh giới giữa sự hỗ trợ và sự thay thế trở nên ít rõ ràng hơn.
Vì vậy, không thể đánh giá sự phát triển của những công nghệ như vậy chỉ dựa trên tốc độ và tỷ lệ phần trăm nhận diện. Cần có sự kiểm soát của người dùng, khả năng sửa chữa kết quả, tính minh bạch trong hoạt động của thuật toán và việc giữ gìn quyền của con người được quyết định chính xác điều gì sẽ được cất lên thay cho mình.
Giọng nói đích thực không chỉ là một tập hợp từ ngữ đúng đắn.
Đó là âm sắc.
Nhịp điệu.
Khoảng lặng.
Cử chỉ.
Sắc thái cảm xúc.
Và tự do không nói.
Trả lại giọng nói nghĩa là trả lại cho con người khả năng nhận ra chính mình trong sự biểu hiện của bản thân.
Điều này mở ra gì cho âm nhạc
Các nhạc sĩ từ lâu đã biết điều mà khoa học thần kinh chỉ mới đang tìm cách diễn đạt: âm thanh bắt đầu trước cả nốt nhạc vật lý.
Nhà soạn nhạc có thể nghe thấy dòng nhạc nội tâm trước khi chạm vào nhạc cụ. Ca sĩ có thể cảm nhận trước hướng đi của câu hát và chỉ sau đó mới rót hơi thở vào đó. Người ứng tác không phải lúc nào cũng biết nốt nào sẽ xuất hiện tiếp theo, nhưng cảm nhận được chuyển động đang chuẩn bị đi qua cơ thể.
Khoa học mô tả những quá trình này thông qua lập kế hoạch vận động, hình ảnh thính giác, ký ức, dự đoán và sự tương tác giữa các vùng khác nhau của não bộ. Nhạc sĩ trải nghiệm chúng như một khoảnh khắc nhận ra nội tâm:
đây là âm thanh muốn được hiển lộ.
Điều này không có nghĩa là thiết bị có thể ghi lại bản nhạc hoàn chỉnh trực tiếp từ ý thức hay khám phá nguồn cảm hứng. Giữa cảm giác nội tâm và tác phẩm vẫn còn một chặng đường dài — lựa chọn, học tập, kỹ thuật, văn hóa, ký ức và câu chuyện không thể lặp lại của mỗi con người.
Nhưng những nghiên cứu mới cho phép nhìn chính khoảnh khắc sáng tạo theo một cách khác.
Âm nhạc không ra đời khi không khí bắt đầu rung động. Âm thanh vật lý đã là một trong những giai đoạn cuối cùng của quá trình. Trước đó tồn tại sự chú ý có định hướng, sự linh cảm về hình thức và sự sẵn sàng của cơ thể để hiện thực hóa điều còn chưa thể nghe thấy từ bên ngoài.
Trước nốt nhạc đầu tiên
Chúng ta đã quen coi khởi đầu của âm nhạc là cú đánh vào trống, cái chạm vào phím đàn hay chuyển động đầu tiên của dây thanh quản.
Nhưng có lẽ đó đã không còn là khởi đầu, mà là sự hiển lộ.
Trước nốt nhạc đầu tiên tồn tại một không gian nội tâm, nơi âm thanh, cảm xúc và chuyển động vẫn chưa tách rời nhau. Rồi ý định xuất hiện. Nó tập hợp sự chú ý, thay đổi hơi thở, kích hoạt các quá trình thần kinh và cơ bắp — và dần dần đi vào vật chất.
Khoa học thần kinh đang học cách ghi nhận từng giai đoạn riêng lẻ của sự chuyển tiếp này. Công nghệ đang cố gắng trả lại cho những người bị liệt khả năng biểu đạt bản thân. Và âm nhạc nhắc nhở rằng giọng nói chưa bao giờ chỉ là một tín hiệu âm thanh.
Nó ra đời từ sự toàn vẹn của con người.
Và có lẽ, nốt nhạc đầu tiên vang lên không phải trong không khí. Nó xuất hiện vào khoảnh khắc mà sự Tĩnh lặng bên trong chúng ta chọn lấy hình thức mà nó muốn trở nên nghe được.




