Antes de la primera nota: dónde nace el sonido

Autor: Inna Horoshkina One

Antes de la primera nota: dónde nace el sonido-1
El silencio entra en el cuerpo como una vertical dorada, se abre en el corazón y se convierte en respiración, una ola, un sonido.

Primero, el silencio.

Pero este silencio no está vacío. En él ya está presente lo que pugna por manifestarse: una resonancia interior apenas perceptible, que aún no se ha convertido en voz, melodía o movimiento.

El músico la escucha no solo con el oído. La acoge con su atención, le permite entrar en su respiración, recorrer sus músculos, sus gestos y sus manos. Y solo entonces aquello que existía dentro sin sonido físico se convierte en vibración del aire: una nota que los demás pueden oír.

El silencio engendra la intención.
La intención entra en el cuerpo.
El cuerpo traduce lo invisible en sonido.

Ahora la neurociencia se ha acercado a esta frontera de la manifestación. Los investigadores aprenden a reconocer la actividad cerebral que surge antes de que una persona pueda pronunciar una palabra y a convertirla en habla audible, en mímica y en movimiento de un cuerpo digital.

La ciencia aún no explica el misterio del nacimiento de la música. Pero ya es capaz de ver que, antes de que la voz suene en el mundo exterior, dentro de la persona tiene lugar toda una sinfonía.

Devolver no solo las palabras

El 14 de septiembre de 2026 en la revista arbitrada Nature Neuroscience se publicó el trabajo Simultaneous speech and gesture decoding for multimodal communication in paralysis — «Decodificación simultánea del habla y los gestos para la comunicación multimodal en la parálisis».

La investigación fue realizada por un equipo de la Universidad de California en San Francisco bajo la dirección del neurocirujano y neurocientífico Edward Chang. La autora principal fue la investigadora Samantha Brosler.

En el experimento participaron tres personas con distintos grados de parálisis del aparato del habla y del cuerpo. Sobre la superficie de la corteza motora de su cerebro se colocaron matrices electrocorticográficas: finas placas con electrodos que registran la actividad neuronal.

Los participantes intentaban pronunciar frases dadas y realizar gestos conocidos: agitar la mano, mostrar el pulgar, mover la cabeza. A veces lo hacían por separado, a veces, simultáneamente.

Los algoritmos de aprendizaje automático buscaban en las señales obtenidas patrones correspondientes al intento de decir determinadas palabras o de realizar un movimiento. Después, la intención reconocida se traducía en acciones de un avatar digital.

Como resultado, dos participantes lograron controlar simultáneamente su habla y sus gestos.

Este es un paso de importancia fundamental. La comunicación humana nunca se limita a una secuencia de palabras. Hablamos con todo el cuerpo: cambiamos la expresión del rostro, giramos la cabeza, movemos las manos, subrayamos el sentido con la mirada y la pausa.

La nueva tecnología aspira a devolver a la persona no solo la posibilidad de transmitir información, sino también una parte de su presencia individual.

El cuerpo no acompaña a la voz: participa en ella

Uno de los resultados más interesantes del estudio se refiere a cómo el cerebro conecta el habla y el movimiento.

Cabía suponer que la pronunciación simultánea de una frase y un gesto era una simple suma de dos señales independientes. Sin embargo, la actividad neuronal durante la expresión combinada difería de la que surgía cuando las palabras y los movimientos se realizaban por separado.

Los algoritmos reconocían con mayor precisión el habla y los gestos simultáneos si previamente se entrenaban precisamente con tales acciones combinadas.

En otras palabras, la expresión humana resultó no ser una suma mecánica de elementos separados.

La voz, el rostro y el movimiento nacen como un único acontecimiento.

Podemos observar esto también en la música. El cantante no produce el sonido únicamente con las cuerdas vocales. En el sonido participan la respiración, la posición de la columna vertebral, la caja torácica, los músculos del rostro y la sensación interior del espacio. El pianista toca la tecla con todo el cuerpo, aunque el movimiento visible lo realice un solo dedo. El bailarín oye el ritmo no solo con los oídos: lo traduce en peso, dirección y trayectoria del movimiento.

El cuerpo no es un envoltorio para el sonido. Se convierte en parte del enunciado musical.

El sonido que aún no existe

El 23 de septiembre de 2026 apareció en la plataforma arXiv una amplia revisión científica Brain-to-Language Decoding: Tasks, Signals, Methods, Evaluation, Practical Use and Beyond. Sus autores cotejaron investigaciones en las que se intenta traducir la actividad cerebral en texto, habla sintetizada, sonido acústico y expresión visual.

Los autores examinan tres direcciones:

  • el habla que la persona intenta pronunciar;
  • el habla interior, que suena sin pronunciación externa;
  • la percepción del lenguaje escuchado.

Por ahora, la revisión es un preprint y no ha pasado por revisión por pares. No es el anuncio de la creación de un nuevo sistema y mucho menos la prueba de que sea posible leer libremente los pensamientos humanos. Su valor está en otra cosa: muestra cuán cerca han llegado distintas direcciones científicas al espacio entre la intención y su manifestación.

Los investigadores ya trabajan no solo con comandos aislados. Algunos sistemas experimentales crean habla sintetizada en flujo continuo, acercan su sonido a la voz individual de la persona y unen las palabras con los movimientos de un rostro digital.

Pero cuanto más expresivos se vuelven tales sistemas, más importante es la pregunta: ¿qué es exactamente lo que reconocen?

La señal cerebral no contiene una frase ya lista que baste con «escuchar». El algoritmo interpreta la compleja actividad del sistema nervioso, la compara con los datos de entrenamiento y elige el resultado más probable.

Por eso, una frase que suena coherente aún no significa que la máquina haya restaurado por completo y sin errores la experiencia interior de la persona. Parte del resultado puede ser completada por el modelo lingüístico.

Esto no es leer el alma. Es una traducción compleja: por ahora imperfecta, configurada individualmente y que requiere una retroalimentación constante con la propia persona.

Quién es el autor de la voz restaurada

Hasta ahora, el objetivo principal de las neuroprótesis del habla era la precisión: cuántas palabras reconocía correctamente el sistema y con qué rapidez lograba reproducirlas.

Ahora surge una pregunta más profunda: la de la autoría.

Si el algoritmo ayuda a la persona a expresar una intención, se convierte en un instrumento semejante a un instrumento musical. Pero si el sistema empieza a completar por su cuenta demasiadas cosas, la frontera entre la ayuda y la suplantación se vuelve menos evidente.

Por eso, el desarrollo de tales tecnologías no puede evaluarse solo por la velocidad y los porcentajes de reconocimiento. Se necesitan el control del usuario, la posibilidad de corregir el resultado, la transparencia del funcionamiento del algoritmo y la conservación del derecho de la persona a decidir qué debe sonar exactamente en su nombre.

La voz verdadera no es solo un conjunto correcto de palabras.

Es el timbre.
El ritmo.
La pausa.
El gesto.
El matiz emocional.
Y la libertad de no hablar.

Devolver la voz significa devolver a la persona la posibilidad de reconocerse en su propia expresión.

Qué le abre esto a la música

Los músicos saben desde hace mucho aquello para lo que la neurociencia apenas está encontrando lenguaje: el sonido comienza antes de la nota física.

El compositor puede oír una línea musical interior antes de tocar el instrumento. El cantante es capaz de sentir de antemano la dirección de la frase y solo después llenarla de aliento. El improvisador no siempre sabe qué nota surgirá a continuación, pero percibe el movimiento que ya se prepara para atravesar el cuerpo.

La ciencia describe estos procesos a través de la planificación motora, las imágenes auditivas, la memoria, la anticipación y la interacción de distintas áreas del cerebro. El músico los vive como un instante de reconocimiento interior:

he aquí el sonido que quiere manifestarse.

Esto no significa que el aparato sea capaz de registrar música ya lista directamente de la conciencia ni de revelar la fuente de la inspiración. Entre la sensación interior y la obra queda un camino enorme: la elección, el aprendizaje, la técnica, la cultura, la memoria y la historia irrepetible de la persona.

Pero las nuevas investigaciones permiten ver de otro modo el momento mismo de la creación.

La música no nace cuando el aire empezó a vibrar. El sonido físico es ya una de las últimas etapas del proceso. Antes de él existen la atención dirigida, la premonición de la forma y la disposición del cuerpo a encarnar lo que todavía es imposible oír desde fuera.

Antes de la primera nota

Estamos acostumbrados a considerar como inicio de la música el golpe en el tambor, el roce de una tecla o el primer movimiento de las cuerdas vocales.

Pero, quizá, esto ya no es el inicio, sino la manifestación.

Antes de la primera nota existe un espacio interior en el que todavía no están separados el sonido, el sentimiento y el movimiento. Luego surge la intención. Esta reúne la atención, cambia la respiración, pone en marcha los procesos neuronales y musculares, y poco a poco entra en la materia.

La neurociencia aprende a fijar las distintas etapas de esta transición. La tecnología intenta devolver a las personas con parálisis la posibilidad de expresarse. Y la música recuerda que la voz nunca fue solo una señal acústica.

Nace de la integridad entera de la persona.

Y, quizá, la primera nota de todas no suena en el aire. Surge en el instante en que el Silencio dentro de nosotros elige la forma en la que quiere volverse audible.


17 Vues

Comentarios

¿Encontró un error o inexactitud?Consideraremos sus comentarios lo antes posible.