Pular para o texto
As palavras têm ossos

Parte III · Capítulo 10

Osso, cor e música

O que o esqueleto deixa de fora

Durante nove capítulos, trabalhamos com o osso. Valeu a pena: com o esqueleto e as classes, você consegue ver parentescos que antes eram invisíveis. Mas todo método focaliza, e ao focalizar deixa coisas de fora. Quem olha só o esqueleto de uma palavra pode deixar de ouvir a sua música: o tom, o ritmo, a emoção com que ela é dita.

Esta parte do manual vai buscar o que deixamos de fora. A disciplina que estuda isso se chama psicofonologia: o estudo do som da linguagem como algo que acontece, ao mesmo tempo, na estrutura, no tempo e na mente. É uma proposta minha, que trabalha em aliança com a endolinguística. A endolinguística estuda o osso; a psicofonologia estuda a carne e a voz.

Um “não”, três vezes

Vamos começar por um experimento que você pode fazer agora mesmo. Diga a palavra não de três jeitos:

  1. Um não seco, duro, curto. Uma porta que bate.
  2. Um não comprido, que hesita, que sobe e desce. Um não que ainda está se decidindo.
  3. Um não pequeno, suave, quase em voz baixa. Um não que é meio súplica.

É a mesma palavra: um n e uma vogal nasal (o ão, em que nenhuma outra consoante soa, como você viu no capítulo 2). Para a gramática, os três são idênticos. E, no entanto, quem ouve você sabe perfeitamente qual deles você disse, e sabe sobre você uma coisa que a palavra não diz.

Onde está a diferença? A psicofonologia diz que todo som da linguagem vive em três planos ao mesmo tempo:

  1. O plano da estrutura: quais sons são, em que ordem. Aqui, os três não são iguais.
  2. O plano da música: o ritmo, a duração, a melodia da voz, onde ela sobe e onde desce. Aqui, os três são diferentes.
  3. O plano da mente: a intenção, a emoção, a tensão de quem fala, e o que isso produz em quem escuta. Aqui está a causa da diferença.

Os três planos não são camadas que se possam separar e estudar cada uma do seu lado. São três maneiras de olhar um único ato. Quando alguém diz não, diz as três coisas ao mesmo tempo, e quem escuta as recebe ao mesmo tempo.

As consoantes desenham, as vogais colorem

No capítulo 2, eu disse que as consoantes são como um contorno e as vogais como uma cor. Agora podemos levar essa imagem a sério.

Uma consoante é um evento: um corte, uma borda, um instante. Por isso as consoantes podem ser contadas e combinadas, e por isso é com elas que se constroem os códigos. Uma vogal é um estado: a boca aberta numa forma, sustentada, soando. As vogais não cortam o ar: elas o colorem.

E as vogais podem se mover sem saltos. Entre o i e o a há uma infinidade de posições intermediárias; você pode deslizar de um para o outro sem cortar. Entre o p e o t, ao contrário, não há nada: ou você fecha os lábios ou não fecha. As consoantes são como as teclas de um piano; as vogais, como o som de um violino, que pode subir aos pouquinhos.

Por isso a psicofonologia diz que a vogal é um operador de qualidade. Ela não muda o esqueleto da palavra: dá a ele uma cor. Três vogais marcam os cantos desse espaço de cor, e são as mesmas que aparecem nos cantos de todos os esquemas de vogais que os linguistas usam:

Todas as outras vogais vivem entre esses três cantos. E o português tem muitas: o é aberto de pé e o ê fechado de você, o ó de avó e o ô de avô, e ainda as vogais nasais, como o ã de mãe. Todas encontram o seu lugar em algum ponto desse triângulo.

O triângulo das vogais: i, u e a nos cantos iua eo o pequeno,o agudo o profundo,o redondo o aberto, o largo boca quase fechada,língua para a frente lábios arredondados,língua para trás boca aberta
Os três cantos do espaço das vogais. As outras vogais vivem no meio.

Bouba ou kiki?

Que as vogais tenham cor não é uma ideia só da endolinguística. É um dos resultados mais sólidos da psicologia experimental da linguagem.

Quase com certeza você disse que a redonda é bouba e a pontuda é kiki. Você não está sozinho: pessoas de línguas muito diferentes, e de idades muito diferentes, respondem a mesma coisa na grande maioria dos casos. As vogais redondas e abertas de bouba combinam com o redondo; o i e o k de kiki, com o afiado.

Há outro experimento, mais antigo. Em 1929, o linguista Edward Sapir inventou duas palavras, mil e mal, e disse a várias pessoas que as duas eram nomes de mesas: uma grande e uma pequena. Qual é a grande? A maioria escolheu mal para a grande e mil para a pequena. (Aqui, leia o l final como um l de verdade, e não como o u que ele vira no Brasil: são palavras inventadas.) O a aberto vai com o grande; o i fechado, com o pequeno.

Agora olhe dois elementos que você com certeza conhece, vindos do grego: macro (o grande, o extenso) e micro (o pequeno). Eles têm o mesmo esqueleto, m · k · r. Só muda a vogal, e a vogal parece carregar o tamanho: a para o grande, i para o pequeno.

Essas tendências não são leis. São inclinações: aparecem quando você olha muitas palavras e muitas pessoas, e há muitas exceções. Mas são reais, e dizem algo importante: na camada mais funda da linguagem, onde o corpo faz os sons, o som e o sentido não estão totalmente separados.

O ritmo decide o que se ouve

Vamos passar da cor de uma vogal à música de uma frase inteira.

As línguas têm ritmos diferentes. O português do Brasil tende a dar a cada sílaba mais ou menos o mesmo tempo: ca-ra-me-lo soa como quatro batidas regulares, com todas as vogais bem audíveis. Já o português de Portugal faz outra coisa: engole as vogais sem acento, que quase somem. Uma palavra como pequeno soa lá quase como p’queno. É a mesma língua, com o mesmo osso, e com outra música.

O inglês vai ainda mais longe nessa direção. Ele bate forte em certas sílabas e aperta as outras entre elas: caramel se comprime, e uma vogal quase desaparece. Diz-se que o inglês tem um ritmo acentual, e que o português do Brasil é mais silábico. O mesmo osso, posto em outro ritmo, soa diferente.

Por isso, quando você fala inglês com ritmo de português, mesmo pronunciando bem cada som, dá para perceber. Você dá o mesmo peso a todas as sílabas onde o inglês esmaga algumas; e às vezes ainda acrescenta uma vogal depois da consoante final, que o inglês não tem (o famoso “clubi”). Aquilo que chamamos de sotaque não é só uma vogal errada aqui ou uma consoante ali. É que o seu ritmo interior, o da sua primeira língua, continua soando por baixo do idioma novo.

Com o espanhol, a história é outra. O espanhol é silábico, como o português do Brasil: ca-ra-me-lo soa como quatro batidas regulares, e o seu ouvido logo se sente em casa. E o acento de palavra, que muda de lugar e muda o sentido, você também já conhece: sábia, sabia, sabiá são três palavras diferentes com os mesmos sons. Em espanhol acontece o mesmo: término (o término), termino (eu termino), terminó (ele terminou).

A esse ritmo interior, a endolinguística chama de endorritmo. Não é o ritmo que se pode gravar com um microfone, mas a disposição de fundo de onde saem todos os seus ritmos: um andamento, um jeito de ir no tempo, tão pessoal quanto o timbre da sua voz. Você o leva consigo de uma frase para outra e de um idioma para outro.

Quando a música é a palavra

Há línguas em que a música não acompanha a palavra: ela é parte da palavra. Elas se chamam línguas tonais. Em chinês mandarim, a sílaba ma dita num tom alto e reto quer dizer “mamãe”; num tom que sobe, “cânhamo”; num tom que desce e sobe, “cavalo”; num tom que cai de repente, “repreender”. Quatro palavras diferentes com os mesmos sons. O que em português uma consoante ou uma vogal faria, em mandarim quem faz é a altura da voz.

E aqui há uma descoberta bonita da linguística histórica. Muitos tons nasceram quando uma língua perdeu uma consoante. A consoante foi embora, mas a diferença que ela marcava não se perdeu: mudou-se para a melodia da vogal vizinha. Isso se chama tonogênese, o nascimento do tom. É como se o osso, ao se gastar, tivesse virado música.

O que a voz diz sem palavras

Há ainda um nível mais fino: os pequenos tremores da voz, as pausas que não são iguais, a garganta que aperta um pouco, a pressa quase imperceptível. A psicofonologia chama isso de micromusicalidade. Ela fica abaixo do que percebemos conscientemente, e mesmo assim a lemos na hora.

Pense numa voz que treme. Se a pessoa está com frio, o tremor é regular, mecânico, ritmado: o corpo tiritando. Se a pessoa está segurando o choro, o tremor é outro: irregular, com pausas desiguais, com uma tensão que se junta na garganta. Os dois se ouvem. Os dois são tremores. E significam coisas opostas. A diferença não está em nenhuma palavra nem em nenhum som: está na micromusicalidade.

O que fazer com tudo isso quando você aprende um idioma

Esta parte pode parecer teórica, mas tem consequências muito práticas.

  1. Escolha um sotaque de referência e fique com ele no começo. Não misture o inglês de Londres com o do Texas na mesma semana, nem o espanhol de Madri com o da Cidade do México. O seu ouvido precisa de um modelo estável.
  2. Escute antes de falar. O ritmo e a melodia de uma língua se aprendem pelo ouvido, não pelos olhos. Coloque áudio do idioma, mesmo sem entender tudo: o seu corpo vai aprendendo o endorritmo da outra língua.
  3. Faça sombra. Coloque uma frase gravada e repita por cima, quase ao mesmo tempo, imitando a melodia, não só os sons. Em inglês, isso se chama shadowing.
  4. Exagere a música. No começo, exagere as subidas e descidas do idioma novo, como se estivesse atuando. O seu ritmo do português vai puxar para o regular, sílaba por sílaba: em inglês, apoie com força as sílabas fortes, deixe as fracas passarem e não acrescente vogais depois das consoantes finais; em espanhol, procure a sílaba certa de cada palavra.
  5. Escute em paralelo. Use as frases-ponte do capítulo 8: ouça a frase no idioma novo e depois a ponte em português, uma atrás da outra. Você não treina só as palavras: treina a mudança de ritmo.

No próximo capítulo, vamos à pergunta mais funda desta parte: como um pensamento, que não soa, vira voz.