Faculdade Perto

Português do Brasil e de Portugal nos corpora

Compare o português do Brasil e de Portugal por nasais, laterais, róticos e fricativas, com origem dos corpora e limites dos dados.

Faculdade PertoPublicado em 6 min de leitura

A diferença do português do Brasil e de Portugal, nestes corpora, está nas proporções de nasais, laterais, róticos e fricativas. Os números comparam os sons registrados no CETENFolha e no PF_Fone. Eles descrevem esses acervos, com origens e tamanhos distintos, e não todos os falantes dos dois países.[1, 2, 3, 4]

Qual a diferença do português do Brasil e de Portugal?

As proporções diferem nas quatro classes examinadas. O CETENFolha apresenta mais nasais, enquanto o PF_Fone registra mais laterais, róticos e fricativas. O denominador informado em cada comparação é o conjunto de sons do respectivo corpus, portanto cada percentual deve permanecer ligado ao acervo que o produziu.[1, 2, 3]

A tabela reúne somente os resultados fornecidos pelo manual. A diferença em pontos percentuais ajuda você a comparar proporções sem confundir essa operação com uma contagem de ocorrências. Ela foi calculada pela subtração entre os percentuais publicados, mas não elimina as diferenças de proveniência entre os corpora.[1, 2, 3, 4]

Classe de sonsCETENFolha, português brasileiroPF_Fone, português europeuDiferença entre os corpora
Nasais6%[1]5,1%[1]0,9 ponto percentual a mais no CETENFolha[1]
Laterais2,25%[1]3,1%[1]0,85 ponto percentual a mais no PF_Fone[1]
Róticos5,6%[2]8,2%[2]2,6 pontos percentuais a mais no PF_Fone[2]
Fricativas13,1%[3]15,1%[3]2 pontos percentuais a mais no PF_Fone[3]

Imagine uma estudante preparando um resumo e encontrando 6% de nasais em uma coluna e 5,1% em outra. A leitura segura é dizer que a proporção é maior no CETENFolha. Seria excessivo concluir que qualquer brasileiro produz mais nasais que qualquer português, pois os percentuais pertencem aos acervos descritos.[1, 4] Para situar essa comparação entre outros tópicos da língua, o conteúdo relacionado do curso funciona como referência temática, sem ampliar a evidência disponível aqui.

De onde vêm os dados comparados?

A origem muda a leitura. O CETENFolha reúne quase 24 milhões de palavras do português brasileiro retiradas das edições de 1994 da Folha de S.Paulo. O PF_Fone contém aproximadamente 26 mil formas do português europeu, acompanhadas de frequência e de transcrição fonética revisada manualmente.[4]

Os dois lados, portanto, não apresentam a mesma unidade de descrição na informação fornecida. Um lado é caracterizado por palavras de edições jornalísticas; o outro, por formas com frequência e transcrição fonética revisada.[4] Pense em duas cestas de feira com etiquetas claras: você consegue comparar o conteúdo registrado, mas precisa conservar a identificação de cada cesta. Apagar a etiqueta produziria uma generalização que a fonte não sustenta.

O ponto fraco aqui é a ausência, no recorte fornecido, de detalhes suficientes para reconstruir toda a conversão dos materiais em sons. A fonte informa as proporções sonoras e a proveniência dos corpora, mas este artigo não pode acrescentar critérios de seleção, distribuição regional ou perfil de falantes que não foram apresentados.[1, 2, 3, 4] Ao ler os números, mantenha sempre três rótulos: corpus, classe sonora e percentual.

O que nasais e laterais mostram nos dois corpora?

As classes se cruzam. As nasais representam 6% dos sons no CETENFolha e 5,1% no PF_Fone. As laterais correspondem a 2,25% no primeiro corpus e 3,1% no segundo. Em ambos, [m] e [l] são os representantes mais frequentes de suas respectivas classes.[1]

Esses dados permitem duas comparações delimitadas. Para as nasais, o CETENFolha supera o PF_Fone em 0,9 ponto percentual. Para as laterais, o PF_Fone supera o CETENFolha em 0,85 ponto percentual.[1] O símbolo [m] identifica o representante mais frequente entre as nasais, e [l] ocupa essa posição entre as laterais nos dois acervos.[1] Você pode registrar classe, proporção e segmento mais frequente em colunas separadas para evitar misturar medidas diferentes.

Essa distinção também impede uma leitura apressada. Frequência dentro de uma classe e participação da classe no total de sons respondem a perguntas diferentes.[1] No caderno, escreva “nasais: 6%” e “representante mais frequente: [m]” em campos próprios. Para estudar outras diferenças de uso sem confundi-las com fonética, consulte a discussão sobre português coloquial, registro e variedade.

O que os róticos permitem comparar?

O tepe lidera entre os róticos dos dois corpora. Os róticos representam 5,6% dos sons no CETENFolha e 8,2% no PF_Fone. Dentro desse conjunto, o tepe [ɾ] é o rótico mais frequente, com 4,5% e 7%, respectivamente.[2]

A comparação pode ser feita em quatro passos:

  1. Identifique a classe: róticos são o grupo medido nos dois acervos.[2]
  2. Preserve o denominador: 5,6% e 8,2% referem-se aos sons de cada corpus.[2]
  3. Separe o segmento: [ɾ] registra 4,5% no CETENFolha e 7% no PF_Fone.[2]
  4. Limite a conclusão: os valores sustentam uma diferença entre corpora, conforme a proveniência descrita.[2, 4]

Em uma ficha de estudo, a estudante pode anotar que o PF_Fone tem 2,6 pontos percentuais a mais de róticos que o CETENFolha. Ela também pode registrar o tepe como o rótico mais frequente em ambos.[2] Isso não vale como descrição automática da fala de uma pessoa específica. A fonte sustenta resultados agregados dos acervos, cujas composições são distintas.[4]

Por que as fricativas e o plural merecem atenção?

Há diferença de predominância. As fricativas correspondem a 13,1% dos sons no CETENFolha e a 15,1% no PF_Fone. Segundo o manual, [s] é a fricativa mais frequente no corpus brasileiro, enquanto [ʃ] predomina no corpus europeu. A obra relaciona essa diferença à realização do morfema de plural.[3]

A menção ao plural tem alcance específico. Ela associa a predominância de [s] ou [ʃ] nos resultados à realização de um morfema, isto é, uma unidade linguística com função gramatical.[3] O dado permite observar uma relação documentada dentro da análise dos corpora. Ele não autoriza afirmar que toda marca de plural será realizada da mesma maneira por brasileiros ou portugueses em qualquer contexto.

Para usar o resultado corretamente, escreva a cadeia completa: fricativas, percentual no corpus, segmento predominante e relação indicada com o plural.[3] Evite transformar “predomina no acervo” em “todos falam assim”. Quando você estudar tonicidade, outro aspecto sonoro, mantenha o mesmo cuidado ao ler por que o português é acentuado e como funciona a sílaba tônica.

Perguntas frequentes

O que é português?

As fontes deste artigo não oferecem uma definição geral de português. Elas permitem uma resposta mais estreita: comparar proporções de classes sonoras em dois corpora associados ao português brasileiro e ao europeu. O CETENFolha e o PF_Fone têm proveniências e dimensões descritas de formas diferentes, limite que deve acompanhar a interpretação.[4]

O que é português nativo?

O material fornecido não define “português nativo” nem classifica falantes por esse critério. Ele relata percentuais de sons em dois corpora e identifica segmentos frequentes, como [m], [l] e [ɾ].[1, 2] Esses resultados não permitem avaliar a origem, a fluência ou a identidade linguística de uma pessoa.

O que é português coloquial?

As fontes permitidas não definem português coloquial. O recorte disponível trata da proveniência do CETENFolha e do PF_Fone e das proporções de nasais, laterais, róticos e fricativas.[1, 2, 3, 4] Registro coloquial e distribuição de classes sonoras são recortes distintos, portanto um não deve servir como definição automática do outro.

Fontes consultadas

Obras e aulas usadas na redação deste guia. Os números no texto levam a elas.

  1. Barbosa, Sandra Madureira, cap. 21
  2. Barbosa, Sandra Madureira, cap. 23
  3. Barbosa, Sandra Madureira, cap. 19
  4. Barbosa, Sandra Madureira, cap. 15

Continue lendo