As Dez Classe Gramaticais - As dez classes gramaticais e suas características | PDF | Pronome | Palavra
As dez classes gramaticais e suas características | PDF | Pronome | Palavra

O que você precisa saber sobre as dez classe gramaticais antes de usar qualquer ferramenta

A maior parte do material que você encontra online trata as classes gramaticais como se fossem etiquetas estáticas. Não são. Elas funcionam de forma dinâmica no texto, e a classificação de uma palavra muda dependendo do contexto. Isso é o que a maioria dos tutores ignora, e é também o motivo pelo qual ferramentas automatizadas cometem tantos erros.

as dez classe gramaticais: a lista que todo mundo cita mas poucos entendem direito

Artigo, substantivo, adjetivo, advérbio, pronome, verbo, preposição, conjunção, interjeição e numeral. Dez. Parece simples, mas a coisa complica rápido quando você começa a analisar produção real. Vou dar um exemplo bem específico. No meu trabalho, precisei processar um corpus jurídico com mais de oitenta mil linhas. A maior parte das ferramentas de análise morfológica errava em três pontos principais: confundia pronome com determinante, classificava advérbios que eram realmente preposições encurvadas, e tinha dificuldades existenciais com numerais. O corpus continha trechos como "conforme o disposto na alínea 'a'", onde "a" pode ser artigo definido, preposição ou pronome oblíquo átono dependendo da estrutura. Ferramentas padrão marcavam tudo como artigo.

Um caso mais difícil: "o menos que se pode esperar". Aqui "menos" funciona como advérbio de intensidade, mas a maioria dos tokenizadores classifica como substantivo. A diferença é crucial para análise estatística downstream. Eu resolvi isso criando uma regra específica no pipeline que verificava o contexto imediato: se "menos" vinha precedido por "o" e seguido por oração subordinada, eu reclassificava manualmente. Pobre, mas eficaz.

Cada classe em prática, não em teoria de livro didático

Vamos começar pelo que as pessoas costumam entender errado. Verbo não é apenas ação. Ele carrega tempo, modo, aspecto, pessoa e número. Tudo ao mesmo tempo. Um verbo conjugado em português é basicamente uma cápsula de informação gramatical compactada. Quando você vê "falávamos", já sabe que é pretérito imperfeito, primeira pessoa do plural, indicativo. Nada disso precisa ser dito explicitamente. Substantivo é mais complicado do que parece. Palavra que nomeia coisas. Mas substantivação acontece o tempo todo. "O moderno", "os pobres", "um cafezinho". Palavras que não são substantivos viram substantivo dependendo da função sintática. Isso significa que classificar uma palavra isoladamente é praticamente inútil. O contexto é tudo.

Adjunto adnominal versus complemento nominal. A diferença é sutil mas importante. Adjunto adnominal modifica substantivo e pode ser substituído por adjetivo. Complemento nominal completa sentido de verbo, substantivo ou adjetivo intransitivo e sempre vem regido por preposição. Ferramentas automáticas tropeçam nisso frequentemente, especialmente em textos formais onde a regência é mais rígida. Pronome merece atenção especial. Pronome pessoal do caso reto (eu, tu, ele) não é o mesmo que oblíquo (me, te, o, a). E tem ainda o possessivo, demonstrativo, relativo, indefinido e interrogativo. O problema é que muitos desses pronomes se sobrepõem funcionalmente. "Que" pode ser pronome relativo, pronome interrogativo ou até partícula expletiva dependendo da construção. Eu passei duas semanas ajustando um analisador porque ele tratava "que" como sempre sendo pronome relativo.

Preposição e conjunção. Duas classes que todo mundo confunde. Preposição liga termos dentro da mesma oração. Conjunção liga orações ou termos coordenados. "Para" é preposição em "fui para casa" mas conjunção em casos mais raros. "Como" é o pior inimigo aqui: pode ser preposição, conjunção comparativa, pronome relativo, advérbio. O contexto determina tudo.

👉 Clique no botão abaixo para saber mais sobre o assunto!

Um insight que ninguém ensina nos cursos básicos

A fronteira entre advérbio e adjetivo é mais borrada do que parece em português. Muitos dicionários classificam palavras como "bem" e "mal" apenas como advérbios, mas elas podem funcionar como adjetivos em certas construções. "O bem e o mal" — aqui são substantivados, não advérbios. A mesma palavra, classe diferente conforme a função sintática. Numeral é outra classe subestimada. Ordinal, cardinal, multiplicativo, fracionário. A maioria dos analisadores morfológicos trata numerais como substantivos ou adjetivos genéricos. Se você está fazendo análise quantitativa de texto, isso gera ruído significativo. Numerais cardinais funcionam como adjetivos quando modificam substantivos ("trinta pessoas") mas como substantivos quando aparecem sozinhos ("os trinta primeiros").

Interjeição é trivial para processamento automático, mas socialmente relevante. Em análise de sentimento e discurso, interjeições carregam carga emocional desproporcional ao tamanho. "Ai", "nossa", "nãoooo" — palavras curtas que distorcem métricas baseadas apenas em frequência se não forem pesadas corretamente.

Onde tudo isso falha na prática

Ferramentas automatizadas de classificação morfológica têm taxa de acerto boa em textos formais bem estruturados, mas degringolam em português falado, literatura contemporânea e textos técnicos com neologismos. A variação dialetal é especialmente problemática. "A gente" é tratamento informal mas funciona como terceira pessoa do singular em Concordância verbal. Anotadores automatizados frequentemente marcam como erro quando na verdade é variação legítima. O maior garganto que eu encontrei: palavraspolissemânticas em domínios específicos. No jurídico, "parte" é substantivo mas também funciona como termo técnico com significado especializado. Na medicina, "baixo" pode ser advérbio de intensidade ou adjetivo anatômico. O modelo precisa de treino por domínio para evitar esses enganos.

Se você está começando agora com análise de texto em português, não confie cegamente em saída de ferramentas prontas. Valide amostras manualmente. Um painel de trinta frases bem anotadas manualmente vale mais do que mil linhas processadas automaticamente com confiança alta mas classificação errada. Eu levei seis meses para parar de confiar cegamente em saida do SpaCy com modelos pt_core_news_sm e foi o melhor investimento de tempo que fiz no projeto.

O que fazer antes de jogar tudo numa ferramenta

Limpeza de texto importa mais do que você imagina. Caracteres especiais, abreviações, siglas, numerais escritos por extenso versus dígitos. Cada um desses elementos pode confundir um tokenizador. Eu criei uma camada pré-processamento que normaliza numerais escritos por extenso antes de qualquer análise morfológica, e a precisão subiu aproximadamente oito pontos percentuais no meu corpus de teste. Documentação de classificação é essencial. Se você vai retrabalhar anotações depois, anote suas decisões. O caso de "o menos que se pode esperar" que citei antes — sem documentação, outro anotador iria marcar como substantivo na revisão. Regras explícitas evitam inconsistência entre revisores.

Não existe ferramenta perfeita para as dez classe gramaticais em português. A língua tem particularidades que modelos treinados em inglês ou espanhol simplesmente não capturam. Use o que estiver disponível, mas mantenha sempre uma camada humana de validação, especialmente para os casos limítrofes que todo texto nativo produz em abundância.