O que são substantivos na prática
Substantivo é a classe gramatical que nomeia seres, coisas, lugares, sentimentos e conceitos. Isso soa simples porque é simples na teoria, mas a hora de classificar palavras em contextos reais começa a complicar. A língua portuguesa tem camadas que livros didáticos muitas vezes ignoram porque acham que o aluno só precisa decorrer a definição de primeira prova. Quando eu comecei a trabalhar com revisão de textos e análise gramatical em larga escala, percebi logo que o problema não é entender o que é substantivo. O problema é identificar quando uma palavra está funcionando como substantivo ou se está prestes a se tornar outra classe. Palavras como "correr", "beleza" e "rápido" transitam entre substantivo, verbo e adjetivo dependendo do contexto, e isso causa erro constante em análise sintática e em ferramentas de NLP.
o que é substantivo e exemplos
A pergunta sobre o que é substantivo e exemplos aparece o tempo todo em fóruns, e a resposta curta é que substantivo é o termo que nomeia entidades. Mas a resposta útil envolve os subtipos, porque saber diferenciar um substantivo comum de um abstracto muda completamente como você trata a palavra na análise. Um substantivo concreto nomeia algo que você pode tocar ou perceber pelos sentidos. Um substantivo abstrato nomeia algo que existe só na ideia, como amor, coragem ou justiça. Aqui vai uma lista prática que costuma funcionar como referência rápida. Substantivos comuns: mesa, professor, cão, cidade, livro. Substantivos próprios: Brasil, Maria, São Paulo, Amazon. Substantivos coletivos: cardume, enxame, bibliografia, arquipélago, alcateia. Substantivos primitivos: pedra, madeira, fruta, rio, fogo. Substantivos derivados: pedr-a, madeir-a, frut-eira, ri-bei-ro, fogo-ras. Substantivos simples: água, sal, terra, vento. Substantivos compostos: girassol, passatempo, segunda-feira, guarda-chuva.
Tem um detalhe que muita gente não considera e que causa erro feio. Palavras que parecem adjetivos ou verbos podem funcionar como substantivos quando recebem artigo ou numeral. O "bem" em "buscar o bem alheio" é substantivação de um advérbio. O "rápido" em "o rápido deve passar" vira substantivo. O "alto" em "viver do alto" também. Se você estiver construindo um pipeline de análise morfossintática, não confie apenas no catálogo de palavras. Confie no entorno sintático. A presença de artigo definido, indeterminado, preposição articulada ou numeral é o sinal mais confiável de que aquela forma está atuando como substantivo naquele ponto do texto.
Classificação prática que funciona
Dividir substantivos em gênero e número é trivial. A parte que realmente importa é a classificação funcional, porque ela determina como a palavra se comporta na frase e quais concordâncias você precisa aplicar. Substantivos comuns e próprios diferem na capitalização, mas funcionalmente ambos ocupam posição de núcleo nominal. Substantivos concretos e abstratos são a divisão que mais gera confusão em exercícios e em processamento automático, porque a fronteira não é sempre nítida. Eu já perdi tempo tentando classificar palavras como "escuridão" e "escuridão do pensamento". A primeira é abstrata até porque não tem existência material direta. A segunda depende do contexto para saber se está nomeando um fenômeno físico ou uma metáfora. Em análise automática, essa ambiguidade quebra classificadores baseados apenas em lista de palavras. A solução mais prática que eu encontrei foi combinar o uso de rede de dependência com um analisador morfossintático, verificando se a palavra ocupa posição de núcleo de sintagma nominal com determinante. Quando ocupa, trata como substantivo naquela ocorrência específica, mesmo que a forma lexical possa ser ambígua.
👉 Clique no botão abaixo para saber mais sobre o assunto!
Pegadinhas e casos de borda
Substantivos uniformes e sobrecomuns são os que mais derrubam quem não presta atenção. Uniformes têm uma forma para dois gêneros, como "o e a vítima", "o e a alicate", "o e a nutricionista". Sobrecomuns têm uma forma fixa e gênero fixo, mas referem-se a pessoas, como "o cônjuge", "o gênio", "a criatura". Isso não é erro. É a norma. O erro é tratar "vítima" como se tivesse variação de gênero só porque a pessoa pode ser homem ou mulher. Adjetivos substantivados merecem atenção separada. "Os ricos", "os pobres", "os antigos", "os franceses" funcionam como substantivos porque o adjetivo está exercendo função de núcleo nominal. Em processamento de linguagem, isso exige regras específicas de lematização. Se você mapear "ricos" apenas como adjetivo, seu analisador vai produzir erro de concordância na geração de texto. A correção é identificar o determinante e tratar a forma como substantivo naquela posição, mantendo a flexão de gênero e número adequada ao referente.
Outro problema recorrente é a substantivação de orações inteiras. "O que ele disse me magoou" funciona como sujeito porque a oração subordinada substantiva ocupa posição de termo nominal. Ferramentas simples de análise não lidam bem com isso. A workaround que eu adotei foi tratar orações subordinadas substantivas como blocos NominalPhrase durante a análise, em vez de tentar decompor cada palavra isoladamente. Isso reduziu drasticamente a taxa de erro em extração de sujeito e objeto direto.
Onde a coisa fica complicada
Substantivos de verbo, como "a corrida", "a limpeza", "a leitura", "a entrega", são formados pela derivação sufixal ou pelo processo de substantivação de infinitivo. Eles carregam argumentos do verbo original, o que significa que a estrutura semântica permanece ativa. "A leitura do livro pelo aluno" ainda mantém a relação de agente e paciente. Em sistemas de extração de informação, ignorar essa propriedade faz com que relacionamentos argumentais sejam perdidos. A solução mais econômica é herdar o quadro predicativo do verbo fonte e aplicá-lo ao substantivo derivado. Há ainda os substantivos que variam de significado conforme o gênero, como "o cabeça" versus "a cabeça", "o grua" versus "a grua", "o moral" versus "a moral". Essa variação não é apenas lexical. Ela afeta concordância, seleção de preposição e até a estrutura sintática da frase. Um analisador que tratasse "moral" sempre como masculino produziria erros em contextos como "a moral da história". O caminho é manter entradas lexicais distintas por gênero, com regras de seleção de sentido baseadas no determinante e no contexto imediato.
Considerações finais sobre uso
Não existe método perfeito para classificação automática de substantivos em textos reais. A ambiguidade estrutural é inerente à língua, e qualquer ferramenta que prometa 100% de precisão está enganando o usuário. O que funciona na prática é combinar análise morfossintática, verificação de contexto e heurísticas baseadas em frequência. Para trabalho manual, o teste do artigo funciona na maioria dos casos, mas falha em construções literárias, títulos e linguagem técnica onde a substativação é intencional eambígua. Se você precisa de uma abordagem mais robusta, considere usar um analisador sintático baseado emgrammar, como o spaCy ou o UDPipe, configurado para português. Eles lidam melhor com ambiguidades do que soluções puramente baseadas em regras. O custo é maior tempo de processamento e necessidade de ajuste fino para domínios específicos. Para a maioria dos casos do dia a dia, however, uma tabela de classificação com os subtipos principais e os testes de entorno descritos aqui resolve o problema sem complicação.