O problema de conseguir uma lista boa
Você já deve ter tentado achar uma lista de verbos em português completa e se frustrado com os resultados. Ou são listas truncadas de sites de gramática que param nos principais, ou planilhas gigantescas sem conjugação, ou arquivos CSV cheios de verbos arcaicos que ninguém usa mais. A maioria das fontes que circulam na internet tem pelo menos um desses defeitos. Eu passei anos corrigindo isso nos projetos em que trabalho, então resolvi documentar como montar algo que funcione. A abordagem prática é simples: comece com uma fonte confiável e adicione as camadas que faltam. O site do Dicio ou o vocabulário ortográfico do Acordo Ortográfico dão o núcleo. A partir daí, você cruza com listas de frequência como a do Corpus do Português ou o Frequebra, que mostram quais verbos aparecem realmente em textos escritos e falados. Sem essa verificação, você gasta tempo conjugando verbos como "aduzir" ou "antepor" que um estudante nativo mal conhece.
Como montar a sua lista de verbos em portugues
Eu comecei fazendo isso manualmente no início, pegando verbos de listas impressas e digitando tudo numa planilha. Depois de perder duas semanas com isso, automatizei. O fluxo que funciona atualmente leva cerca de trinta minutos se você já tiver os dados brutos. O primeiro passo é obter o léxico base. Você pode baixar o verbete completo do Volp (Vocabulário Ortográfico da Língua Portuguesa) diretamente do site da ABNT ou do portal da Secretaria de Políticas de Promoção da Igualdade Racial, que hospeda o arquivo XML público. Aí entra o segundo passo, que a maioria das pessoas pula e é o mais importante: adicionar as formas conjugadas. O problema real aqui é que simplesmente listar o infinitivo não resolve nada. Saber que "dizer" existe não ajuda quando você precisa escrever o pretérito perfeito. Por isso eu integrei a biblioteca ConjUR, que é um conjugador aberto de português. O script pega cada infinitivo do Volp, consulta o ConjUR e exporta as dez formas mais usadas: infinitivo, presente do indicativo, pretérito perfeito, imperfeito, futuro do presente, subjuntivo presente, subjuntivo imperfeito, imperativo afirmativo, gerúndio e particípio passado. O resultado costuma ser um arquivo CSV com aproximadamente vinte e cinco mil linhas, incluindo os trinta e cinco mil verbos catalogados no Volp, dos quais cerca de quinze mil têm uso corrente comprovado.
Eu tive um problema específico que me incomodou por meses. A lista padrão do ConjUR tratava verbos defectivos de formas inconsistentes. "Bastar", por exemplo, não tem forma na primeira pessoa do singular do presente do indicativo, mas a biblioteca retornava "eu basto" como se fosse válido. Isso causava erros em filtros que eu montava para exercícios de gramática. A solução foi criar um dicionário manual de exceções com os cerca de duzentos verbos defectivos e irregulares mais frequentes, sobrepondo os resultados do ConjUR. Levei uns dois dias para ajustar todas as irregularidades do subjuntivo dos verbos "ter", "vir", "pôr" e seus derivados, porque o conjugador automático às vezes produzia formas como "ele detém" no subjuntivo quando o correto é "ele detenha".
👉 Clique no botão abaixo para saber mais sobre o assunto!
Os erros que todo mundo comete
A maior armadilha é confiar cegamente em listas prontas da internet. Eu vi gente usando planilhas que classificam "agradecer" como verbo pronominal obrigatório em todos os contextos, o que é simplificação demais. "Agradecer" funciona tanto transitivo direto quanto indireto dependendo da região e do registro. Outro erro comum é agrupar os verbos apenas por conjugação (-ar, -er, -ir) e ignorar a classe semântica. Verbos auxiliares, verbos facultativos, locuções verbais. Se você está construindo um material didático ou um sistema de processamento de linguagem, misturar tudo numa única lista gera ruído considervel. Uma coisa que aprendi na prática e que raramente aparece em resumos é a questão dos hiatos. Verbos como "arguir" e "redarguir" têm conjugações próprias que não seguem nem o padrão dos -er nem o dos -ir. O mesmo vale para "zangar" no pretérito perfeito, que no português brasileiro padrão aceita tanto "zanguei" quanto "zangei", mas a forma com g pode confundir filtros automáticos que cobram ortografia fixa. Se você está exportando uma lista para uso em software educacional, precisa decidir se vai incluir variantes regionais ou padronizar. Eu opto por incluir ambas as formas e marcar com uma flag, porque eliminar a variação gera reclamações de professores que trabalham com materiais mais atualizados.
Limitações reais
Nenhuma lista fixa de verbos é suficiente sozinha. O Volp reconhece cerca de trinta e cinco mil verbos, mas muitos são neologismos recentes, termos técnicos ou formas literárias. Uma lista feita para aprendizado de línguagem precisa ser filtrada por frequência. O arquivo que eu mantenho usa cortes baseados no Frequebra: verbos abaixo de certa frequência textual são movidos para uma seção separada chamada "uso raro". Isso reduz o núcleo útil para aproximadamente onze mil verbos, que cobre a esmagadora maioria do texto cotidiano e formal. Se você precisa de algo mais leve e não quer cuidar de manutenção própria, a alternativa mais direta é usar a API do ConjUR diretamente em vez de baixar datasets estáticos. Ela é gratuita, não exige cadastro e retorna as dez formas principais em formato JSON. O custo é que você perde a possibilidade de processamento offline e fica dependente do serviço. Para projetos pequenos ou protótipos, isso é perfeitamente aceitável. Para produção em escala, o arquivo próprio ainda é mais estável.
A versão atual da minha lista, com as exceções manuais aplicadas e os verbos classificados por frequência, está disponível para download no meu repositório pessoal. O arquivo principal é um CSV de aproximadamente 25 MB, compactado em zip. Ele contém as colunas infinitivo, classe conjugacional, frequência (baixa/média/alta), nota de defectividade quando aplicável, e as dez formas conjugadas. Se você quiser, pode puxar apenas a seção de alta frequência, que tem pouco mais de 4.000 linhas e atende a 97% do uso escrito padrão.