Insira um fragmento de texto para ver o idioma mais provável e o nível de confiança. O detetor é útil para classificar materiais multilingues, verificar traduções, comentários, consultas de pesquisa e conteúdo misturado acidentalmente.
O que significa a percentagem de confiança
A percentagem indica o grau em que o resultado corresponde às características que o modelo associa a um determinado idioma. Não é uma garantia de correção nem uma afirmação de que exatamente essa percentagem do texto está escrita nesse idioma.
Por exemplo, um resultado «espanhol — 72%, português — 24%» significa que o espanhol parece a opção mais provável, mas o texto contém traços de uma língua próxima e requer verificação. Quanto mais curto e neutro for o fragmento, mais cuidado se deve ter na interpretação do resultado.
Que textos são reconhecidos com mais precisão
Para uma determinação fiável, insira pelo menos algumas frases completas. O texto deve conter palavras comuns e estruturas gramaticais típicas do idioma.
O resultado costuma tornar-se menos fiável se o fragmento predominar:
- uma ou duas palavras curtas;
- nomes de pessoas, marcas e produtos;
- URLs, endereços de e-mail, números e referências;
- código de programação;
- termos internacionais;
- transliteração;
- palavras idênticas em vários idiomas;
- texto em vários idiomas ao mesmo tempo.
A palavra menu, o nome Anna ou a cadeia SEO audit 2026 por si só praticamente não fornecem contexto suficiente ao modelo linguístico.
Idioma, escrita e país não são a mesma coisa
O cirílico não significa automaticamente russo, nem o latino significa inglês. Numa mesma escrita podem ser usadas dezenas de línguas. Além disso, o detetor de idiomas normalmente não consegue determinar com fiabilidade o país do autor.
Por exemplo:
ptdesigna o português;pt-BR— a variante portuguesa para o Brasil;pt-PT— a variante para Portugal;sr-Cyrl— sérvio em cirílico;sr-Latn— sérvio em latino.
Estas designações são chamadas de etiquetas de idioma BCP 47. O detetor pode identificar o idioma principal, mas isso não significa que determinou com certeza a variante regional ou a escrita.
Como usar o resultado para um site
A identificação do idioma é útil como verificação preliminar, mas não substitui a configuração do site.
- O idioma principal de um documento HTML é indicado pelo atributo
lang, por exemplo<html lang="pt">. - Um fragmento noutro idioma pode ser marcado separadamente:
<span lang="en">...</span>. - Para ligar versões linguísticas de páginas, utiliza-se
hreflang; o detetor de texto não o verifica. - Não convém alterar automaticamente
langouhreflangcom base apenas num curto fragmento.
Um atributo lang correto ajuda os navegadores, leitores de ecrã, sintetizadores de voz e tradutores a processar o texto adequadamente.
Cenários úteis
Verificação de site multilingue
Insira o texto de um bloco suspeito se na versão em português da página tiver ficado por erro inglês, espanhol ou outra localização. Para verificar toda a página, analise os blocos de texto principais separadamente, e não o menu, referências e código em conjunto.
Classificação de mensagens recebidas
O detetor ajuda a distribuir comentários, pedidos e contactos em filas por idioma. Com baixa confiança, é melhor encaminhar a mensagem para verificação manual.
Controlo de traduções
Pode detetar se no material traduzido ficou um fragmento grande no idioma original. A ferramenta não avalia a qualidade da tradução, gramática ou fidelidade ao original – determina apenas o idioma provável.
Limpeza semântica
Ao trabalhar com palavras-chave multilingues, o detetor ajuda a encontrar consultas que não estão no idioma desejado. As palavras-chave de uma só palavra e nomes de marcas devem ser verificados manualmente.
Como melhorar a precisão do resultado
- Use um fragmento coerente de várias frases.
- Remova URLs, números, código e elementos repetitivos.
- Separe o texto misto em blocos linguísticos e verifique-os individualmente.
- Compare não só o primeiro idioma provável, mas também os seguintes.
- Em caso de valores próximos, verifique o resultado com um falante nativo ou tradutor.
Erros comuns de interpretação
- Uma percentagem elevada não significa que o texto está isento de erros.
- Um idioma determinado não significa um país determinado.
- O detetor não confirma a qualidade nem a integridade da tradução.
- O nome do idioma não substitui a etiqueta BCP 47 correta para HTML e integrações.
- Um único resultado geral para texto misto pode ocultar uma segunda língua dentro do documento.
Perguntas frequentes
Que volume de texto é necessário?
Não existe um limiar universal rigoroso. Várias frases completas geralmente fornecem mais indícios do que uma única palavra ou título. Para textos curtos, o resultado deve ser considerado preliminar.
É possível detetar duas línguas no mesmo texto?
A ferramenta pode mostrar várias opções prováveis, mas não marca necessariamente os limites de cada língua. Os blocos mistos devem ser divididos e verificados separadamente.
O detetor identifica o dialeto ou o país?
Por vezes, os traços linguísticos permitem sugerir uma variante, mas o resultado principal geralmente refere-se ao idioma. A região não pode ser deduzida de forma fiável apenas a partir de um texto curto.
A ferramenta pode traduzir ou verificar a ortografia?
Não. A deteção de idioma, a tradução e a verificação ortográfica são tarefas diferentes.
Ferramentas relacionadas: Processador de texto; Comparador de diferenças; Eliminador de duplicados.
Normas oficiais
- BCP 47 / RFC 5646 — Tags for Identifying Languages: https://www.rfc-editor.org/rfc/rfc5646
- WHATWG HTML — atributo
lang: https://html.spec.whatwg.org/multipage/dom.html#the-lang-and-xml:lang-attributes
