| Escrita latina | |
|---|---|
As 26 letras básicas são adaptadas aos sons de cada língua | |
| Tipo | Alfabeto com maiúsculas e minúsculas |
| Línguas | Ver Lista de alfabetos derivados do latino |
Período de tempo | Século VII a.C. até o presente |
Sistemas-pais | |
| Direção | Esquerda-para-direita |
| ISO 15924 | Latn, 215 |
Conjunto de carateres Unicode | Ver Escrita latina em Unicode |
A escrita latina, também chamada escrita romana, é o sistema de escrita usado para escrever português e muitas outras línguas, com um conjunto básico de letras de A a Z. Cada língua pode acrescentar sinais ou letras e atribuir sons diferentes às que já existem.
Os romanos adaptaram para o latim um alfabeto recebido dos etruscos. O alfabeto etrusco vinha de uma forma do alfabeto grego usada em Ísquia e Cumas, no sul da Península Itálica. A adaptação romana deu origem ao alfabeto latino, que se espalhou a partir da Roma Antiga e mudou à medida que passou a escrever outras línguas.
A escrita latina é usada na Europa Ocidental e Central, em muitas línguas da África subsaariana e em grande parte das Américas e da Oceânia. Ela é empregada para registrar mais línguas do que qualquer outra escrita. Suas letras também serviram de base ao alfabeto fonético internacional, usado para indicar a pronúncia.
As 26 letras mostradas na tabela, de A a Z em maiúsculas e minúsculas, compõem o alfabeto latino básico ISO.
| A a | B b | C c | D d | E e | F f | G g |
| H h | I i | J j | K k | L l | M m | N n |
| O o | P p | Q q | R r | S s | T t | U u |
| V v | W w | X x | Y y | Z z |
Na ortografia da língua portuguesa, o Acordo Ortográfico de 1990 enumera 26 letras, incluindo K, W e Y, usadas sobretudo em nomes de origem estrangeira, seus derivados, siglas e símbolos de unidades de medida.
Os sinais I, V e X, por exemplo, também são usados na numeração romana. Já os algarismos 1, 2, 3... que aparecem ao lado das letras latinas pertencem ao sistema numérico hindu-arábico e também são chamados de algarismos arábicos ocidentais.
Com a expansão do Império Romano, o latim e seu alfabeto saíram da Península Itálica e chegaram às terras em torno do mar Mediterrâneo. Na parte oriental do império, o grego continuou a ser muito usado. Na parte ocidental, o latim se espalhou, e as línguas românicas que dele se formaram mantiveram o alfabeto latino e o adaptaram.

Nos manuscritos medievais, os copistas desenvolveram formas minúsculas que se veem nos livros atuais, entre elas a minúscula carolíngia, difundida nos séculos IX e X. No Renascimento italiano, a escrita humanista retomou formas carolíngias. Os tipos romanos usados na impressão se basearam nessa escrita humanista.

Na Idade Média, a expansão do cristianismo ocidental levou as letras latinas às Ilhas Britânicas, à Escandinávia e a regiões de língua germânica. Textos em línguas celtas e germânicas passaram a ser escritos com elas. Na Irlanda, a nova escrita substituiu o ogam em muitos usos e, entre os povos germânicos, tomou o lugar das runas em boa parte dos textos.
Entre povos de línguas eslavas ocidentais e de parte das línguas eslavas meridionais, a conversão ao catolicismo veio acompanhada do uso do alfabeto latino. Já os falantes de línguas eslavas orientais em geral adotaram o alfabeto cirílico com o cristianismo ortodoxo. A língua sérvia usa as duas escritas, com predomínio do cirílico na comunicação oficial e do latino em outros usos. A legislação sérvia estabelece o cirílico para o uso oficial e prevê as condições de emprego da escrita latina.
No início da Idade Moderna, o uso da escrita latina estava concentrado no oeste cristão da Europa. A leste, comunidades cristãs ortodoxas usavam sobretudo os alfabetos cirílico e grego, enquanto a escrita árabe era usada por muitos povos muçulmanos ao sul e a sudeste. Em algumas regiões, duas ou mais dessas escritas eram usadas lado a lado.

Com a colonização europeia, a escrita latina chegou às Américas, à Oceânia, a partes da Ásia e da África e às ilhas do Pacífico. Em línguas africanas, as letras latinas passaram a conviver com escritas anteriores, que nem sempre deixaram de ser usadas.
Nas línguas das Filipinas, o alfabeto latino tomou o lugar da escrita baybayin na maior parte dos usos, embora escritas tradicionais permaneçam em algumas comunidades. Na Malásia, o malaio é escrito em rumi, de base latina, e o jawi, de base árabe, também pode ser usado. O indonésio também emprega letras latinas.
Em Goa, na costa ocidental da Índia, missionários jesuítas introduziram a escrita latina para a língua concani, uma língua indo-ariana. Um livro em concani com letras latinas foi impresso em 1622.
No Vietnã, missionários portugueses participaram da criação de um alfabeto de base latina para a língua vietnamita, que antes era escrita com caracteres de origem chinesa. No século XIX, sob o domínio francês, as letras latinas começaram a substituir esses caracteres na administração.
No século XIX, os romenos passaram a escrever a língua romena com o alfabeto latino, deixando de usar o cirílico romeno. O romeno pertence à família das línguas românicas.
No silabário cherokee, criado por Sequoyah no século XIX, os sinais representam sílabas da língua cherokee. Ao preparar os tipos para imprimi-lo, foram aproveitadas algumas letras latinas, mas elas receberam outros valores e não transformaram o silabário num alfabeto latino.
Em 1928, como parte das reformas de Mustafa Kemal Atatürk, a República da Turquia adotou um alfabeto latino para a língua turca, substituindo uma adaptação do alfabeto árabe.

Nas décadas de 1920 e 1930, povos da União Soviética adotaram alfabetos latinos, entre eles versões do alfabeto turco unificado. A mudança começou entre povos de línguas turcas, como os azeris, iacutos, tártaros, basquires, cazaques e quirguizes, e depois alcançou outros grupos linguísticos. Os moldávios passaram a usar um alfabeto latino quase idêntico ao romeno. No fim da década de 1930 e no início da seguinte, essas reformas foram revertidas pela adoção do cirílico. Alfabetos latinos soviéticos para o abaza e o cabardiano usaram o H com gancho à esquerda.
Nem todos os povos soviéticos passaram por essa mudança, como os letões, lituanos, estonianos, alemães, poloneses, finlandeses, georgianos e armênios.
Na década de 1920, linguistas da União Soviética criaram um alfabeto latino para o curdo. Nos anos 1930, Celadet Bedir Khan criou outro, publicado na revista Hawar e usado para escrever o curmânji. O sorâni costuma ser escrito com letras de base perso-árabe.
Em 1957, a República Popular da China introduziu um alfabeto para o zhuang padrão que reunia letras latinas, cirílicas e símbolos do AFI. Letras colocadas no fim das sílabas indicavam os tons. A reforma de 1982 retirou as letras cirílicas e os símbolos do AFI. O sawndip, formado a partir de caracteres chineses, continuou a ser usado por parte dos falantes.
Depois da dissolução da União Soviética, em 1991, Azerbaijão, Usbequistão e Turquemenistão se tornaram independentes e adotaram oficialmente alfabetos latinos para suas línguas turcas. Na Moldávia, onde se fala romeno, o alfabeto latino voltou a ser usado no fim do período soviético.
Depois da queda do Derg, em 1991, a política linguística da Etiópia abriu espaço para o ensino em línguas antes preteridas em favor do amárico. O oromo já era escrito com o alfabeto latino Qubee desde a década de 1970, e esse alfabeto recebeu reconhecimento oficial em 1991.
O kafa pode ser escrito com letras latinas ou com a escrita etíope. O sidama e o wolaytta também têm ortografias de base latina. O somali, falado também na Etiópia, adotou oficialmente um alfabeto latino em 1972.
Em 1999, o Tartaristão, na Rússia, aprovou uma lei para introduzir a escrita latina na língua tártara. Algumas escolas começaram a ensinar o novo alfabeto no ano letivo de 2000–2001.
A legislação federal russa de 2002 passou a exigir uma base cirílica para os alfabetos das línguas oficiais das repúblicas. O Tribunal Constitucional manteve essa exigência em 2004, impedindo a mudança planejada no Tartaristão.
Na Etiópia, a escolha entre as escritas latina e etíope ainda era debatida, na primeira década do século XXI, entre falantes de hadia e kambaata.

Em 2017, um decreto presidencial do Cazaquistão determinou a transição gradual da língua cazaque do cirílico para um alfabeto latino, com conclusão prevista para 2025. Como a mudança não se completou até 2025, o plano governamental para 2023–2029 ainda prevê a aprovação de um novo alfabeto e de regras de escrita.
Em 26 de setembro de 2019, a Inuit Tapiriit Kanatami, organização nacional dos inuítes do Canadá, anunciou a adoção de uma escrita unificada para as línguas inuítes do país. O sistema, chamado Inuktut Qaliujaaqpait, usa letras latinas e foi concebido como uma escrita auxiliar ao lado das ortografias regionais.
O Usbequistão iniciou em 1993 a adoção de um alfabeto latino para a língua usbeque. Uma resolução de 10 de fevereiro de 2021 fixou 1.º de janeiro de 2023 como limite para o uso do cirílico na documentação oficial. Em setembro de 2026, o Senado aprovou uma lei que prevê substituir ⟨G‘⟩ por ⟨Ğ⟩, ⟨O‘⟩ por ⟨Ö⟩, ⟨Sh⟩ por ⟨Ş⟩ e ⟨Ch⟩ por ⟨Ç⟩ no alfabeto latino usbeque.
O Curultai aprovou, entre 1991 e 1993, propostas de alfabeto latino para a língua tártara da Crimeia. Em 22 de setembro de 2021, o governo da Ucrânia aprovou uma versão de 31 letras, acertada com o Mejlis do Povo Tártaro da Crimeia, e estabeleceu a transição do ensino para essa escrita até 1.º de setembro de 2025.
Em geral, a escrita latina segue da esquerda para a direita e separa as palavras com espaços. Para escrever sons que o latim não tinha, outras línguas puseram diacríticos, como acentos, sobre letras existentes, criaram novas letras ou uniram duas ou mais em ligaduras. Também passaram a usar pares e trios de letras para sons próprios.

Os sons que uma língua distingue são fonemas, e as letras ou combinações usadas para escrevê-los são grafemas. Nos alfabetos de escrita latina, variam esses grafemas, a ordem das letras e os sons atribuídos a cada sinal.
Até o início do século XVII, ⟨i⟩ e ⟨j⟩ eram tratadas como formas de uma mesma letra, assim como ⟨u⟩ e ⟨v⟩. Em livros impressos, a escolha entre essas formas muitas vezes dependia da posição na palavra. Entre o fim do século XV e meados do XVII, ⟨i⟩ e ⟨u⟩ passaram gradualmente a indicar vogais, enquanto ⟨j⟩ e ⟨v⟩ passaram a indicar consoantes. No alfabeto atual, cada uma das quatro é uma letra distinta.
No inglês antigo, o alfabeto latino ganhou as letras rúnicas wynn, ⟨Ƿ ƿ⟩, e thorn, ⟨Þ þ⟩, além de eth, ⟨Ð ð⟩, ausentes do conjunto romano.
A letra irlandesa g insular deu origem a yogh, ⟨Ȝ ȝ⟩, usada no inglês médio. Para representar o som /w/, os copistas também escreviam ⟨uu⟩, forma que passou a conviver com o wynn. No inglês moderno, ⟨th⟩ tomou o lugar de eth e thorn. O wynn e o yogh também saíram de uso. Eth e thorn permanecem no alfabeto islandês, e eth integra o alfabeto feroês.

O dangme usa ⟨Ɛ ɛ⟩ e ⟨Ɔ ɔ⟩, e o ga também usa ⟨Ŋ ŋ⟩, letras acrescentadas ao alfabeto latino básico para escrever sons dessas línguas. O hauçá emprega ⟨ɓ⟩, ⟨ɗ⟩ e ⟨ƙ⟩.
O alfabeto africano de referência foi elaborado para reunir símbolos capazes de representar sons de diferentes línguas africanas. O ômega latino, ⟨Ꞷ ꞷ⟩, também aparece entre as letras destinadas a alfabetos africanos.
O I com ponto, ⟨İ i⟩, e o I sem ponto, ⟨I ı⟩, são formas distintas usadas nos alfabetos turco, azeri e em propostas latinas para o cazaque. A língua azeri também usa ⟨Ə ə⟩ para representar a vogal anterior quase aberta não arredondada.
Nas fórmulas matemáticas, letras como x e y podem indicar quantidades que variam ou ainda não são conhecidas. Para esse uso, as letras latinas usadas na matemática às vezes ganham formas tipográficas próprias.

Em chave, as letras ⟨ch⟩ representam juntas um som. Essa combinação é um dígrafo, assim como ⟨lh⟩ em olho e ⟨nh⟩ em ninho. Em inglês, ⟨sh⟩ e ⟨th⟩ também podem representar sons com pares de letras. Em neerlandês, ⟨ij⟩ é escrito ⟨IJ⟩ quando inicia um nome com maiúscula, como IJsland.
Quando três letras representam um som, a combinação se chama trígrafo, como ⟨sch⟩ em Schule, no alemão.

Nos caracteres ⟨Æ æ⟩ e ⟨Œ œ⟩, os pares ⟨ae⟩ e ⟨oe⟩ foram unidos num único desenho, ou glifo. Esse tipo de união se chama ligadura tipográfica. O sinal ⟨&⟩, chamado "e comercial", veio da união de ⟨e⟩ e ⟨t⟩ na palavra latina et, "e".
A letra ⟨ẞ ß⟩, chamada eszett ou "s forte", pode ser desenhada como a união de ⟨ſ⟩, a forma antiga do s usada no interior das palavras, com ⟨s⟩ ou com uma forma antiga de ⟨z⟩ parecida com ⟨ʒ⟩.

Em café, avô, pão e açúcar, o acento agudo, o acento circunflexo, o til e a cedilha são diacríticos, sinais acrescentados às letras. A grafia académico, usada em Portugal, e acadêmico, usada no Brasil, acompanha a diferença de pronúncia da vogal acentuada.
No alemão, o umlaut aparece nas letras ⟨ä⟩, ⟨ö⟩ e ⟨ü⟩. No romeno, há sinais em outras posições, como nas letras ⟨ă⟩, ⟨â⟩, ⟨î⟩, ⟨ș⟩ e ⟨ț⟩. Um diacrítico pode mudar o som de uma letra, a pronúncia de uma sílaba ou palavra inteira, marcar um tom, como no vietnamita e no iorubá, indicar o início de uma sílaba ou distinguir palavras de grafia semelhante.
Em neerlandês, por exemplo, een, pronunciado /ən/, é o artigo indefinido "um" ou "uma", enquanto één, pronunciado /eːn/, é o numeral "um". O efeito desses sinais depende da língua, assim como o valor das próprias letras.
O Acordo Ortográfico de 1990 suprimiu o trema das palavras portuguesas e aportuguesadas, mas o manteve em derivados de nomes estrangeiros, como mülleriano.
A revista The New Yorker escreve coöperative com trema para mostrar que os dois ⟨o⟩ pertencem a sílabas diferentes. Alguns empréstimos em inglês também preservam diacríticos da língua de origem.

Em português, a sequência vai de A a Z, com K, W e Y, enquanto o ⟨ç⟩ e os dígrafos, como ⟨ch⟩, são usados nas palavras sem ocupar posições adicionais nessa lista de 26 letras.
No sueco, ⟨å⟩, ⟨ä⟩ e ⟨ö⟩ ocupam posições próprias depois de ⟨z⟩. Na ordenação alfabética alemã, ⟨ä⟩, ⟨ö⟩ e ⟨ü⟩ são tratados em geral como ⟨a⟩, ⟨o⟩ e ⟨u⟩. Em espanhol, ⟨ñ⟩ vem entre ⟨n⟩ e ⟨o⟩, enquanto as vogais acentuadas e ⟨ü⟩ aparecem na ordenação junto das respectivas vogais sem esses sinais.
Em português, nomes de pessoas e lugares, como Pedro e Lisboa, começam com maiúscula, enquanto janeiro e primavera se escrevem com minúscula.
Em alemão, os substantivos começam com maiúscula, como em Haus, "casa". Em português, casa fica em minúscula quando não inicia uma frase nem faz parte de um nome próprio.

Criado na década de 1960 para o intercâmbio de informações, o ASCII atribui códigos de sete bits a 128 caracteres, entre eles as 26 letras latinas básicas em maiúsculas e minúsculas. A ISO/IEC 646 também reúne conjuntos de caracteres de sete bits para esse intercâmbio.
Padrões posteriores, como a ISO/IEC 10646, mantiveram as 52 formas maiúsculas e minúsculas de A a Z no conjunto latino básico, com extensões para letras usadas em outras línguas. A ISO/IEC 8859-1, conhecida como Latin-1, abrange caracteres empregados em muitas línguas da Europa Ocidental.
Os padrões baseados no ASCII não incluíam todas as letras com diacríticos usadas pelas línguas de escrita latina. O Unicode codifica essas letras junto com as letras básicas e caracteres de outras escritas. O UTF-8 permite guardar e transmitir os caracteres do Unicode e é recomendado pelo W3C para páginas da web.
Na lista ISO 15924, a escrita latina recebe o código Latn e o nome inglês Latin.
No Brasil, o modelo da Carteira de Identidade Nacional determina que nomes e sobrenomes sejam registrados com caracteres do alfabeto latino em UTF-8, conforme a tabela definida na resolução.
Para que nomes possam ser escritos e compartilhados entre sistemas digitais europeus sem perder letras ou sinais, a norma alemã DIN 91379 seleciona caracteres e combinações do Unicode. O conjunto cobre as línguas oficiais da União Europeia, da Islândia, de Liechtenstein, da Noruega e da Suíça, além das línguas minoritárias da Alemanha. A criação de uma norma europeia pelo Comitê Europeu de Normalização, ou CEN, integra os objetivos do projeto.

Em comunicações internacionais multilíngues, nomes e palavras escritos em árabe ou chinês podem precisar aparecer com letras latinas. A transliteração procura corresponder aos sinais da escrita de origem, enquanto a transcrição procura representar os sons da fala. Essa passagem para a escrita latina se chama romanização.
Em sistemas antigos de computador que só aceitavam o ASCII de sete bits, muitas mensagens em línguas de outras escritas precisavam ser registradas informalmente com letras latinas. O Unicode passou a codificar essas outras escritas, mas teclados que oferecem apenas caracteres ASCII ou latinos ainda podem levar seus usuários a escrever formas romanizadas.
| Recursos de biblioteca sobre Escrita latina |