O que encontramos ao conferir cada tabela de código morse
Para montar um tradutor para mais de 45 línguas, extraímos cada tabela nacional de código morse da sua fonte publicada e a comparamos com uma segunda fonte independente. A maioria bate. Estes são os pontos em que elas não batem.
O ه árabe: um erro no site de morse mais visitado
A Wikipédia em inglês e a Wikipédia em árabe dão a letra árabe ه (ha) como ··−·· em código morse, o mesmo código do É latino. A tabela árabe do morsecode.world, o site de código morse mais visitado, dá ··−−··, que no código morse internacional é o ponto de interrogação. Com duas fontes independentes contra uma, e sendo essa uma o código de um sinal de pontuação, o morse24 usa ··−··. As outras 28 letras árabes batem nas três fontes. Veja a página do código morse árabe.
Croata e sérvio: duas tabelas, um código
A Wikipédia em sérvio traz uma tabela morse para o cirílico sérvio do Reino da Iugoslávia, citando a enciclopédia Свезнање, de 1937. A Wikipédia em croata traz uma tabela para as letras latinas do croata. Elas batem letra por letra: Č e Ч são ambas −·−−·, Ć e Ћ −·−··, Đ e Ђ −··−−, DŽ e Џ −−·−·, LJ e Љ ·−−−·, NJ e Њ −−·−−, Š e Ш −−−·− e Ž e Ж −−··−. A mesma tabela também difere da russa em В, Ж, Ч e Ш. Veja a página do código morse sérvio.
Ź e Ż do polonês: trocados entre as fontes
A Wikipédia em polonês dá Ż como −−··−· e Ź como −−··−. A Wikipédia em inglês e a Wikipédia em sueco dão o contrário (Ż −−··−, Ź −−··−·). Como as fontes discordam e nenhuma é um padrão oficial, o morse24 envia as duas letras como um Z simples quando você escolhe polonês, e avisa, em vez de arriscar enviar a errada.
O Ї ucraniano: regulamento oficial contra tabela dos escoteiros
A Wikipédia em ucraniano mostra duas colunas. O regulamento oficial envia Ї igual a І (··). A tabela do Plast, a organização de escoteiros da Ucrânia, dá a Ї um código próprio, ·−−−·, e a Wikipédia em inglês concorda com o Plast. O morse24 usa ·−−−· para que Ї possa ser decodificada de volta, e registra a variante oficial na página do ucraniano.
Código telegráfico chinês: 418 caracteres diferem
O chinês é enviado em morse como números de quatro algarismos tirados de um livro de códigos telegráficos. O banco de dados Unihan do Unicode registra dois livros: o da China continental (kMainlandTelegraph, 7.078 caracteres) e o de Taiwan (kTaiwanTelegraph, 9.024 caracteres). Dos 4.572 caracteres que aparecem nos dois, 418 têm um número diferente em cada livro. Uma mensagem codificada com um livro e decodificada com o outro sai errada nesses caracteres. Veja a consulta do código telegráfico chinês.
O ็ tailandês: duas fontes, dois códigos
A Wikipédia em tailandês e a tabela publicada pela estação de radioamador tailandesa HS4VED batem em 65 sinais morse tailandeses. Elas discordam em um, o sinal de vogal curta ็ (mai tai khu): −−−·· em uma, ·−−−· na outra. O morse24 prefere deixá-lo de fora a chutar.
Como conferimos
Cada tabela foi extraída da sua fonte por script, nunca digitada à mão, e cada código foi verificado contra a linha exata de onde veio. A lista completa de fontes está na página de fontes. Se você conhece uma tabela publicada que resolva um desses conflitos, escreva para hello@morse24.com.
Abrir o tradutor de código morse
Mais ferramentas de código morse
Referência
Mais