ORTHO(1) DICIO NOME ortho, tt-ortho, tex-ortho - corretor ortogr'afico para portugu^es SINOPSE DIR/[tt-|tex-]ortho [-alt | -allwrong] [DICIOS] < TEXTO > ERROS DESCRI'C~AO "ortho" e seus parentes s~ao programas que fazem verifica'c~ao ortogr'afica de textos em portugu^es (variante do Brasil), e opcionalmente sugerem corre'c~oes para erros. Na sinopse acima, DIR 'e o diret'orio onde o sistema "ortho" est'a instalado, atualmente "/proj/dicio/ortho". O par^ametro DICIOS 'e uma lista opcional de nomes de arquivos (m'aximo 4) contendo palavras que o usu'ario quer acrescentar ao vocabul'ario fornecido com o sistema. Cada um destes arquivos deve conter uma palavra por linha, em qualquer ordem, sempre com acentos codificados em ISO Latin-1 (os filtros DIR/ttiso e DIR/texiso podem ser 'uteis neste ponto). Por problemas t'ecnicos da implementa'c~ao, os DICIOS devem estar acess'iveis e leg'iveis a todos os usu'arios. As tr^es formas do comando t^em efeitos similares, diferindo basicamente na maneira como acentos devem ser codificados na entrada: "ortho" pressup~oe arquivo-texto com acentos codificados em por c'odigos de 8 bits, segundo o padr~ao ISO Latin-1. "tt-ortho" pressup~oe arquivo-texto com acentos codificados segundo a conven,c~ao tt, que est'a sendo usada neste arquivo. "tex-ortho" pressup~oe arquivo-texto com acentos codificados segundo a conven,c~ao TeX (use "\c{c}" e "\c{C}" em lugar de "\c c" e "\c C"; para "i" com acento use "\'{\i}"; para todas as outras letras acentuadas use "\'a", etc; N~AO USE "\'{a}"). De qualquer forma, o formato especificado para o arquivo de entrada ser'a usado tamb'em para o arquivo de sa'ida. Estes tr^es programas s~ao "filtros" no sentido UNIX (atualmente dispon'iveis apenas nas plataformas SPARC/Solaris). Todos l^eem uma lista de palavras da entrada padr~ao, e escrevem a resposta na sa'ida padr~ao. O conte'udo da sa'ida depende das outras op'c~oes: "-alt" indica que o arquivo de sa'ida deve trazer sugest~oes de alternativas para as palavras inv'alidas (n~ao encontradas no vocabul'ario geral ou nos vocabul'arios locais.) A op,c~ao "-allwrong" indica que todas as palavras devem ser consideradas incorretas (usado para obter listas de alternativas para todas as palavras dadas). Em qualquer dos tr^es programas, palavras que cont^em '\' s~ao ignoradas (sup~oe-se que sejam comandos de formata'c~ao), e letras mai'usculas s~ao convertidas para min'usculas. Al'em disto, s~ao ignoradas (quase?) todas as palavras como "center", "itemize" etc que podem aparecer em '\' em LaTeX. DETALHES DA IMPLEMENTA'C~AO Na verdade, tt-ortho e tex-ortho s~ao scripts que convertem os acentos para ISO Latin-1, executam o programa "DIR/notPUB/Verif" (que 'e o cora'c~ao do sistema), e convertem o resultado de volta para a codifica'c~ao correspondente. O programa "DIR/notPUB/Verif" pode ser utilizado diretamente pelo usu'ario, ou aproveitado em scripts especializados para outros formatos de entrada/sa'ida. Ele aceita outras op,c~oes para busca mais completa de alternativas. Entre elas est~ao "-transpose", "-subst", "-remove" e "-insert". Com estas op,c~oes, o programa tenta, para palavras suficientemente longas, respectivamente, transpor letras consecutivas, substituir uma letra por outra, remover uma letra, inserir uma letra entre outras duas. (Entretanto, vale obervar que estas op,c~oes tornam a execu,c~ao significativamente mais demorada e produzem, frq"uentemente, alternativas n~ao muito razo'aveis.) Um script auxiliar, "DIR/testortho" executa um exemplo de "ortho" com dicion'ario local e busca de alternativas para todas as palavras dadas num arquivo. PROBLEMAS E LIMITA'C~OES Algumas palavras de uso comum n~ao constam do vocabul'ario. Solicitamos aos usu'arios que comuniquem tais lacunas (ou quaisquer outros problemas com o sistema "ortho") por e-mail, para . Hifens s~ao tratados como separadores de palavras, isto 'e, "guarda-chuva" e "compr'a-lo-ei" s~ao tratados como palavras "guarda","chuva", "compr'a", "lo" e "ei" (que s~ao acusadas como erros). Esta vers~ao 'e mais lenta do que seria desejado, devido em parte ao uso de v'arias camadas de filtros. AUTORES E AGRADECIMENTOS O sistema "ortho" foi desenvolvido por T. Kowaltowski, C. L. Lucchesi e J. Stolfi, no Instituto de Computa'c~ao (IC) da Unicamp. O vocabul'ario atualmente usado pelo sistema 'e cortesia da TTI Tecnologia, e foi cedido somente para fins acad^emicos de PESQUISA e de ENSINO. Partes da tecnologia usada no sistema foi desenvolvida sob conv^enio entre o IC e empresas nacionais de software. Em conseq"u^encia, o programa "ortho" e os arquivos associados n~ao podem ser copiados (exceto para "back-up") ou transferido para nenhum outro diret'orio ou instala,c~ao sem concord^ancia pr'evia dos autores. VEJA TAMB'EM O arquivo ortho.manpage neste mesmo diret'orio. A interface WWW em http://www.dcc.unicamp.br/ortho/ CONTROLE DE EDI'C~AO Last edited on 1999-06-10 04:13:44 by dicio