|
|
ru.linux- RU.LINUX --------------------------------------------------------------------- From : Victor Wagner 2:5020/400 14 Feb 2002 10:45:46 To : Denis Smirnov Subject : Re: генерация NLS -------------------------------------------------------------------------------- Denis Smirnov <mithraen@freesource.info> wrote: DS> Victor Wagner <vitus@45.free.net> wrote: VW>> Всего три уровня подстановок 1. Последовательности, VW>> заменяющие символы, недопустимые в выходном формате 2. VW>> Перекодировка 3. Последовательности, заменяющие символы, VW>> отсутствующие в выходной кодировке. Для разных форматов - VW>> ASCII, TeX, HTML - просто подменяем первую и третью VW>> таблицу. DS> Я несколько не понимаю -- получается что 3-я таблица DS> действует уже после перекодировки, а значит должна DS> задаваться в формате результирующей кодировки? У тебя это Hет. Третья таблица вступает в действие тогда, когда перекодировка данного символа _не удалась_. И на входе имеет то же самое, что имела вторая таблица. DS> проходит нормально, но если добавить в качестве DS> результирующей таблицы, скажем, EBCDIC, то всё должно DS> сломаться, я правильно понимаю? Абсолютно неправильно. У меня все будет ломаться только при указании в качестве результирующей кодировки какой-нибудь big-5 или EUC-JP, в силу особенностей реализации 2-й таблицы, которая устроена по принципу "символ в байт". VW>> А в качестве второй (и нулевой - преобразования из VW>> исходной кодировки в Unicode) используем файлик с VW>> ftp.unicode.org _как_есть_ считывая его в некую структуру VW>> данных runtime. DS> Это я понял. Хотя я предпочёл компилировать их изначально в DS> массивы, и прилинковывать. Чтобы бедному юзеру, которому понадобилась вдруг какая-то cp1125, о которой ты в момент написания и не подозревал, пришлось бы программу перекомпилировать. А также чтобы при загрузке программы в память попадали все известные ей таблицы, когда нужны-то всего две. VW>> Это нынче уже лишнее. DS> Можно подробнее? Каким образом произвольный уникодный текст DS> представить в виде, который съест и не подавится latex? Hапример, вместо LaTex в сложных случаях использовать omega. Сложным называется случай когда после перекодировки по моему алгоритму более 10% символов превращаются в многосимвольные последовательности. -- Ошибайся коллективно. --- С.Е. Лец Отправлено через сервер Форумы@mail.ru - http://talk.mail.ru --- ifmail v.2.15dev5 * Origin: Free Net of Leninsky,45 (2:5020/400) Вернуться к списку тем, сортированных по: возрастание даты уменьшение даты тема автор
Архивное /ru.linux/6488fcb49f80.html, оценка из 5, голосов 10
|