|
|
ru.algorithms- RU.ALGORITHMS ---------------------------------------------------------------- From : Roman Kukushkin 2:5025/37.216 11 Jan 2003 18:46:03 To : Vitaly Lugovsky Subject : метод архивации -------------------------------------------------------------------------------- Среда Январь 08 2003 в 21:37 Vitaly Lugovsky писал Alexander Kuklev: VL> Даже если данные - эти самые 20 мб русской болтовни, то всё равно VL> некорректно считать, что вся избыточность заключена только лишь в VL> повторениях. Я не вижу ни одного основания для подобных утверждений. Если рассмотреть русский текст до определенного момента, то можно рассчитать вероятность появления в следующей позиции различных букв. Hапример, после последовательности "рассказыв" с вероятностью около 99% появляется буква 'a' (исключаются опечатки, случай в моем письме или подобные, или появление случайной последовательности именно этих букв). VL> А КАК ты найдешь все эти закономерности? Почему выбран именно такой VL> способ устранения избыточности? Марковские цепи знаешь? Hу вот. Алгоритмы с их использованием можно сделать и самообучающимися, тогда таблицу вероятностей хранить не придется. Конечно, на практике все равно мы полного сжатия не достигнем (слишком большой объем памяти и вычислительной работы потребуется), но, думаю, погрешность будет не более 2% C уважением, Roman Kukushkin. --- * Origin: (2:5025/37.216) Вернуться к списку тем, сортированных по: возрастание даты уменьшение даты тема автор
Архивное /ru.algorithms/240123e2058cc.html, оценка из 5, голосов 10
|