Re[5]: Автозамена символов
ПЯ>> Письма вы отправляете вообще-то в КОИ-8, что следует из заголовков
ПЯ>> письма вашего ответа.
ЕАА> В кои было единственное письмо :-) И всё из-за новой версии Бата.
ЕАА> Остальные в 1251.
А рубашку на груди рвали что в ASCII :)
ПЯ>> А в КОИ-8-r (RFC1489) тоже ни знака номера ни ёлочек нет.
ЕАА> Этот ужас вообще зря придумали -- попытка выпендриться перед другими,
ЕАА> но сейчас не об этом :-)
Как раз таки это они нормально придумали
На тот момент не было реально ни одно стандарта на кирилицу.
Потом ещё буржуины с большого ума придумали мёртво рождённый ISO-8859-5
Мелкомягкие взяв массой расплодили cp-1251
А КОИ-8 как раз таки стандартизировали те кто реально занимался
первыми сетями в СССР
По части всяких красивых символов он конечно имеет меньше чем винда
но у него есть одно специальное свойство которое на тот момент было
очень важно - если текст пострадает при передаче и у байтов занулится
старший бит то текст останется читаем - русские буквы станут латинскими
(правда с заменой регистра) но прочитать "по латински" текст вы
сможете.
Это сейчас выгляд ужасом, то тогда семибитные пути и протоколы передачи данных
были во весь рост (привет всё от тех же пиндосов с их семибитным ASCII
и мнением что по другому чем у них в мире не бывает) и текст
в котором есть символы бОльшие по коду чем 127 корячило только так.
Виндовая же и прочие кодировки при такой "обработке" превращались
вообще в нечитаемое для обычного человека.
ЕАА> В таком случае, что увидят те, кто получает в кои, если символы не
ЕАА> трогать, а оставить как есть?
ПЯ>> Попробуйте верно формулировать.
ПЯ>> Вот например были недавно у человека проблемы с выпуском по-рассписанию
-
ПЯ>> ему лист помог. Правда он не путал ничего.
ЕАА> Угу. Ну, скажем так, Subscribe -- первый сайт, где я увидел такую
ЕАА> замену :-) Больше нигде не видел, честно-честно :-) Откройте тайну,
ЕАА> что там ещё заменяется и на что? Вся расширенная аски заменяется на
ЕАА> похожие символы? :-)
Всё чего нет в КОИ заменяется на "аналог" для _текстовых_ версий
(в ХТМЛ проблем нет - entity и вперёд)
И причина так же проста как и стара - с самого начала (>10 лет назад)
кодировка серверов и _хранения_ архива была КОИ-8 - с ЮТФ тогда было
не очень хорошо.
Вот такие вот родимые пятна. Думы конвертнуть всё в UTF конечно еcть,
но каких-то огромных плюсов это не даст (внутри обработка выпуска
всё же в Unicode да и новые части в UTF-8) + не тронь что работает.