Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > Флейм > Какую кодировку лучше использовать?


Автор: KatEr 24.3.2003, 10:44
Здравствуйте!
Я создаю сайт на Linux-сервере и использую кодировку koi-8. Но вот недавно услышала, что в последнее время стандартом все-таки становится кодировка Windows и во многом ее использовать удобнее. Это правда?

Автор: desyatnik 24.3.2003, 21:56
Чушь собачья. Стандартом кодировка Windows никогда не была и не станет. Если уж на то пошло, то стандартом можно назвать только ISO-8859-5, Unicode и KOI-8. Первая почти не используется, так что остаётся два варианта. CP1251 разумно использовать в Windows-системах, за их пределами - бессмысленно. Если хочется переносимости - UTF-8 нам поможет.

Автор: KatEr 25.3.2003, 09:41
А почему именно они - стандарты? Не исторический аспект (это понятно), а их универсальность по отношению к каким-либо системам.
Нужна такая информация: win умеет то и то и не умеет то и то, а вот koi... и так далее...
Заранее спасибо за ответ.

Автор: desyatnik 26.3.2003, 00:25
ISO-8859-x приняты ISO (International Standart Organisation, если не ошибаюсь); Unicode тоже имеет соответствие в ISO (номер точно не помню; смысл в том, что ISO даёт только кодовую таблицу, а Unicode ещё и определяет разные схемы кодирования типа UTF-8/UTF-16/UCS-2, алгоритмы алфавитного сравнения букв etc. etc.), КОИ-8 принята ГОСТом. Это, и только это определяет, является ли кодировка стандартной или не является.

А в плане юзабельности:
1) Unicode одна на всех (UTF-8, UTF-16, UCS-2 и прочие - это схемы кодирования, более-менее эквивалентные друг другу), зато довольно прожорливая как к памяти, так и к вычислительным ресурсам (сложная система кодирования, буквы занимают от одного до чуть ли не 16-и байт и т.п.)

2) КОИ-8 остаётся читабельной при урезании 8-го бита (актуально ли это сейчас, не знаю), зато невозможно простое алфавитное сравнение (буквы не в алфавитном порядке раскиданы).

3) CP1251, ISO-8859-5 особо выдающегося ничего не имеют, но и недостатков особых у них нет. Разве что в CP1251 есть некоторые символы, которых больше нигде нет (кроме Уникода), например, левые/правые кавычки.

Вроде бы так... smile.gif

Автор: KatEr 26.3.2003, 05:52
Представим такую ситуацию. На сервере родная кодировка В, на клиенте родная кодировка А.
Если на сервере родная кодировка В, то серверу нужно напрягаться, чтобы послать страницу, написанную на А?
Если на клиенте родная кодировка А, то клиенту нужно напрягаться, чтобы принять страницу написанную на В?
Как это все зависит от разновидностей клиентов и серверов?

Автор: desyatnik 27.3.2003, 01:08
Обычно (всегда smile.gif) на сервере жёстко закрепляется кодировка страниц. Напрягаться должен клиент. Современные браузеры, к счастью, русские кодировки поддерживают неплохо. Если же подразумевается какое-то клиент-серверное ПО в локалке, то лучше всего заранее и навсегда установить общую для всех кодировку. У меня лично душа лежит к Уникоду - пусть он и неэффективный, зато проблем меньше всего (если софт Уникодный, естественно). Да и в осях тенденция аналогичная наблюдается: WinNT в файловой системе Уникод использует, QNX тоже, Linux (и FreeBSD, AFAIK) можно настроить таким макаром.

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)