Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > C/C++: Общие вопросы > Чем отличается std::wstring от std::string?


Автор: Alca 28.10.2008, 10:13
Чем отличается std::wstring от std::string?

Автор: Alek86 28.10.2008, 10:16
первое - строки 2х-байтных символов
второе - однобайтных

Автор: Alca 28.10.2008, 10:24
Цитата

2-x байтовые

Это типа юникод или как?

Автор: Alek86 28.10.2008, 10:29
1 из его видов

Добавлено через 51 секунду
кстати, в wchar_t не обязательно именно 2 байта. но если ты пишешь только под винду, то можно считать, что 2

Автор: Alca 28.10.2008, 10:44
Спасиб.

Автор: J0ker 28.10.2008, 18:35
Цитата(Alek86 @  28.10.2008,  10:16 Найти цитируемый пост)
первое - строки 2х-байтных символов

не 2х-байтных, а wchar_t
wchar_t стандартом не специфицирован - на gcc например он 4-х байтный

Автор: Alek86 28.10.2008, 22:53
Цитата(J0ker @  28.10.2008,  18:35 Найти цитируемый пост)
не 2х-байтных, а wchar_t

Цитата(Alek86 @  28.10.2008,  10:29 Найти цитируемый пост)
кстати, в wchar_t не обязательно именно 2 байта. но если ты пишешь только под винду, то можно считать, что 2


Автор: Alca 1.11.2008, 14:39
В каких случаях может пригодиться std::wstring?
В каких случаях используется? 

Автор: HappyLife 1.11.2008, 17:18
Alca, Вместо std::string, если ты пишеш программу с юникодным шрифтом.

Автор: Alca 2.11.2008, 00:20
Спасибо.

Автор: Alca 28.11.2008, 18:28
Зачем использовать std::string (какой сенс), если есть std::wstring?

Автор: JackYF 28.11.2008, 18:43
Цитата(Alca @  28.11.2008,  17:28 Найти цитируемый пост)
если есть std::wstring? 

Скорость, размер.

Автор: Alca 28.11.2008, 18:50
Коротко и ясно, спасибо.

Автор: 586 28.11.2008, 20:08
Цитата(Alca @  28.10.2008,  10:13 Найти цитируемый пост)
Чем отличается std::wstring от std::string? 

вот чем:
Код
typedef basic_string<char, char_traits<char>, allocator<char> > string;
typedef basic_string<wchar_t, char_traits<wchar_t>, allocator<wchar_t> > wstring;

Автор: J0ker 28.11.2008, 20:54
Цитата(JackYF @ 28.11.2008,  18:43)
Цитата(Alca @  28.11.2008,  17:28 Найти цитируемый пост)
если есть std::wstring? 

Скорость, размер.

это-то тут при чем?

Автор: JackYF 28.11.2008, 21:41
Цитата(J0ker @  28.11.2008,  19:54 Найти цитируемый пост)
это-то тут при чем? 

Как это при чём? Ты действительно считаешь, что скорость обработки и размер ОЗУ для хранения двух-и-более-байтовых символов аналогичны этим же показателям для однобайтовых?

Автор: J0ker 28.11.2008, 22:48
Цитата(JackYF @ 28.11.2008,  21:41)
Цитата(J0ker @  28.11.2008,  19:54 Найти цитируемый пост)
это-то тут при чем? 

Как это при чём? Ты действительно считаешь, что скорость обработки и размер ОЗУ для хранения двух-и-более-байтовых символов аналогичны этим же показателям для однобайтовых?

я действительно считаю что это лишь оооооочень слабое следствие, причем весьма спорное и отношения к делу не имеющее
юникод нужен для унификации кодировок различных языков, а ANSI набор нужен как минимум для обратной совместимости и для приложений не нуждающихся в поддержки различных языков

Автор: Kallikanzarid 29.11.2008, 10:49
Цитата

Как это при чём? Ты действительно считаешь, что скорость обработки и размер ОЗУ для хранения двух-и-более-байтовых символов аналогичны этим же показателям для однобайтовых?

Methinks это имеет значение, только если твоя программа занимается в основном обработкой строк.

Автор: Alca 29.11.2008, 13:13
Цитата

это-то тут при чем?

При том что размер wchar_t в двое больше размера char.

Автор: J0ker 29.11.2008, 19:02
Цитата(Alca @ 29.11.2008,  13:13)
Цитата

это-то тут при чем?

При том что размер wchar_t в двое больше размера char.

ну иногда и вчеверо
и что из этого?
я не думаю что десятые доли процента производительности в среднестатистическом приложении играют какую-то роль - это во-первых
во-вторых, складывается впечатление, что сначала были wchar_t, а потом, чтобы ускорить, придумали char
было как раз наоборот, и причины были несколько другие
а нам в ответ на то, зачем нужны char и wchar_t канифолят мозги про какие-то размер и производительность
бредить изволите, господа  smile 

Автор: MAKCim 29.11.2008, 19:12
J0ker, 
 smile 

Автор: MAKCim 29.11.2008, 19:37
вообще ради интереса можно запустить следующую программу
Код

#include <sys/time.h>
#include <wchar.h>
#include <stdio.h>
#include <string.h>

static volatile wchar_t ws1[] = L"0123456789abcdefghijklmnopqrstuvwxyz";
static volatile wchar_t ws2[] = L"0123456789abcdefghijklmnopqrstuvwxyz";

static volatile char s1[] = "0123456789abcdefghijklmnopqrstuvwxyz";
static volatile char s2[] = "0123456789abcdefghijklmnopqrstuvwxyz";

#define tv2ms(tv) ((tv)->tv_sec * 1000 + (tv)->tv_usec / 1000)

int main()
{
    struct timeval start, stop;
    int i, r;
    gettimeofday(&start, NULL);
    for (i = 0, r = 0; i < 0x10000000; ++i) {
        r += wcscmp((const wchar_t*)s1, (const wchar_t*)s2);
    }
    gettimeofday(&stop, NULL);
    printf("wchar_t: miliseconds [%lu]\n", (unsigned long)tv2ms(&stop) - tv2ms(&start));
    gettimeofday(&start, NULL);
    for (i = 0, r = 0; i < 0x10000000; ++i) {
        r += strcmp((const char*)s1, (const char*)s2);
    }
    gettimeofday(&stop, NULL);
    printf("char: miliseconds [%lu]\n", (unsigned long)tv2ms(&stop) - tv2ms(&start));
    return 0;
}

результаты несколько неожиданные

Автор: J0ker 29.11.2008, 22:38
Цитата(MAKCim @  29.11.2008,  19:37 Найти цитируемый пост)
результаты несколько неожиданные 

неожиданные для тех, кто думает, что сравнение строк == сравнение байтов
на самом деле существует такое понятие как collation
 smile 

Автор: MAKCim 30.11.2008, 11:07
J0ker, 
это понятно
неожиданно то, что разница почти в _два_ раза

Автор: J0ker 30.11.2008, 19:08
Цитата(MAKCim @ 30.11.2008,  11:07)
J0ker, 
это понятно
неожиданно то, что разница почти в _два_ раза

у меня все нормально
Код

wchar_t: [4296]
char: [4266]

Код

wchar_t: [4234]
char: [4266]

количество увеличено в 16 раз, вместо gettimeofday - clock

Автор: MAKCim 1.12.2008, 09:42
J0ker, 
clock() менее точен
по крайней мере в Linux он использует значение utime для процесса, а оно имеет латентность 1/HZ

через clock() аналогичная ситуация
на чем тестил? (ОС, компилятор)

Автор: Mayk 1.12.2008, 09:46
Цитата(MAKCim @  30.11.2008,  15:07 Найти цитируемый пост)
J0ker, 
это понятно
неожиданно то, что разница почти в _два_ раза 

у меня вообще было так - первый запуск разница в два раза, второй запуск - одинаково. это было вчера на локальной машине, я тогда поленился рез-ты копировать.

Автор: J0ker 2.12.2008, 08:13
Цитата(MAKCim @ 1.12.2008,  09:42)
J0ker, 
clock() менее точен
по крайней мере в Linux он использует значение utime для процесса, а оно имеет латентность 1/HZ

через clock() аналогичная ситуация
на чем тестил? (ОС, компилятор)

какая разница наскока clock менее точен, если счет идет на тысячи
тестал на msvc9, winxp

Добавлено через 6 минут и 29 секунд
разница может быть из-за того, что на VC wchar_t не юникод-комплаянт - 2 байта вместо четырех - при правильном юникоде коллэйшен может быть сложнее

Автор: MAKCim 2.12.2008, 09:50
Цитата(J0ker @  2.12.2008,  08:13 Найти цитируемый пост)

какая разница наскока clock менее точен, если счет идет на тысячи

вооще говоря это просто утверждение насчет clock() и Linux
с чего ты взял, что это имеет отношение к теме?  smile 
там даже разделение идет специально пустой строкой

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)