| Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате |
| Форум программистов > Общие вопросы по .NET и C# > RegExp tokenizer |
| Автор: azesmcar 23.5.2010, 16:16 |
| Добрый день, Регулярные выражения всегда были моим слабым местом, никак руки не доходят изучить как следует. Нужна помощь в создании регулярного выражения, для разделения текста на токены. Разделителем служат все символы, кроме a-z, A-Z. Т.е. все, кроме alphabetical символов, ума не приложу как это сделать Например: LpZaq2Wd32Da [0] = LpZaq [1] = Wd [2] = Da можно конечно же ручками, но зачем? Мне кажется регулярками это сделать гораздо проще. Заранее большое спасибо. |
| Автор: diadiavova 23.5.2010, 21:31 | ||||||||
Если нужна регулярка для токена, то так
При включении опции IgnoreCase ещё проще
и
Или я чего-то не паонял? |
| Автор: azesmcar 24.5.2010, 06:31 | ||
выводит пустые строки, или я что-то не так написал? Насколько я могу судить о регулярках это не совсем то, что нужно, но я не уверен.. в общем нужно разделить текст на слова, разделитель любое количество любых символов кроме a-z, A-Z. Т.е. словами явлется набор символов a-z, A-Z, остальное - разделитель. |
| Автор: mrbrooks 24.5.2010, 10:40 | ||
я бы так зафигачил и не парился:
Добавлено через 1 минуту и 6 секунд хотя, как я понимаю, diadiavova к этому и вел |
| Автор: azesmcar 24.5.2010, 13:07 |
| diadiavova Теперь понятно, я почему-то думал в сторону split а не matches. Спасибо. так и сделал благодарю. |