Модераторы: Poseidon
  

Поиск:

Ответ в темуСоздание новой темы Создание опроса
> [С] Вывод гистограммы длин слов 
:(
    Опции темы
NO_FATE
Дата 17.11.2006, 17:05 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 4
Регистрация: 17.11.2006

Репутация: нет
Всего: нет



Читаю сейчас книгу Керниган, Ричи. "Язык C" и возникли трудности с задачкой № 1.13. Вот ее текст:
1.13 Напишите программу для вывода гистограммы длин слов во входном потоке. Построить гистограмму с горизонтальными рядами довольно легко, а вот с вертикальными столбцами труднее.
Ядро программы, которое собственно подсчитывает длины слов и складывает их в массив, я написала, там ничего сложного нет, а вот с выводом гистограммы не могу никак разобраться. Как ее вывести на экран (все работает исключительно в режиме командной строки, разумеется)?

Код

#include "stdafx.h"

#define IN 1 /* эти символические константы введены в качестве индикатора, находимся ли мы в слове или за его пределами */
#define OUT 0

int main()
{
    int c, i, state, nc;
    int ndigit[20]; /* массив объявляю на 20 элементов, поскольку более длинные слова в тестовом потоке не встречаются, а сделать массив "резиновым" я пока не знаю как :)  */
    state = OUT;
    nc = 0;
    for (i = 0; i < 20; ++i)
        ndigit[i] = 0;
    while ((c = getchar()) != EOF)
        if (c == ' ' || c == '\n' || c == '\t') {
            ++ndigit[nc];
            nc = 0;
            state = OUT;
        }
        else {
            state = IN;
            ++nc;
        }
    for (i = 0; i < 20; ++i)
        printf(" %d\n", ndigit[i]);
    return 0;
}




Это сообщение отредактировал(а) NO_FATE - 17.11.2006, 17:06
PM MAIL   Вверх
maxim1000
Дата 17.11.2006, 17:25 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Эксперт
****


Профиль
Группа: Участник
Сообщений: 3334
Регистрация: 11.1.2003
Где: Киев

Репутация: 24
Всего: 110



касательно самого подсчёта:
переменной state присваиваются значения, но она нигде не читается
если у нас есть гарантия того, что между словами всегда только один разделитель, то, в общем-то, можно обойтись и без неё
но для того, чтобы правильно анализировать строки, где идут, например, два пробела подряд, стоит перед тем, как обрабатывать конец слова, проверить, равно ли state IN

касательно построения диаграммы:
её можно строить построчно, каждый символ в строке соответствует некоторой длине слова
для того, чтобы узнать, рисовать ли на месте символа (x,y) звёздочку или пробел, достаточно посмотреть, находится ли он под верхней границей гистограммы, т.е. длина (x) > y


--------------------
qqq
PM WWW   Вверх
NO_FATE
Дата 17.11.2006, 17:53 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 4
Регистрация: 17.11.2006

Репутация: нет
Всего: нет



Чесно говоря, я все равно не совсем поняла как пишеться гистограмма, если не сложно, можете написать пример или закончить эту программку. 
PM MAIL   Вверх
maxim1000
Дата 17.11.2006, 18:06 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Эксперт
****


Профиль
Группа: Участник
Сообщений: 3334
Регистрация: 11.1.2003
Где: Киев

Репутация: 24
Всего: 110



ну что-нибудь типа такого:
Код

int c;
int y;
//считаем максимум, чтобы знать, высоту гистограммы
int max=0;
for(c=0;c<20;++c)
    if(max<ndigit[c])
        max=ndigit[c];
//выводим гистограмму построчно
for(y=0;y<max;++y)
{
    for(c=0;c<20;++c)
        if(ndigit[c]>=y)
            printf("*");
        else
            printf(" ");
    printf("\n");
}


Добавлено @ 18:08 
правда, в этом случае она получится перевёрнутая
чтобы возрастание шло вверх, можно поменять y на max-1-y

Это сообщение отредактировал(а) maxim1000 - 17.11.2006, 18:06


--------------------
qqq
PM WWW   Вверх
NO_FATE
Дата 17.11.2006, 18:31 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 4
Регистрация: 17.11.2006

Репутация: нет
Всего: нет



Спасибо! доберусь домой посмотрю как и что!
Когда есть код в нем намного легче разбираться чем так  smile 
PM MAIL   Вверх
breaking
Дата 10.6.2008, 23:20 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 39
Регистрация: 24.2.2007

Репутация: 1
Всего: 1



Цитата

... но для того, чтобы правильно анализировать строки, где идут, например, два пробела подряд, стоит перед тем, как обрабатывать конец слова, проверить, равно ли state IN

И куда же интересно "влепить" это условие в этом куске кода:
Код

  while ((c = getchar()) != EOF)
        if (c == ' ' || c == '\n' || c == '\t') {
            ++ndigit[nc];
            nc = 0;
            state = OUT;
        }
        else {
            state = IN;
            ++nc;
        }

????
К примеру этот условный переход:
Код

if ((c == ' ' || c =='\n' || c == '\t') && (state == IN))

к нужному результату не приводит.
PM MAIL   Вверх
breaking
  Дата 17.6.2008, 19:03 (ссылка) | (нет голосов) Загрузка ... Загрузка ... Быстрая цитата Цитата


Новичок



Профиль
Группа: Участник
Сообщений: 39
Регистрация: 24.2.2007

Репутация: 1
Всего: 1



Сразу замечу, что решил не создавать новую тему, т.к. моя задача весьма схожа с описанной выше. Итак, условие:
Для заданного текстового файла построить гистограмму распределения длин слов, которые он содержит.
С учетом вышеизложенных рекомендаций я сделал задачу следующим образом:
Код

#include <stdio.h>
#include <stdlib.h>
#include "gets.c"

#define SIZE 128
#define N 20
#define IN 1
#define OUT 0

void BuildHistogramm(char *filename);
void Error(const char *message);

main()
{
    char *filename;
    
    printf("Please enter an input file name: ");
    filename = GetStringAt(SIZE);
    BuildHistogramm(filename);
    free(filename);
    return 0;
}

void Error(const char *message)
{
    printf("\n\nError: %s\n\n", message);
    exit(1);
}

void BuildHistogramm(char *filename)
{
    int ndigit[20], state, nc, i;
    char c;
    const char Separator[] = {' ', '.', ',', ':', ';', '-', '!', '?', 'я'};
    int max1, max2 = 0;
    FILE *f;

    state = OUT;
    nc = 0;

    for(i = 0; i < 20; ++i)
        ndigit[i] = 0;
    f = fopen(filename, "r");
    if (!f)
        Error("Opening file");
    while ((c = fgetc(f)) != EOF || state == IN) {
        for(i = 0; i < 9; i++) {
            if (c == Separator[i] && state == IN) {
                ++ndigit[nc];
                nc = 0;
                state = OUT;
            }
        }
        if (c != ' ' && c != '.' && c != ',' && c != ':' && c != ';' && c != '-' && c != '!' && c != '?' && c != 'я') {
            state = IN;
            ++nc;
            if (nc > max2)
                max2 = nc;
        }
    }
    fclose(f);
    for (i = 0; i < N; ++i)
        if (max1 < ndigit[i])
            max1 = ndigit[i];
    for(i = 0; i < max1; ++i) {
        for(nc = 1; nc < max2 + 1; ++nc)
            if (ndigit[nc] > (max1 - 1 - i))  {
                if(nc > 9)
                    printf(" *");
                else
                    printf("*");
            }
            else {
                if(nc > 9)
                    printf("  ");
                else
                    printf(" ");
            }
        printf("\n");
    }
    for(i = 1; i < max2 + 1; ++i)
        printf("%d", i);
    printf("\n");
}

Листинг gets.c:
Код

#include <stdio.h>
#include <string.h>
#include <conio.h>
#include "gets.h"

char *GetStringAt(int size)
{
    char buffer[MAXLEN];
    int i = 0;
    char c;

    if ((size > MAXLEN) || (size <=0))
        size = MAXLEN;
    while (--size > 0) {
        c = getchar();
        if (c == '\n')
            size = 0;
        else
            buffer[i++] = c;
    }
    buffer[i] = '\0';
    return strdup(buffer);
}

И листинг gets.h:
Код

#define MAXLEN 128

char *GetStringAt(int size);

Правда в коде есть парочка нюансов один из которых заключается в том, что насколько я понял, последний байт файла - EOF имее значение символа - 'я',(компилятор MS VC++ 6.0) поэтому на текст, в файле которого содержатся слова с этой буквой, будет построена неправильная гистограмма. Точнее говоря, она вообще не будет построена smile. Вопрос -  можно ли как-нибудь избежать сей досадный момент?
Второй нюанс заключается в том, что мне хотелось бы немного улучшить вывод гистограммы. Сейчас объясню, что я имею ввиду. Допустим у нас есть файл input.txt, содержащий следующий текст:
An interactively controllable walking character using parametric motion graphs.
После выполнения программы гистограмма будет построена следующим образом:
          *
  *    ***  *  *      *  *                             
12345678910111213
Очевидно, что это не очень красиво и гораздо нагляднее смотрелось бы вот так:
               *
   *       * * *    *   *        *   *            
1 2 3 4 5 6 7 8 9 10 11 12 13
Тобишь, при построении вставить между числами пробелы. Однако как это реализовать я не знаю...
Я пытался каким-либо образом изменить следующий участок кода:
Код

    for(i = 0; i < max1; ++i) {
        for(nc = 1; nc < max2 + 1; ++nc)
            if (ndigit[nc] > (max1 - 1 - i))  {
                if(nc > 9)
                    printf(" *");
                else
                    printf("*");
            }
            else {
                if(nc > 9)
                    printf("  ");
                else
                    printf(" ");
            }
        printf("\n");
    }
    for(i = 1; i < max2 + 1; ++i)
        printf("%d", i);

Однако, к нужному результату это не привело.
И ещё один момент,  вообще на ваш взгляд, реально ли здесь сделать массив ndigit динамическим?
В качестве завершения поста, хотелось бы заметить - может быть есть какие-либо альтернативные варианты решения этой задачи? Что если попробовать реализовать вместо звездочек реальные графические столбиковые диаграммы, пускай даже одноцветные, но естественно разной высоты?Или, ладно, пускай будут звездочки, но с более эффективным алгоритмом.


PM MAIL   Вверх
  
Ответ в темуСоздание новой темы Создание опроса
Правила форума "Центр помощи"

ВНИМАНИЕ! Прежде чем создавать темы, или писать сообщения в данный раздел, ознакомьтесь, пожалуйста, с Правилами форума и конкретно этого раздела.
Несоблюдение правил может повлечь за собой самые строгие меры от закрытия/удаления темы до бана пользователя!


  • Название темы должно отражать её суть! (Не следует добавлять туда слова "помогите", "срочно" и т.п.)
  • При создании темы, первым делом в квадратных скобках укажите область, из которой исходит вопрос (язык, дисциплина, диплом). Пример: [C++].
  • В названии темы не нужно указывать происхождение задачи (например "школьная задача", "задача из учебника" и т.п.), не нужно указывать ее сложность ("простая задача", "легкий вопрос" и т.п.). Все это можно писать в тексте самой задачи.
  • Если Вы ошиблись при вводе названия темы, отправьте письмо любому из модераторов раздела (через личные сообщения или report).
  • Для подсветки кода пользуйтесь тегами [code][/code] (выделяйте код и нажимаете на кнопку "Код"). Не забывайте выбирать при этом соответствующий язык.
  • Помните: один топик - один вопрос!
  • В данном разделе запрещено поднимать темы, т.е. при отсутствии ответов на Ваш вопрос добавлять новые ответы к теме, тем самым поднимая тему на верх списка.
  • Если вы хотите, чтобы вашу проблему решили при помощи определенного алгоритма, то не забудьте описать его!
  • Если вопрос решён, то воспользуйтесь ссылкой "Пометить как решённый", которая находится под кнопками создания темы или специальным флажком при ответе.

Более подробно с правилами данного раздела Вы можете ознакомится в этой теме.

Если Вам помогли и атмосфера форума Вам понравилась, то заходите к нам чаще! С уважением, Poseidon, Rodman

 
0 Пользователей читают эту тему (0 Гостей и 0 Скрытых Пользователей)
0 Пользователей:
« Предыдущая тема | Центр помощи | Следующая тема »


 




[ Время генерации скрипта: 0.0479 ]   [ Использовано запросов: 22 ]   [ GZIP включён ]


Реклама на сайте     Информационное спонсорство

 
По вопросам размещения рекламы пишите на vladimir(sobaka)vingrad.ru
Отказ от ответственности     Powered by Invision Power Board(R) 1.3 © 2003  IPS, Inc.