Версия для печати темы
Нажмите сюда для просмотра этой темы в оригинальном формате
Форум программистов > Java: Общие вопросы > Код неправильно читает файл


Автор: 3,14 20.4.2005, 16:58
Никак не пойму почему код неправильно читает файл:

Код

package techlib;

import java.io.*;
import java.net.*;
import javax.mail.*;
import javax.mail.internet.*;
import java.util.*;
import javax.activation.*;
import javax.servlet.*;
import javax.servlet.http.*;

public class install extends HttpServlet
{
    public void service( HttpServletRequest request, HttpServletResponse response ) throws ServletException, IOException 
    {
        response.setContentType("text/html");
        PrintWriter out = response.getWriter();
        out.println("<html><body>");

        String file_name = "/users/techlib/techlib_books.sql";
        FileReader sql_dump = new FileReader(file_name);
        char [] cbuff = new char [1024];
        int received = 0;
        String sqlQueries = "";
        while ((received = sql_dump.read(cbuff)) > 0)
        {
            sqlQueries += new String(cbuff);
        }

        out.println(sqlQueries.replaceAll("[\\n\\r]+", "<br>"));
        out.println("</body></html>");
    }
}

Добавлено @ 17:02
Торможу smile, всё понял

Автор: batigoal 20.4.2005, 17:04
А в чем именно неправильность?

Вот эта строка
Код

while ((received = sql_dump.read(cbuff)) > 0)

Здесь получается так, что значение boolean (которое, кстати, всегда true) сравнивается с числом. Имхо, не очень хорошо.

Автор: AntonSaburov 20.4.2005, 18:12
Цитата(Lamer @ 20.4.2005, 17:04)
Здесь получается так, что значение boolean (которое, кстати, всегда true) сравнивается с числом.

Что-то ты путаешь. Где тут boolean ?
Код

while ((received = sql_dump.read(cbuff)) > 0)


(received = sql_dump.read(cbuff) - вернет число считаных байт. И его потом сравнивают с нулем. Тут все чистенько.

Скорее проблема в том, что строка формируется из полного массива, а это странно. Конец-то не всегда полностью покрывает весь массив.

Автор: batigoal 20.4.2005, 22:29
Пардон, стормозил под под конец рабочего дня.

Автор: igon 20.4.2005, 23:35
Цитата
Скорее проблема в том, что строка формируется из полного массива, а это странно. Конец-то не всегда полностью покрывает весь массив.

Да, нужно что-то типа
Цитата
sqlQueries += new String(cbuff, 0, received);

Кроме того, достаточно ли анализировать только на
Цитата
received > 0 ?

Возможна, хотя и маловероятна ситуация, когда
sql_dump.read(cbuff) вернет 0, но конец файла еще достигнут не будет.
ИМХО, читать нужно до тех пор, пока не получим -1.
Странным кажется и размер буфера - 1024. Файл не может быть длиннее? sql_dump.read(cbuff) может ведь за раз считать и гораздо бОльшие фрагменты.
Похоже, безопаснее использовать

Цитата
public int read(char[] cbuf,
                int offset, // 0
                int length) // 1024
        throws IOException
Read characters into a portion of an array.



Автор: 3,14 21.4.2005, 08:18
Цитата(igon @ 20.4.2005, 23:35)
Да, нужно что-то типа
Цитата
sqlQueries += new String(cbuff, 0, received);

Именно в этом и была проблема

Автор: AntonSaburov 21.4.2005, 15:58
Цитата(igon @ 20.4.2005, 23:35)
Странным кажется и размер буфера - 1024.

Мы когда-то замеряли - получилось, что читать больше чем 4 Кб смысла особого уже нет. Но 1 Кб наверно маловато будет. Если конечно файлы не маленькие. А если маленькие, то тут вообщем-то по барабану.

Автор: igon 22.4.2005, 00:16
Цитата
читать больше чем 4 Кб

А разве можно управлять размером блока, считываемого из Stream в каждой итерации? Сколько Stream успеет подготовить, столько и выдаст - конкретное значение суть величина непредсказуемая. Единственное, что можем - "держать карман шире" smile При маленьком буфере для варианта
Код

read(cbuff) 
рискуем получать "Переполнение массива".
При маленьком length для варианта
Код

read(cbuf, offset, length) 
придется сделать больше итераций. Оптимальные значения - 4K smile

Автор: AntonSaburov 22.4.2005, 14:17
Цитата(igon @ 22.4.2005, 00:16)
рискуем получать "Переполнение массива".

Ну переполнение - это как-то странно.
А 4К - больше просто диск обычно не позволяет. Может сейчас можно и больше. В принципе IO операции ограничены работой с диском и тут большой массив просто будет дольше считываться и если обработка не очень сложная, то пока подготовиться следующие 4К можно успеть что-то сделать с предыдущими. А больше - ну а что лишний раз память есть.

Автор: igon 24.4.2005, 02:09
Риск "переполнения" действительно мнимый, sorry smile (RTFM - и еще одной иллюзией меньше smile)

Powered by Invision Power Board (http://www.invisionboard.com)
© Invision Power Services (http://www.invisionpower.com)