Е
Евгений_Канусовский@198124 сентября 2018 г. 12:47

Чтение файлов в python

Добрый вечер Евгений и форумчане! Столкнулся с проблемой чтения файлов в python: файлы с обычным текстом в формате las и txt читаются, например:

~Version information
VERS.                            1.20: CWLS LAS  -  VERSION 1.20
WRAP.                              NO: One line per depth step

~Well information

Но если текст такого вида (с абракадаброй):

~Version information block
VERS.                             1.20:Ќ з «м­ п Ј«гЎЁ­  § ¬Ґа
WRAP.                       137.60:Љ®­Ґз­ п Ј«гЎЁ­  § ¬Ґа
TYPE.                                ѓ€‘: ‚Ё¤ ЇҐаҐ¤ ў Ґ¬ле ¤ ­­ле

программа вылетает. Не подскажите как лечится?

Рекомендуем хостинг TIMEWEB
Рекомендуем хостинг TIMEWEB
Стабильный хостинг, на котором располагается социальная сеть EVILEG. Для проектов на Django рекомендуем VDS хостинг.

Вам это нравится? Поделитесь в социальных сетях!

18
Evgenii Legotckoi
  • 25 сентября 2018 г. 3:20

День добрый!

А киньте код вашей программы, который отвечает за чтение. Возможно, что вы как-то криво читаете кодировку. Может там кодировка, которая имеет меньше байт на символ, которую вы используете, поэтому и вылетает за пределы текстового массива указатель при чтении.

    Е
    • 25 сентября 2018 г. 11:57

    Вот код:


    import sys

    from re import match

    from vira import *
    from PyQt5 import QtCore, QtGui, QtWidgets
    from PyQt5.QtWidgets import (QDialog, QFileDialog, QMessageBox, QLineEdit, QProgressBar, QProgressDialog)
    from PyQt5.QtCore import QDir, QDirIterator


    class MyWin(QtWidgets.QMainWindow):
    def __init__(self, parent=None):
    QtWidgets.QWidget.__init__(self, parent)
    self.ui = Ui_MainWindow()
    self.ui.setupUi(self)

    # Вешаем на кнопку функцию Open
    self.ui.pushButton.clicked.connect(self.Open)
    self.ui.pushButton_2.clicked.connect(self.close)

    def Open(self):
    self.ui.textEdit.clear()
    files, _ = QFileDialog.getOpenFileNames(self, "Выбрать файлы", "/home", "*.las *.txt")
    hjh = list(filter(lambda x: x != '*.las *.txt', files))
    myString = '\n'.join(hjh)
    self.ui.textEdit.setText(myString)
    if self.ui.comboBox.currentIndex() == 0:
    strx = self.ui.textEdit.toPlainText()
    strxList = strx.split('\n')

    for jk in range(0, len(strxList), 1):
    print(strxList[jk])
    self.ui.textEdit.append(str(strxList[jk]))
    f = open(strxList[jk], 'r')
    for line in f:
    print(line)
    self.ui.textEdit.append(line)
    f.close()

    if __name__ == "__main__":
    app = QtWidgets.QApplication(sys.argv)
    myapp = MyWin()
    myapp.show()
    sys.exit(app.exec_())

      Извиняюсь, не проверил код у себя ещё. В каком именно месте падает? Вы определили это?

        Е
        • 27 сентября 2018 г. 6:15
      • Вот здесь:
      • for jk in range(0, len(strxList), 1):
      • print(strxList[jk])
      • self.ui.textEdit.append(str(strxList[jk]))
      • f = open(strxList[jk], 'r')
      • for line in f:
      • print(line)
      • self.ui.textEdit.append(line)
      • f.close()
      • strxList - это список файлов считанный с textedit, когда начинаю перебирать каждый элемент списка нормальные файлы читаются и выводятся в консоль и textedit, а когда попадается файл с "абракадаброй" программа вылетает 

          Похоже, что здесь сам вывод print у Python крашится из-за кодировки символов.

          Попрбуйте установить кодировку для потока вывода.

          Что вроде такого может быть

          UTF8Writer = codecs.getwriter('utf8')
          sys.stdout = UTF8Writer(sys.stdout)

            Е
            • 27 сентября 2018 г. 6:25
            codecs подчеркивается
              import codecs
                Е
                • 27 сентября 2018 г. 6:35
                import codecs
                for jk in range(0,len(strxList),1):
                print(strxList[jk])
                self.ui.textEdit.append(str(strxList[jk]))
                UTF8Writer = codecs.getwriter ('utf8')
                sys.stdout = UTF8Writer (sys.stdout)
                f = open(strxList[jk], 'r')
                for line in f:
                print(line)
                self.ui.textEdit.append(line)
                f.close()
                  Е
                  • 27 сентября 2018 г. 6:35

                  Я правильно скомпоновал код?

                    import codecs

                    Я бы добавил в самом начале файла

                    UTF8Writer = codecs.getwriter ('utf8')
                    sys.stdout = UTF8Writer (sys.stdout)

                    А это я думаю, стоит добавить перед ээтой строкой

                    app = QtWidgets.QApplication(sys.argv)
                      Е
                      • 27 сентября 2018 г. 6:46

                      Программа вообще не запускается

                        А что пишет?

                          Evgenii Legotckoi
                          • 27 сентября 2018 г. 6:55

                          Так, а если тогда просто файл открывать с учётом кодировки?

                          f = codecs.open(filename, encoding="utf-8")
                            Е
                            • 27 сентября 2018 г. 6:57

                            Process finished with exit code 3

                              Е
                              • 27 сентября 2018 г. 7:02

                              Опять вылетает

                                Е
                                • 29 сентября 2018 г. 1:47

                                Решение найдено:

                                f = codecs.open (strxList[jk], 'r', encoding='cp866')
                                  Е
                                  • 29 сентября 2018 г. 5:40

                                  Спасибо Евгений Вам за то что направили на путь истинный!

                                    Пожалуйста, успехов.

                                      Комментарии

                                      Только авторизованные пользователи могут публиковать комментарии.
                                      Пожалуйста, авторизуйтесь или зарегистрируйтесь
                                      AD

                                      C++ - Тест 004. Указатели, Массивы и Циклы

                                      • Результат:50баллов,
                                      • Очки рейтинга-4
                                      m
                                      • molni99
                                      • 26 октября 2024 г. 1:37

                                      C++ - Тест 004. Указатели, Массивы и Циклы

                                      • Результат:80баллов,
                                      • Очки рейтинга4
                                      m
                                      • molni99
                                      • 26 октября 2024 г. 1:29

                                      C++ - Тест 004. Указатели, Массивы и Циклы

                                      • Результат:20баллов,
                                      • Очки рейтинга-10
                                      Последние комментарии
                                      i
                                      innorwall13 ноября 2024 г. 23:03
                                      Как написать игру на Qt - Урок 3. Взаимодействие с другими объектами what is priligy tablets What happens during the LASIK surgery process
                                      i
                                      innorwall13 ноября 2024 г. 20:09
                                      Использование переменных объявленных в CMakeLists.txt внутри C++ файлов where can i buy priligy online safely Tom Platz How about things like we read about in the magazines like roid rage and does that really
                                      i
                                      innorwall11 ноября 2024 г. 22:12
                                      Django - Урок 055. Как написать функционал auto populate field Freckles because of several brand names retin a, atralin buy generic priligy
                                      i
                                      innorwall11 ноября 2024 г. 18:23
                                      QML - Урок 035. Использование перечислений в QML без C++ priligy cvs 24 Together with antibiotics such as amphotericin B 10, griseofulvin 11 and streptomycin 12, chloramphenicol 9 is in the World Health Organisation s List of Essential Medici…
                                      i
                                      innorwall11 ноября 2024 г. 15:50
                                      Qt/C++ - Урок 052. Кастомизация Qt Аудио плеера в стиле AIMP It decreases stress, supports hormone balance, and regulates and increases blood flow to the reproductive organs buy priligy online safe Promising data were reported in a PDX model re…
                                      Сейчас обсуждают на форуме
                                      i
                                      innorwall13 ноября 2024 г. 18:52
                                      добавить qlineseries в функции PMID 35774217 Free PMC article priligy cvs
                                      i
                                      innorwall11 ноября 2024 г. 10:55
                                      Всё ещё разбираюсь с кешем. priligy walgreens levitra dulcolax carbs The third ring was found to be made up of ultra relativistic electrons, which are also present in both the outer and inner rings
                                      9
                                      9Anonim25 октября 2024 г. 9:10
                                      Машина тьюринга // Начальное состояние 0 0, ,<,1 // Переход в состояние 1 при пустом символе 0,0,>,0 // Остаемся в состоянии 0, двигаясь вправо при встрече 0 0,1,>…
                                      ИМ
                                      Игорь Максимов3 октября 2024 г. 4:05
                                      Реализация навигации по разделам Спасибо Евгений!

                                      Следите за нами в социальных сетях