E
Edi23 января 2020 г. 17:11

QWebPage получить html

QWebPage, QtWebEngineWidgets, QWebEnginePage::toHtml(), QWebEnginePage, QWebEngin, webenginewidgets, QWebPage получить html

Здравствуйте, пытаюсь получить html код страницы, но не появляется ни чего в указанной дирректории, что у меня не правильно? Надо получить вэб страницу не из виджета, а с помощью кода, ее отображение в саймой программе не требуется. Помогите плиз.
QWebEngineProfile m_profile = new QWebEngineProfile;
m_profile->setDownloadPath("my path");
QWebEnginePage
page = new QWebEnginePage(m_profile);
QUrl url("https://domenName");
page->load(url);
page->save("my path", QWebEngineDownloadItem::CompleteHtmlSaveFormat);

Рекомендуем хостинг TIMEWEB
Рекомендуем хостинг TIMEWEB
Стабильный хостинг, на котором располагается социальная сеть EVILEG. Для проектов на Django рекомендуем VDS хостинг.

Вам это нравится? Поделитесь в социальных сетях!

8
E
  • 23 января 2020 г. 19:24
  • (ред.)
  • Ответ был помечен как решение.

Уже дошло) Оставлю здесь код для следующего поколения новичков) Вместо toHtml() можно вставить toPlainText и получить текст web страницы

QWebEngineProfile *m_profile = new QWebEngineProfile;
m_profile->setDownloadPath("my dir");
QWebEnginePage *page = new QWebEnginePage(m_profile);

page->settings()->setAttribute(QWebEngineSettings::AutoLoadImages, false);
page->settings()->setAttribute(QWebEngineSettings::JavascriptEnabled, true);

QEventLoop *event = new QEventLoop;
connect(page, &QWebEnginePage::loadFinished, event, &QEventLoop::quit);

page->load(QUrl("my url"));

event->exec();

page->toPlainText([this](const QString &result){
   qDebug()<<"html:";
   qDebug()<<result.size();
   ui->textBrowser->append(result);
   });
    Evgenii Legotckoi
    • 23 января 2020 г. 19:35

    Добрый день. Ещё можно использовать просто QNetworkAccessManager, а то использование QWebEngine для получения html текста страницы с сайта может быть просто стрельбой из пушки по воробьям.

    В этой статье есть пример получения JSON файла , но для обычной страницы разницы особой нет.

      E
      • 23 января 2020 г. 20:08

      Нужно получить страницу, на кт после выполнения java скрипта открывается дополнительный контент. С помощью QNetworkRequest можно получить только страницу, а доп. контент нельзя. Сейчас пытаюсь это сделать с помощью QWebEnginePage::runJavaScript(). Правильная же концепция? Вот код:

      QEventLoop *event = new QEventLoop;
      connect(page, &QWebEnginePage::loadFinished, event, &QEventLoop::quit);
      
      page->load(QUrl("my url"));
      
      event->exec();
      
      page->runJavaScript("document.getElementsByTagName(\"script\")[i]");
      
        Evgenii Legotckoi
        • 23 января 2020 г. 20:33
        • (ред.)

        Тогда согласен.

        Да, концепция правильная. Нужно только поизвращаться с сигналами и слотами. Там всё это асинхронно работает и поэтому достаточно по дурацки.

        У меня была подобная задача. Добавлял WebView в диалог и уже в диалоге всё обрабатывал.

        Принцип следующий.

        В конструкторе диалога добавляем следующее

        m_webView = new QWebEngineView(this);
        ui->centralWidgetLayout->addWidget(m_webView);
        connect(m_webView, &QWebEngineView::loadFinished, this, &Dialog::onLoadFinished);
        connect(this, &Dialog::getHtml, this, &Dialog::handleHTML);
        

        Далее пишем слот onLoadFinished, который выплёвывает сигнал getHtml

        void Dialog::onLoadFinished()
        {
            m_webView->page()->toHtml([this](const QString& result) mutable { emit getHtml(result); });
        }
        

        И потом уже в handleHTML делаем обработку.

        void WizardMapWebDialog::handleHTML(QString html)
        {
            // ToDo something with html
        }
        

        Заголовочник будет следующий

        class Dialog : public QDialog
        {
            Q_OBJECT
        public:
            explicit Dialog(QWidget* parent = nullptr);
        
            virtual ~Dialog() override;
        
        signals:
            void getHtml(QString html);
        
        private slots:
            void onLoadFinished();
            void handleHTML(QString html);
        
        private:
            Ui::Dialog* ui;
            QWebEngineView* m_webView;
        };
        

        JavaScript можно вызвать с применением callback функции, чтобы ещё и результат сразу полчить из функции

            m_webView->page()->runJavaScript("checkMap()", [this](const QVariant& v)
            {
                if (v.toString() == "true")
                {
                    m_webView->page()->runJavaScript("takeValues();");
                }
                else
                {
                    gui::DMessageBox::showError(this, tr("The mark point is outside the map.<br>Please select a location on the map"));
                }
            });
        

        В примере с запуском JavaScript вызывались функции, которые уже есть на странице сайта, так что если там подключена jQuery, то думаю, что сможете её функционал использовать.

        Другого способа, как получать перезагруженный контент через JavaScript на странице, я не знаю. Любые другие способы у меня не работали. Только таким образом сработало.

          E
          • 24 января 2020 г. 0:02
          • (ред.)

          Спасибо) А можно получить скрипты сайта таким образом?

              QWebEngineProfile *m_profile = new QWebEngineProfile;
              QWebEnginePage *page = new QWebEnginePage(m_profile);
              QList<QWebEngineScript> lsc;
              qDebug() << page->scripts().toList().isEmpty();
              lsc = page->scripts().toList();
              qDebug() << lsc;
          

          Что делать с проблемой, когда скрипты сайта подгружаются по http и Qt ругается так:

          js: Mixed Content: The page at was loaded over HTTPS, but requested an insecure script . This request has been blocked; the content must be served over HTTPS.
          js: Mixed Content: The page at was loaded over a secure connection, but contains a form that targets an insecure endpoint . This endpoint should be made available over a secure connection.

          Я пытался получить html по http и в профайле прописал: -no-openssl, но не помогло.

            Evgenii Legotckoi
            • 24 января 2020 г. 13:37

            Не уверен. я бы попробовал выдернуть ссылки и забрать всё через QNetworkAccessManager, если вам не нужно запускать эти скрипты.
            Я с той ошибкой не сталкивался.

              E
              • 26 января 2020 г. 2:00

              Нашел фикс той ошибки:
              ui->vebEngineView->settings()->setAttribute(QWebEngineSettings::AllowRunningInsecureContent, true);

                E
                • 26 января 2020 г. 22:42

                Другого способа, как получать перезагруженный контент через JavaScript на странице, я не знаю.

                Получилось сделать без QWebEngineView, с помощью QWebEnginePage, runJavaScript работает ассинхронно и надо дождаться пока скрипт выполнится, я установил таймер. В итоге в textBrowser выводился html, измененный скриптом.

                QWebEnginePage *page1 = new QWebEnginePage;
                
                    page1->settings()->setAttribute(QWebEngineSettings::AutoLoadImages, false);
                    page1->settings()->setAttribute(QWebEngineSettings::JavascriptEnabled, true);
                    page1->settings()->setAttribute(QWebEngineSettings::AllowRunningInsecureContent, true);
                
                    QEventLoop *event = new QEventLoop;
                    connect(page1, &QWebEnginePage::loadFinished, event, &QEventLoop::quit);
                
                    page1->load(QUrl("https://..."));
                
                    event->exec();
                
                
                    page1->toHtml([this](const QString &result){
                       ui->textBrowser_2->append(result);
                       });
                
                    page1->runJavaScript("javascript:__doPostBack('...')");
                
                    qDebug() << "run!";
                
                    QEventLoop *event1 = new QEventLoop;
                    QTimer *timer = new QTimer();  
                    connect(timer, &QTimer::timeout, event1, &QEventLoop::quit);
                    timer->start(10000);
                    event1->exec();
                
                
                    page1->toHtml([this](const QString &result){
                       ui->textBrowser->append(result);
                       });
                

                  Комментарии

                  Только авторизованные пользователи могут публиковать комментарии.
                  Пожалуйста, авторизуйтесь или зарегистрируйтесь
                  Ua

                  Qt - Тест 001. Сигналы и слоты

                  • Результат:84баллов,
                  • Очки рейтинга4
                  Ua

                  Qt - Тест 001. Сигналы и слоты

                  • Результат:42баллов,
                  • Очки рейтинга-8
                  ОК

                  Qt - Тест 001. Сигналы и слоты

                  • Результат:47баллов,
                  • Очки рейтинга-6
                  Последние комментарии
                  ИМ
                  Игорь Максимов22 ноября 2024 г. 21:51
                  Django - Урок 017. Кастомизированная страница авторизации на Django Добрый вечер Евгений! Я сделал себе авторизацию аналогичную вашей, все работает, кроме возврата к предидущей странице. Редеректит всегда на главную, хотя в логах сервера вижу запросы на правильн…
                  Evgenii Legotckoi
                  Evgenii Legotckoi31 октября 2024 г. 23:37
                  Django - Урок 064. Как написать расширение для Python Markdown Добрый день. Да, можно. Либо через такие же плагины, либо с постобработкой через python библиотеку Beautiful Soup
                  A
                  ALO1ZE19 октября 2024 г. 17:19
                  Читалка fb3-файлов на Qt Creator Подскажите как это запустить? Я не шарю в программировании и кодинге. Скачал и установаил Qt, но куча ошибок выдается и не запустить. А очень надо fb3 переконвертировать в html
                  ИМ
                  Игорь Максимов5 октября 2024 г. 16:51
                  Django - Урок 064. Как написать расширение для Python Markdown Приветствую Евгений! У меня вопрос. Можно ли вставлять свои классы в разметку редактора markdown? Допустим имея стандартную разметку: <ul> <li></li> <li></l…
                  d
                  dblas55 июля 2024 г. 20:02
                  QML - Урок 016. База данных SQLite и работа с ней в QML Qt Здравствуйте, возникает такая проблема (я новичок): ApplicationWindow неизвестный элемент. (М300) для TextField и Button аналогично. Могу предположить, что из-за более новой верси…
                  Сейчас обсуждают на форуме
                  f
                  firstlunoxod15 февраля 2025 г. 13:46
                  Рисование на QGraphicsScene при зажатой кнопке мыши Подскажите, пожалуйста! Как данный класс можно дополнить, чтобы созданные объекты можно было перемещать мышкой по сцене?
                  Дмитрий
                  Дмитрий3 февраля 2025 г. 16:24
                  Создание deb-пакета. Как создать ярлык на рабочем столе после установки собственного deb-пакета? Всем привет. Сделал свой deb-пакет с программой. Всё устанавливается и работает. Ставлю по пути /usr/bin/my_application. Как для пользователя при установке пакета сразу создать ярлык на раб…
                  NW
                  Nayo Wai30 января 2025 г. 19:22
                  не запускается компьютер!!! Не запускается компьютер (точнее работает блок , но сам монитор вообще жесть)В общем я ничего с интернета не скачивала в последнее время. На компе никаких левых пр…
                  n
                  nkly3 января 2025 г. 12:52
                  Нужно запретить перемещение только некоторых итемов, остальные перемещать можно. Вопрос решен. Узнать QModelIndex элемента на который мы перетаскиваем другой элемент, можно с помощью функции indexAt(event->position().toPoint()) представления QTreeViev вызываемой в переопр…
                  M
                  Marsel17 августа 2023 г. 0:26
                  OAuth2.0 через VK, получение email Спасибо большое за помощь и простите за то что отнял время своей невнимательностью.

                  Следите за нами в социальных сетях