java 利用jousp 爬取知乎首页问题

时间：2018-07-19 23:25:59 阅读：630 评论：0 收藏：0 [点我收藏+]

标签：cep stat 爬虫 title 链接 soup node att 导入

今天学了下java的爬虫，首先要下载jousp的包，然后导入，导入过程：首先右击工程：Build Path ->configure Build Path,再点击Add External JARS，进行导包。

学习参考文档：https://jsoup.org/

但是有一点小问题：就是利用java爬虫爬去了知乎的问题，但是却只爬到了前三条，大体思路应该还是正确的。不知怎么解决，如果各位大佬有思路，望指教：

import java.io.BufferedWriter;
import java.io.File;
import java.io.FileWriter;
import java.io.IOException;
import java.util.ArrayList;
import java.util.List;

import org.jsoup.Jsoup;
import org.jsoup.nodes.Document;
import org.jsoup.nodes.Element;
import org.jsoup.select.Elements;
import java.io.IOException;
import org.jsoup.Jsoup;
import org.jsoup.nodes.Document;
import org.jsoup.nodes.Element;
import org.jsoup.select.Elements;

public class worm0{
    public static void main(String[] args) throws IOException {
    
        Document document=Jsoup.connect("https://www.zhihu.com/").get();
        Elements main=document.select(".ContentLayout-mainColumn");
        
        Elements url=main.select("h2[class=ContentItem-title]").select("a");
        System.out.println("url"+url);
        for(Element question:url){
            //输出href后的值，即主页上每个关注问题的链接
            String URL=question.attr("abs:href");
            //下载问题链接指向的页面
            Document document2=Jsoup.connect(URL).get();
            //问题
            Elements title=document2.select(".QuestionHeader-title");
            //问题描述
            Elements detail=document2.select("span[class=RichText ztext]");
            //回答
            Elements answer=document2.select(".RichContent-inner");
            System.out.println("\n"+"链接："+URL
                    +"\n"+"标题："+title.text()
                    +"\n"+"问题描述："+detail.text()
                    +"\n"+"回答："+answer.text());
        }   
    }
}

java 利用jousp 爬取知乎首页问题

标签：cep stat 爬虫 title 链接 soup node att 导入

原文地址：https://www.cnblogs.com/xr210/p/9338974.html

踩

(0)

评论一句话评论（0）

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)

周排行