c#网页抓取京东商城首页案列

简介: c#网页抓取京东商城首页案列

在C#语言中,我们可以使用一些工具类库来进行网页抓取,例如.NET Framework提供的System.Net命名空间中的HttpWebRequest和HttpWebResponse类,以及第三方类库HtmlAgilityPack。

下面是一个简单的C#程序,使用HttpWebRequest和HttpWebResponse类来抓取网页:

using System;
using System.IO;
using System.Net;
 
public class WebRequestExample
{
    public static void Main()
    {
        // 创建一个WebRequest对象
        WebRequest request = WebRequest.Create("http://www.example.com");
 
        // 发送请求并获取响应
        WebResponse response = request.GetResponse();
 
        // 读取响应内容
        Stream stream = response.GetResponseStream();
        StreamReader reader = new StreamReader(stream);
        string content = reader.ReadToEnd();
        
        // 关闭响应和流
        response.Close();
        reader.Close();
        stream.Close();
 
        // 输出网页内容
        Console.WriteLine(content);
    }
}

上述代码会获取http://www.example.com的网页内容并输出到控制台中。

如果需要解析网页内容,可以使用HtmlAgilityPack类库。下面是一个使用HtmlAgilityPack来抓取京东商城首页商品列表的示例:

using System;
using System.Collections.Generic;
using System.Linq;
using System.Net.Http;
using HtmlAgilityPack;
 
public class Program
{
    public static void Main()
    {
        // 发送HTTP请求获取京东商城首页内容
        using (var client = new HttpClient())
        {
            var response = client.GetAsync("https://www.jd.com/").Result;
            var responseContent = response.Content;
 
            // 使用HtmlAgilityPack解析HTML内容
            var htmlDocument = new HtmlDocument();
            htmlDocument.LoadHtml(responseContent.ReadAsStringAsync().Result);
 
            // 获取商品列表中的商品名称和价格
            var productList = htmlDocument.DocumentNode.Descendants("ul")
                .Where(x => x.GetAttributeValue("class", "") == "clearfix")
                .FirstOrDefault();
            if (productList != null)
            {
                var items = productList.Descendants("li").ToList();
                foreach (var item in items)
                {
                    var name = item.Descendants("div")
                        .Where(x => x.GetAttributeValue("class", "") == "p-name")
                        .FirstOrDefault()?.InnerText;
                    var price = item.Descendants("div")
                        .Where(x => x.GetAttributeValue("class", "") == "p-price")
                        .FirstOrDefault()?.InnerText;
                    Console.WriteLine($"商品名称:{name},价格:{price}");
                }
            }
        }
    }
}

上述代码使用HttpClient类发送HTTP请求获取京东商城首页内容,然后使用HtmlAgilityPack解析HTML内容,并提取出商品列表中的商品名称和价格。最后输出到控制台中。

需要注意的是,网页抓取涉及到网站的隐私和版权等问题,需要遵循相关法律法规,不得擅自抓取或使用他人内容。


相关文章
|
Ubuntu 数据安全/隐私保护
修改Wsl为root登录,并修改root密码
修改Wsl为root登录,并修改root密码
648 0
|
8月前
|
传感器 人工智能 物联网
《跨越架构鸿沟:分布式软总线实现设备通信大一统》
随着设备多样性增加,不同芯片架构(如X86、ARM、RISC-V)在通信中面临诸多障碍。分布式软总线技术应运而生,通过融合底层通信技术、协议货架适配和中间适配层,屏蔽硬件、操作系统及协议差异,实现高效统一通信。该技术已在智能家居与办公场景中展现价值,未来结合AI与新一代通信技术,将助力万物互联愿景的实现。
401 6
|
机器学习/深度学习 数据采集 数据挖掘
使用Python实现智能食品消费习惯预测的深度学习模型
使用Python实现智能食品消费习惯预测的深度学习模型
388 19
|
8月前
|
Devops API 语音技术
Cisco NX-OS Software Release 9.3(15) - 数据中心网络操作系统
Cisco NX-OS Software Release 9.3(15) - 数据中心网络操作系统
204 5
Cisco NX-OS Software Release 9.3(15) - 数据中心网络操作系统
|
前端开发 API 数据库
介绍一下Flask的使用方法
介绍一下Flask的使用方法
|
Docker 容器
docker network inspect 查询出来的网络的创建命令是什么
【6月更文挑战第17天】docker network inspect 查询出来的网络的创建命令是什么
251 1
|
Windows
解决telnet不是内部或外部以及验证某个端口是否开放
解决telnet不是内部或外部以及验证某个端口是否开放
285 0
|
Kubernetes 应用服务中间件 网络安全
kubernetes中Ingress Nginx 常用规则使用
kubernetes中Ingress Nginx 常用规则使用
240 0
|
弹性计算 大数据 测试技术
阿里云服务器多少钱?阿里云价格表新鲜出炉(2024年最新)
2024年阿里云服务器租用价格表更新,云服务器ECS经济型e实例2核2G、3M固定带宽99元一年、ECS u1实例2核4G、5M固定带宽、80G ESSD Entry盘优惠价格199元一年,轻量应用服务器2核2G3M带宽轻量服务器一年61元、2核4G4M带宽轻量服务器一年165元12个月、2核4G服务器30元3个月
1429 0

热门文章

最新文章