c#网页抓取京东商城首页案列

简介: c#网页抓取京东商城首页案列

在C#语言中,我们可以使用一些工具类库来进行网页抓取,例如.NET Framework提供的System.Net命名空间中的HttpWebRequest和HttpWebResponse类,以及第三方类库HtmlAgilityPack。

下面是一个简单的C#程序,使用HttpWebRequest和HttpWebResponse类来抓取网页:

using System;
using System.IO;
using System.Net;
 
public class WebRequestExample
{
    public static void Main()
    {
        // 创建一个WebRequest对象
        WebRequest request = WebRequest.Create("http://www.example.com");
 
        // 发送请求并获取响应
        WebResponse response = request.GetResponse();
 
        // 读取响应内容
        Stream stream = response.GetResponseStream();
        StreamReader reader = new StreamReader(stream);
        string content = reader.ReadToEnd();
        
        // 关闭响应和流
        response.Close();
        reader.Close();
        stream.Close();
 
        // 输出网页内容
        Console.WriteLine(content);
    }
}

上述代码会获取http://www.example.com的网页内容并输出到控制台中。

如果需要解析网页内容,可以使用HtmlAgilityPack类库。下面是一个使用HtmlAgilityPack来抓取京东商城首页商品列表的示例:

using System;
using System.Collections.Generic;
using System.Linq;
using System.Net.Http;
using HtmlAgilityPack;
 
public class Program
{
    public static void Main()
    {
        // 发送HTTP请求获取京东商城首页内容
        using (var client = new HttpClient())
        {
            var response = client.GetAsync("https://www.jd.com/").Result;
            var responseContent = response.Content;
 
            // 使用HtmlAgilityPack解析HTML内容
            var htmlDocument = new HtmlDocument();
            htmlDocument.LoadHtml(responseContent.ReadAsStringAsync().Result);
 
            // 获取商品列表中的商品名称和价格
            var productList = htmlDocument.DocumentNode.Descendants("ul")
                .Where(x => x.GetAttributeValue("class", "") == "clearfix")
                .FirstOrDefault();
            if (productList != null)
            {
                var items = productList.Descendants("li").ToList();
                foreach (var item in items)
                {
                    var name = item.Descendants("div")
                        .Where(x => x.GetAttributeValue("class", "") == "p-name")
                        .FirstOrDefault()?.InnerText;
                    var price = item.Descendants("div")
                        .Where(x => x.GetAttributeValue("class", "") == "p-price")
                        .FirstOrDefault()?.InnerText;
                    Console.WriteLine($"商品名称:{name},价格:{price}");
                }
            }
        }
    }
}

上述代码使用HttpClient类发送HTTP请求获取京东商城首页内容,然后使用HtmlAgilityPack解析HTML内容,并提取出商品列表中的商品名称和价格。最后输出到控制台中。

需要注意的是,网页抓取涉及到网站的隐私和版权等问题,需要遵循相关法律法规,不得擅自抓取或使用他人内容。


相关文章
|
前端开发
HTML+CSS仿京东购物车页面静态页面
HTML+CSS仿京东购物车页面静态页面
194 2
|
Web App开发 计算机视觉 iOS开发
验证码识别实战|百度营销模拟登陆
验证码识别实战|百度营销模拟登陆
163 0
|
5月前
|
JSON 小程序 JavaScript
微信小程序制作 购物商城首页 【内包含源码】
这篇文章提供了一个微信小程序购物商城首页的实现方法和源码,包括页面布局、数据结构、核心代码以及如何配置tabBar和搜索框组件。
微信小程序制作 购物商城首页 【内包含源码】
|
8月前
|
移动开发 前端开发 HTML5
HTML5实现酷炫个人产品推广、工具推广、信息推广、个人主页、个人介绍、酷炫官网、门户网站模板源码
HTML5实现酷炫个人产品推广、工具推广、信息推广、个人主页、个人介绍、酷炫官网、门户网站模板源码
|
8月前
|
存储 JSON API
如何教会小白使用淘宝API接口获取商品数据
随着互联网的普及,越来越多的人开始接触网络购物,而淘宝作为中国最大的电商平台之一,成为了众多消费者首选的购物平台。然而,对于一些小白用户来说,如何通过淘宝API接口获取商品数据可能是一个难题。本文将详细介绍如何教会小白使用淘宝API接口获取商品数据。
|
8月前
|
小程序 JavaScript Java
购物|电商购物小程序|基于微信小程序的购物系统设计与实现(源码+数据库+文档)
购物|电商购物小程序|基于微信小程序的购物系统设计与实现(源码+数据库+文档)
111 0
|
监控 Serverless 持续交付
小试牛刀,一键部署电商商城
SAE 仅需一键,极速部署一个微服务电商商城,体验 Serverless 带给您的全托管体验,一起来部署吧!
2508 44
|
小程序 测试技术 定位技术
微信小程序景区的制作思路
微信小程序景区的制作思路
|
小程序 安全 前端开发
公司企业展示门户店铺展示宣传微信小程序前端源码
微信小程序,小程序的一种,英文名Wechat Mini Program,是一种不需要下载安装即可使用的应用,它实现了应用“触手可及”的梦想,用户扫一扫或搜一下即可打开应用。
186 0
|
小程序 CDN
🍁商城类小程序实战(三):商城首页的制作
🍁商城类小程序实战(三):商城首页的制作
448 4
🍁商城类小程序实战(三):商城首页的制作