python爬取贝壳中二手房的数据
前言通过代码爬取贝壳中二手房的数据以此给更多需要了解爬虫或者二手房信息的人提供便利。第一部分爬取地址1.1贝壳首页地址jiujiang.ke.com第二部分爬取数据2.1输入要爬多少页int(input(输入一共要多少页输入整数))2.2找到要请求的网址wangzhi fhttps://jiujiang.ke.com/ershoufang/pg{y}/2.3定位多个房源信息位置page.eles(xpath://div[classinfo clear], timeout20)2.4设置要爬的信息​ for x in loc: # 标题 biaoti x.ele(xpath:.//div[classtitle]/a).text # 地址 address x.ele(xpath:.//div[classpositionInfo]/a).text # 概述 info x.ele(xpath:.//div[classhouseInfo]).text # 总价 price x.ele(xpath:.//div[classtotalPrice totalPrice2]/span).text ​ # 详情页链接 lianjie x.ele(xpath:.//div[classpositionInfo]/a).attr(href)第三部分保存信息pandas.DataFrame(kong_list).to_csv(贝壳二手房九江.csv, indexFalse)全部的代码见文章末尾更多信息请关注......本篇文章的源码如下from DrissionPage import ChromiumPage import time import pandas kong_list [] num int(input(输入一共要多少页输入整数)) for y in range(1, num1): page ChromiumPage() wangzhi fhttps://jiujiang.ke.com/ershoufang/pg{y}/ page.get(wangzhi) # 遇到需要验证的页码就跳过进入下一页 loc page.eles(xpath://div[classinfo clear], timeout20) # 定位多个房源信息的位置 for x in loc: # 标题 biaoti x.ele(xpath:.//div[classtitle]/a).text # 地址 address x.ele(xpath:.//div[classpositionInfo]/a).text # 概述 info x.ele(xpath:.//div[classhouseInfo]).text # 总价 price x.ele(xpath:.//div[classtotalPrice totalPrice2]/span).text # 详情页链接 lianjie x.ele(xpath:.//div[classpositionInfo]/a).attr(href) print(\n, biaoti, address, info, price, lianjie) kong_list.append({ 标题: biaoti, 地址: address, 概述: info, 总价: price万, 详情链接: lianjie, }) time.sleep(3) # 写入文件 pandas.DataFrame(kong_list).to_csv(贝壳二手房九江.csv, indexFalse)

相关新闻

学习日记 7.28

学习日记 7.28

在机器学习的学习之路上,线性回归和逻辑回归是两块重要的基石。今天我们将通过两个实战案例,从理论到代码,全面掌握这两种算法的应用:案例一:多元线性回归 —— 根据体重和年龄预测血压收缩压;案例二&#…

2026/7/29 4:26:03 阅读更多
IP地址与子网掩码计算:网络排错与规划的必备基本功

IP地址与子网掩码计算:网络排错与规划的必备基本功

1. 从一次真实的网络故障说起:为什么IP计算是基本功那天下午,整个办公室的网络突然变得奇慢无比,部分同事甚至完全无法访问内部的文件服务器。作为团队里对网络稍有了解的人,我被叫去帮忙。初步排查,路由器和交换机指示…

2026/7/29 4:56:04 阅读更多
步进电机驱动器核心参数解析与实战选型指南

步进电机驱动器核心参数解析与实战选型指南

1. 项目概述:从“会转”到“转得好”的必经之路提起步进电机,很多搞过单片机、玩过3D打印机或者DIY过一些小装置的朋友肯定不陌生。它最大的特点就是“听话”——给一个脉冲,它就转一个固定的角度,开环控制,结构简单&a…

2026/7/29 4:46:03 阅读更多