python编写的bt爬虫实践_torrentkitty

作者：繁依Fanyi0 | 2024-02-09 10:49:01

踩

torrentkitty

前言

网上各种爬虫实战都有很多，比如爬取微博，贴吧消息，妹子图等等。但是爬bt的就很少了（似乎暴露了什么。。。），所以准备自己动手写一个爬bt的爬虫。

好的，话不多说进入正题，博主用的python3.6，ide用的sublim。

正文

首先就是寻找一个合适的bt搜索网站，记得以前有好多著名的bt站，比如种子列表，或者torrentkitty什么的，后来由于某些大家都知道的原因，这样的网站封禁了一大批。所以这次我选用的是一个名叫btbook的网站。emmm，虽然也有广告，但是算非常少的一个了，页面也比较干净。（大家不要好奇去点弹出的X榴社区的广告，那是假的！假的！）

用谷歌或者火狐自带的开发者工具。f12一下，可以看到网页源码，找到搜索框部分，如下

可以看到在一个id=“search-form”的表单里边有我们所需要的东西。我们还发现了更多的信息，比如通过这个表单向服务器传送数据的方法是get，文本框的name=‘q’等等。

接下来肯定是要导入各种爬虫所需要的库，urllib用于进行一系列对url的操作，BeautifulSoup用于解析html，使其变成字典或者数组，比起正则表达式来说方便了许多。

我们先编写代码尝试获取一下网站的html源码

[python]view plaincopy

声明：本文内容由网友自发贡献，不代表【wpsshop博客】立场，版权归原作者所有，本站不承担相应法律责任。如您发现有侵权的内容，请联系我们。转载请注明出处：https://www.wpsshop.cn/blog/article/detail/71535

python编写的bt爬虫实践_torrentkitty

前言

正文

Python Web开发完全指南

Python提取PDF表格及文本！（附源码）_table_df python

python flask实现博客系统_基于Flask的博客网站设计与实现

Python：PDF文件处理（数据处理）_pdfplumber

实用脚本，Python 提取 PDF 指定内容生成新文件_deprecation_with_replacement("pdffilereader", "pdf

Python Flask框架-开发简单博客-开篇介绍_python轻博客

Python 读取PDF文档内容提取PDF文本和图片_python读取pdf,并截取部分内容为图片

开发了一款基于 Flask 框架的在线电影网站系统（附 Python 源码）_flask网站源码

Python Flask小项目实战_python flask项目

Python 实现 PDF 提取所有图片_python提取pdf中图形信息

如何使用 Python 读写 PDF 文件

python: 从pdf中提取图片_fitz api xreflength

Python Flask 全流程全栈项目实战18章内附源码

(分享)Python Flask 全流程全栈项目实战

(超清)Python Flask 全流程全栈项目实战

python+flask项目实战开发_python继基于flask的项目

太全了！使用 Python 转换 PDF，看这一篇总结就够了。

Python Flask 全流程全栈项目实战完整版_python flask 项目实战

办公自动化：Python 操作 PDF 这一篇就足够了！_python pdf

Python 操作 PDF_python 操作pdf