Python爬取歌曲宝音乐:轻松下载Jay的歌

歌曲宝是一个不用付费就能听jay的歌曲,但是每次都只能播放一首不方便,于是今天想把它下载下来,本地循环播放,它所用到的接口是某我的还不错哈

获取搜索接口

分析html请求接口,获取到的数据是直接渲染好的HTML内容,通过curl我们可以得到搜索接口请求构造
在这里插入图片描述

搜索请求:

import requests

cookies = {
    'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149',
    'Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}

headers = {
    'authority': 'www.gequbao.com',
    'accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7',
    'accept-language': 'zh-CN,zh;q=0.9',
    'cache-control': 'no-cache',
    # 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149',
    'pragma': 'no-cache',
    'referer': 'https://www.gequbao.com/',
    'sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"',
    'sec-ch-ua-mobile': '?0',
    'sec-ch-ua-platform': '"Windows"',
    'sec-fetch-dest': 'document',
    'sec-fetch-mode': 'navigate',
    'sec-fetch-site': 'same-origin',
    'sec-fetch-user': '?1',
    'upgrade-insecure-requests': '1',
    'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}

response = requests.get('https://www.gequbao.com/s/%E5%91%A8%E6%9D%B0%E4%BC%A6', cookies=cookies, headers=headers)
print(response.text)
print(response)

URL解码

由于接口被编码了,很难看出它是如何提交参数的,通过解码,我们可以快速查看接口构造

解码后,如下图:
在这里插入图片描述

用法:替换为想要搜索的歌曲或者是歌手,运行脚本即可

代码替换:

import requests

cookies = {
    'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149',
    'Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}

headers = {
    'authority': 'www.gequbao.com',
    'accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7',
    'accept-language': 'zh-CN,zh;q=0.9',
    'cache-control': 'no-cache',
    # 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149',
    'pragma': 'no-cache',
    'referer': 'https://www.gequbao.com/',
    'sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"',
    'sec-ch-ua-mobile': '?0',
    'sec-ch-ua-platform': '"Windows"',
    'sec-fetch-dest': 'document',
    'sec-fetch-mode': 'navigate',
    'sec-fetch-site': 'same-origin',
    'sec-fetch-user': '?1',
    'upgrade-insecure-requests': '1',
    'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}

response = requests.get('https://www.gequbao.com/s/周杰伦', cookies=cookies, headers=headers)
print(response.text)

清洗数据

使用Beautiful Soup解析HTML

由于搜索的数据不是接口返回,是HTML渲染的,所以我们需要通过 Python的BS模块进行数据处理

# 使用Beautiful Soup解析HTML
soup = BeautifulSoup(html_data, 'html.parser')

# 提取标题
title = soup.title.text
print("标题:", title)

# 找到所有的<div>标签,并遍历它们
for div in soup.find_all('div', class_='row'):
    # 检查是否存在类为'text-success'的<div>标签
    text_success_div = div.find('div', class_='text-success')
    if text_success_div:
        # 提取歌手名
        artist_name = text_success_div.text.strip()
        # 检查是否存在<a>标签
        a_tag = div.find('a')
        if a_tag:
            # 提取歌曲名
            song_name = a_tag.text.strip()
            # 打印歌曲名和歌手名
            print("歌曲名:", song_name)
            print("歌手:", artist_name)
            print()

通过BS处理的数据可以很清晰的获取到歌曲名歌手以及歌曲的ID,而歌曲的ID是用来获取音乐地址

在这里插入图片描述

拼接下载链接

通过网页抓包分析,我们发现下载的时候需要歌曲ID,所以在进行下载之前要处理好ID的获取,然后进行下载调用

for a_tag in soup.find_all('a', class_='text-primary font-weight-bold'):
    # 提取 href 属性值
    href_value = a_tag.get('href')
    # 提取数字部分
    music_id = href_value.split('/')[-1]
    # 提取歌曲名
    song_name = a_tag.text.strip()
    # 打印歌曲名和音乐ID
    print("歌曲名:", song_name)
    print("音乐ID:", music_id)
    print()

解析歌曲id

在这里插入图片描述

下载保存

请求歌曲宝下载接口,进行文件下载

在这里插入图片描述

新建一个download方法,进行ID和歌名的接收,在方法内执行音乐下载接口的请求

def download(id,musicname):

    cookies = {
        'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710768074,1710915841,1710916149,1710922373',
        'Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710923549',
    }

    headers = {
        'authority': 'www.gequbao.com',
        'accept': 'application/json, text/javascript, */*; q=0.01',
        'accept-language': 'zh-CN,zh;q=0.9',
        'cache-control': 'no-cache',
        # 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710768074,1710915841,1710916149,1710922373; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710923549',
        'pragma': 'no-cache',
        'referer': 'https://www.gequbao.com/music/112019',
        'sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"',
        'sec-ch-ua-mobile': '?0',
        'sec-ch-ua-platform': '"Windows"',
        'sec-fetch-dest': 'empty',
        'sec-fetch-mode': 'cors',
        'sec-fetch-site': 'same-origin',
        'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
        'x-requested-with': 'XMLHttpRequest',
    }

    params = {
        'id': id,
        'json': '1',
    }

    response = requests.get('https://www.gequbao.com/api/play_url', params=params, cookies=cookies, headers=headers)
    print(response.json)
    music_data=response.json()
    if music_data['code']==1:

        url = music_data['data']['url']  # 替换为要下载的文件的URL
        local_filename = musicname+".mp3"  # 保存到本地的文件名,可以根据需要修改

        # 发送GET请求下载文件
        response = requests.get(url)

        # 检查请求是否成功
        if response.status_code == 200:
            # 打开文件以二进制写模式保存
            with open(local_filename, 'wb') as file:
                # 将文件内容写入本地文件
                file.write(response.content)
            print("文件已成功下载并保存到:", local_filename)
        else:
            print("下载文件失败:", response.status_code)
    else:
        print("下载失败"+music_data['msg'])


运行结束后,保存在根目录,如下图:
在这里插入图片描述

尝试放歌
在这里插入图片描述

关于

在这里插入图片描述

🍋希望你能喜欢我的其他作品
《记一次云之家签到抓包》
《记一次视频抓包m3u8解密过程》
《抓包部分软件时无网络+过代理检测 解决办法 安卓黄鸟httpcanary+vmos》
《Python】记录抓包分析自动领取芝麻HTTP每日免费IP(成品+教程)》
《某课抓包视频 安卓手机:黄鸟+某课app+VirtualXposed虚拟框架》

推荐专栏:

《Python爬虫脚本项目实战》

该专栏往期文章:
《【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)》

🥦如果感觉看完文章还不过瘾,欢迎查看我的其它专栏
🥦作者对python有很大的兴趣,完成过很多独立的项目:例如滇医通等等脚本,但是由于版权的原因下架了,爬虫这一类审核比较严谨,稍有不慎就侵权违规了,所以在保证质量的同时会对文章进行筛选

如果您对爬虫感兴趣请收藏或者订阅该专栏哦《Python爬虫脚本项目实战》,如果你有项目欢迎联系我,我会同步教程到本专栏!

🚀Python爬虫项目实战系列文章!!
⭐⭐欢迎订阅⭐⭐

【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)
【Python爬虫项目实战二】Chatgpt还原验证算法-解密某宝伪知网数据接口

⭐⭐欢迎订阅⭐⭐
在这里插入图片描述

Python爬虫脚本项目实战
在这里插入图片描述

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/480757.html

如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!

相关文章

lvs+keepalived+nginx实现高可用

主机&#xff1a;192.168.199.132 备机&#xff1a;192.168.199.133 真实服务器1&#xff1a;192.168.199.134 真实服务器2&#xff1a;192.168.199.135 问题&#xff1a; 防火墙没关 132配置ipvsadm进行dr模式 132配置keepalived.conf 133配置ipvsadm进行dr模式 133配置ke…

【测试开发学习历程】计算机编程语言

前言&#xff1a; 学习完数据库&#xff0c;我们便要进入到编程语言的内容当中了。 这里先对编程语言写出大致的分类&#xff0c; 在这之后&#xff0c;我们会以Python为重点&#xff0c; 开始测试开发为重点的编程语言学习。 目录 1 计算机编程语言的发展 2 语言的分类…

高蛋白的猫粮品牌有哪些?

亲爱的猫友们&#xff0c;你们是否也在寻找一款高蛋白的猫粮&#xff0c;希望给自家的小猫咪提供最好的营养呢&#xff1f;&#x1f431; 在市面上&#xff0c;高蛋白的猫粮品牌确实不少&#xff0c;但要说到真正让人信赖的&#xff0c;福派斯鲜肉无谷猫粮无疑是一个不错的选择…

如何自己构建 Ollama 模型

如何自己构建 Ollama 模型 0. 引言1. 下载原始模型2. 创建 Modelfile 文件3. 构建 Ollama 模型4. 运行自构建的 Ollama 模型 0. 引言 针对模型新出的大模型&#xff0c;可能 Ollama Models Library 不提供&#xff0c;或者会在今后的某个时点提供。还有可能 Ollama Models Lib…

计算机视觉之三维重建(3)---单视几何

文章目录 一、问题提出二、无穷远点、无穷远线、无穷远平面2.1 2D空间2.2 3D空间 三、影消点和影消线3.1 2D平面上的无穷远点&#xff0c;无穷远线变换3.2 影消点3.3 影消线 四、单视重构 一、问题提出 1. 当摄像机标定后&#xff0c;内部参数 K K K 已知&#xff0c;外部参数…

R语言逻辑回归与lasso模型

一、数据描述 数据集heart_learning.csv与heart_test.csv是关于心脏病的数据集&#xff0c;heart_learning.csv是训练数据集&#xff0c;heart_test.csv是测试数据集。 变量名称变量说明age年龄sex性别&#xff0c;取值1代表男性&#xff0c;0代表女性pain 胸痛的类型&#x…

去中心化的 AI 数据供应:认识Grass,参与Grass

去中心化的 AI 数据供应&#xff1a;认识Grass&#xff0c;参与Grass &#x1f44b;&#xff1a;邀请链接☘️&#xff1a;Intro❓&#xff1a;看好Grass和即将推出的L2的原因有哪些&#xff1f;&#x1f4a1;&#xff1a;展望&#x1f50d;&#xff1a;总结 &#x1f44b;&…

Ubuntu 安装GPU驱动

https://www.nvidia.cn/Download/index.aspx 驱动我前面安装好啦&#xff0c;不做了&#xff0c;不过可以去看看 CUDA Toolkit 12.4 Downloads | NVIDIA Developer wget https://developer.download.nvidia.com/compute/cuda/12.4.0/local_installers/cuda_12.4.0_550.54.14_l…

【CXL协议-事务层之CXL.io(3)】

3.1 CXL.io CXL.io 为 I/O 设备提供非一致的加载/存储接口。 图 14 显示了 CXL.io 事务层在 Flex Bus 分层结构中的位置。 交易类型、交易数据包格式、基于信用的流量控制、虚拟通道管理和交易排序规则遵循PCIe定义&#xff1b; 请参阅 有关详细信息&#xff0c;请参阅 PCI Ex…

一文读懂多模态大模型:原理、应用与挑战全解析

在这个信息交织、五彩斑斓的时代&#xff0c;文字、图像、视频和音频如同四条蜿蜒曲折的河流&#xff0c;各自流淌&#xff0c;却又相互交织。它们构成了我们数字生活的核心元素&#xff0c;每一天&#xff0c;我们都在与之亲密接触。然而&#xff0c;面对这些形态各异的信息流…

(附源码)基于Spring Boot + Vue 在线网课学习系统的设计与实现

前言 &#x1f497;博主介绍&#xff1a;✌专注于Java、小程序技术领域和毕业项目实战✌&#x1f497; &#x1f447;&#x1f3fb; 精彩专栏 推荐订阅&#x1f447;&#x1f3fb; 2024年Java精品实战案例《100套》 &#x1f345;文末获取源码联系&#x1f345; &#x1f31…

政安晨:【深度学习实践】【使用 TensorFlow 和 Keras 为结构化数据构建和训练神经网络】(六)—— 二元分类

政安晨的个人主页&#xff1a;政安晨 欢迎 &#x1f44d;点赞✍评论⭐收藏 收录专栏: 政安晨的机器学习笔记 希望政安晨的博客能够对您有所裨益&#xff0c;如有不足之处&#xff0c;欢迎在评论区提出指正&#xff01; 这篇文章咱们将深度学习应用到另一个常见任务中。 前言 在…

说说webpack的构建流程?

文章目录 一、运行流程初始化流程编译构建流程compile 编译make 编译模块build module 完成模块编译 输出流程seal 输出资源emit 输出完成 二、小结参考文献 一、运行流程 webpack 的运行流程是一个串行的过程&#xff0c;它的工作流程就是将各个插件串联起来 在运行过程中会…

selenium自动化登录模块HTMLTestRunner测试报告

1.下载HTMLTestRunner.py放到python的Lib目录下&#xff0c;python3之后的&#xff0c;文件要修改以下内容&#xff1a; 第94行&#xff0c;将import StringIO修改成import io 第539行&#xff0c;将self.outputBuffer StringIO.StringIO()修改成self.outputBuffer io.Strin…

eth 交易案例分析9

交易hash: 先用0.26eth买入了多个GPT&#xff0c;然后用这多个GPT 在uniswap3 兑换了1.69 个eth&#xff0c; 疑问点&#xff1a;买入的 DLP 什么意思&#xff1f;

C++一维数组练习oj

思路分析&#xff1a;这题它说n是小于等于1000的&#xff0c;那么我们现在就需要找出1--1000的幸运数 4&#xff0c;7&#xff0c;44&#xff0c;47&#xff0c;74&#xff0c;77&#xff0c;444&#xff0c;447&#xff0c;474&#xff0c;477&#xff0c;774&#xff0c;747&…

OCR研究背景及相关论文分享

光学字符识别&#xff08;Optical Character Recognition&#xff0c;OCR&#xff09;是指使用光学方法将图像中的文字转换为机器可编辑的文本的技术。OCR技术的研究和应用已有数十年的历史&#xff0c;其背景和发展受到多方面因素的影响。 技术需求背景 1.自动化文档处理&am…

从原理到实践:深入探索Linux安全机制(一)

前言 本文将从用户和权限管理、文件系统权限、SELinux、防火墙、加密和安全传输、漏洞管理和更新等几个Linux安全机制中的重要方面&#xff0c;深入探索其工作原理和使用方法。在当今数字化时代&#xff0c;网络安全问题备受关注&#xff0c;Linux作为广泛应用的操作系统之一&…

Github 2024-03-23 Rust开源项目日报 Top10

根据Github Trendings的统计,今日(2024-03-23统计)共有10个项目上榜。根据开发语言中项目的数量,汇总情况如下: 开发语言项目数量Rust项目10Dart项目1RustDesk: 用Rust编写的开源远程桌面软件 创建周期:1218 天开发语言:Rust, Dart协议类型:GNU Affero General Public Li…

Mora: Enabling Generalist Video Generation via A Multi-Agent Framework

Mora: Enabling Generalist Video Generation via A Multi-Agent Framework PDF: https://arxiv.org/html/2403.13248v1 1 概述 为弥补Sora不开源的缺陷&#xff0c;本文提出多代理框架Mora&#xff0c;整合先进视觉AI代理&#xff0c;复制Sora的全能视频生成能力。Mora能利用…