Python爬取京东商品信息,详细讲解,手把手教学(附源码)

Python 爬虫爬取京东商品信息

下面我将逐一解释每一部分的代码

导入库

from selenium import webdriver
from selenium.webdriver.edge.service import Service
from selenium.webdriver.edge.options import Options
import time
import random
import csv
from selenium.common.exceptions import TimeoutException
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from pyquery import PyQuery as pq
import os
import requests
from datetime import datetime
import re
  • 作用:导入所有必要的库和模块。

  • 技术栈

  • selenium: 用于自动化浏览器操作。

  • time, random: 用于添加延迟和生成随机数。

  • csv: 用于读写CSV文件。

  • os: 用于文件系统操作。

  • requests: 用于发送HTTP请求(例如下载图片)。

  • datetime: 用于处理日期和时间。

  • re: 用于正则表达式匹配。

配置变量

KEYWORD = '美妆'
CSV_FILE = 'DepartmentStore.csv'
id = 3538
dratenums = 5
drate = 5
num = 5
  • 作用:初始化全局变量。

  • 技术栈:无特殊技术栈。

设置WebDriver

# 创建EdgeOptions对象
options = Options()

# 设置Edge WebDriver的路径
webdriver_path = 'G:\\大三下暑期实训基于电商商品推荐平台\\爬虫\\a\\msedgedriver.exe'
service = Service(webdriver_path)

# 初始化Edge WebDriver
driver = webdriver.Edge(service=service, options=options)

# 窗口最大化
driver.maximize_window()

wait = WebDriverWait(driver, 15)
  • 作用:初始化Microsoft Edge WebDriver。

  • 技术栈

  • selenium: 用于自动化浏览器操作。

函数定义

search_goods 函数
def search_goods(start_page, total_pages):
  • 作用:搜索特定商品并处理翻页逻辑。

  • 技术栈

  • selenium: 用于自动化浏览器操作。

  • pyquery: 用于解析HTML文档。

  • time: 用于添加延迟。

  • random: 用于生成随机数。

page_turning 函数
def page_turning(page_number):
    # ...
  • 作用:实现翻页操作。

  • 技术栈selenium: 用于自动化浏览器操作。

random_sleep 函数
def random_sleep(timeS, timeE):
    # ...
  • 作用:随机等待一段时间,防止被网站检测到爬虫行为。

  • 技术栈time, random: 用于添加延迟和生成随机数。

scroll_smoothly 函数
def scroll_smoothly(duration):
    # ...
  • 作用:平滑滚动页面以模拟真实用户行为。

  • 技术栈selenium: 用于自动化浏览器操作。

get_goods 函数
def get_goods():
    # ...
  • 作用:获取商品列表中的具体信息。

  • 技术栈

  • selenium: 用于自动化浏览器操作。

  • pyquery: 用于解析HTML文档。

  • os: 用于文件系统操作。

  • requests: 用于发送HTTP请求(例如下载图片)。

  • datetime: 用于处理日期和时间。

  • re: 用于正则表达式匹配。

save_to_csv 函数
def save_to_csv(result):
    # ...
  • 作用:将获取到的商品信息保存到CSV文件中。

  • 技术栈csv: 用于读写CSV文件。

main 函数
def main():
    # ...
  • 作用:主函数,用于启动爬虫并处理异常。

  • 技术栈:无特殊技术栈。

主程序入口

if __name__ == '__main__':
    main()
  • 作用:程序的入口点。

  • 技术栈:无特殊技术栈。

接下来,我将针对每个函数进行详细的代码解释。

search_goods 函数

def search_goods(start_page, total_pages):
    print('正在搜索: ')
    try:
        driver.get('https://www.taobao.com')
        time.sleep(10)
        driver.execute_cdp_cmd("Page.addScriptToEvaluateOnNewDocument",
                               {"source": """Object.defineProperty(navigator, 'webdriver', {get: () => undefined})"""})
        input = wait.until(EC.presence_of_element_located((By.CSS_SELECTOR, "#q")))
        submit = wait.until(
            EC.element_to_be_clickable((By.CSS_SELECTOR, '#J_TSearchForm > div.search-button > button')))
        input.send_keys(KEYWORD)
        submit.click()
        time.sleep(10)

        if start_page != 1:
            driver.execute_script("window.scrollTo(0, document.body.scrollHeight);")
            random_sleep(1, 3)
            pageInput = wait.until(EC.presence_of_element_located(
                (By.XPATH, '//*[@id="root"]/div/div[3]/div[1]/div[1]/div[2]/div[4]/div/div/span[3]/input')))
            pageInput.send_keys(start_page)
            admit = wait.until(EC.element_to_be_clickable(
                (By.XPATH, '//*[@id="root"]/div/div[3]/div[1]/div[1]/div[2]/div[4]/div/div/button[3]')))
            admit.click()

        get_goods()

        for i in range(start_page + 1, start_page + total_pages):
            page_turning(i)
    except TimeoutException:
        print("search_goods: error")
        return search_goods(start_page, total_pages)
  • 作用:搜索特定商品并处理翻页逻辑。

  • 细节

  • 打开淘宝网站并等待页面加载。

  • 使用CDP命令禁用WebDriver标志,以防被网站检测。

  • 在搜索框中输入关键词并提交。

  • 如果不是第一页,则跳转到指定的起始页。

  • 调用get_goods函数获取商品信息。

  • 循环翻页并获取商品信息。

page_turning 函数

def page_turning(page_number):
    print('正在翻页: ', page_number)
    try:
        submit = wait.until(
            EC.element_to_be_clickable((By.XPATH, '//*[@id="sortBarWrap"]/div[1]/div[2]/div[2]/div[8]/div/button[2]')))
        submit.click()
        wait.until(EC.text_to_be_present_in_element(
            (By.XPATH, '//*[@id="sortBarWrap"]/div[1]/div[2]/div[2]/div[8]/div/span/em'), str(page_number)))
        get_goods()
    except TimeoutException:
        page_turning(page_number)
  • 作用:实现翻页操作。

  • 细节

  • 点击下一页按钮。

  • 等待新的页面加载完成。

  • 调用get_goods函数获取商品信息。

random_sleep 函数

def random_sleep(timeS, timeE):
    random_sleep_time = random.uniform(timeS, timeE)
    time.sleep(random_sleep_time)
  • 作用:随机等待一段时间,防止被网站检测到爬虫行为。

  • 细节

  • 生成一个在timeStimeE之间的随机数作为睡眠时间。

  • 使用time.sleep暂停指定的时间。

scroll_smoothly 函数

def scroll_smoothly(duration):
    total_height = driver.execute_script("return document.body.scrollHeight")
    viewport_height = driver.execute_script("return window.innerHeight")
    steps = 30  # 分成30步
    step_duration = duration / steps  # 每步的时间
    step_height = (total_height - viewport_height) / steps  # 每步的高度

    for i in range(steps):
        driver.execute_script(f"window.scrollBy(0, {step_height});")
        time.sleep(step_duration)
  • 作用:平滑滚动页面以模拟真实用户行为。

  • 细节

  • 计算页面的总高度和视窗的高度。

  • 计算每次滚动的距离和时间。

  • 使用JavaScript执行平滑滚动效果。

get_goods 函数

def get_goods():
    global id, drate, dratenums, num  # 声明使用全局变量 id
    random_sleep(2, 4)
    # 滑动浏览器滚轮,向下滑动
    scroll_smoothly(4)
    random_sleep(4, 4)  # 等待页面加载
    html = driver.page_source
    doc = pq(html)
    items = doc(
        'div.PageContent--contentWrap--mep7AEm > div.LeftLay--leftWrap--xBQipVc > div.LeftLay--leftContent--AMmPNfB > div.Content--content--sgSCZ12 > div > div').items()

    for item in items:
        title = item.find('.Title--title--jCOPvpf span').text()
        price_int = item.find('.Price--priceInt--ZlsSi_M').text()
        price_float = item.find('.Price--priceFloat--h2RR0RK').text()
        if price_int and price_float:
            price = float(f"{price_int}{price_float}")
        else:
            price = 0.0
        deal = item.find('.Price--realSales--FhTZc7U').text()
        location = item.find('.Price--procity--_7Vt3mX').text()
        shop = item.find('.ShopInfo--TextAndPic--yH0AZfx a').text()
        postText = item.find('.SalesPoint--subIconWrapper--s6vanNY span').text()
        result = 1 if "包邮" in postText else 0
        image = item.find('.MainPic--mainPicWrapper--iv9Yv90 img').attr('src')
        # 图片的URL
        image_url = image
        pattern = r"https:\/\/.*?\.jpg"

        match = re.search(pattern, image_url)
        if match:
            print("Extracted URL:", match.group(0))
        else:
            print("No match found")
        image_url = match.group(0)

        # 保存图片的文件夹
        save_folder = "shopping_cover"

        # 确保保存路径存在
        if not os.path.exists(save_folder):
            os.makedirs(save_folder)

        # 将图片文件名固定为 '1.jpg'
        image_name = str(id) + ".jpg"

        # 完整的保存路径
        save_path = os.path.join(save_folder, image_name)

        # 获取当前日期
        current_date = datetime.now()

        # 格式化日期为 'yyyy-mm-dd'
        formatted_date = current_date.strftime('%Y-%m-%d')

        imdblink = item.find('.Card--doubleCardWrapper--L2XFE73 a').attr('href')

        # 下载图片并保存
        try:
            with requests.get(image_url, stream=True) as response:
                response.raise_for_status()
                with open(save_path, 'wb') as f:
                    for chunk in response.iter_content(chunk_size=8192):
                        if chunk:  # filter out keep-alive new chunks
                            f.write(chunk)
            print(f"图片已保存到: {save_path}")
            product = {
                'id': id,
                'name': title,
                'director': shop,
                'country': location,
                'years': formatted_date,
                'leader': price,
                'd_rate_nums': dratenums,
                'd_rate': drate,
                'intro': deal + str(result),
                'num': num,
                'orign_image_link': image,
                'image_link': save_folder + '/' + image_name,
                'imdb_link': imdblink
            }
            save_to_csv(product)
            id += 1
        except requests.RequestException as e:
            print(f"下载图片失败:{e}")

        # 直接滑动浏览器滚轮到最顶部
        driver.execute_script("window.scrollTo(0, 0);")
  • 作用:获取商品列表中的具体信息。

  • 细节

  • 使用pyquery解析HTML源码。

  • 提取每个商品的信息。

  • 下载并保存商品图片。

  • 调用save_to_csv保存数据。

save_to_csv 函数

def save_to_csv(result):
    try:
        with open(CSV_FILE, mode='a', newline='', encoding='utf-8') as file:
            writer = csv.writer(file)
            writer.writerow([result['id'], result['name'], result['director'], result['country'], result['years'], result['leader'], result['d_rate_nums'], result['d_rate'], result['intro'], result['num'], result['orign_image_link'], result['image_link'], result['imdb_link']])
        print('存储到CSV成功: ', result)
    except Exception as e:
        print('存储到CSV出错: ', result, e)
  • 作用:将获取到的商品信息保存到CSV文件中。

  • 细节

  • 将商品信息追加到CSV文件中。

  • 输出保存成功的消息或错误消息。

main 函数

def main():
    try:
        # 检查文件是否存在,如果不存在则创建并写入标题行
        if not os.path.exists(CSV_FILE):
            with open(CSV_FILE, mode='w', newline='', encoding='utf-8') as file:
                writer = csv.writer(file)
                writer.writerow(['id', 'name', 'director', 'country', 'years', 'leader', 'd_rate_nums', 'd_rate', 'intro', 'num', 'orign_image_link', 'image_link', 'imdb_link'])

        pageStart = int(input("输入您想开始爬取的页面数: "))
        pageAll = int(input("输入您想爬取的总页面数: "))
        search_goods(pageStart, pageAll)
    except Exception as e:
        print('main函数报错: ', e)
  • 作用:主函数,用于启动爬虫并处理异常。

  • 细节

  • 检查CSV文件是否存在,若不存在则创建并写入表头。

  • 获取用户输入的起始页和总页数。

  • 调用search_goods函数开始爬取。

主程序入口

if __name__ == '__main__':
    main()
  • 作用:程序的入口点。

  • 细节:当直接运行此文件时,执行main函数。

以下是完整代码

from selenium import webdriver
from selenium.webdriver.edge.service import Service
from selenium.webdriver.edge.options import Options
import time
import random
import csv
from selenium.common.exceptions import TimeoutException
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from pyquery import PyQuery as pq
import os
import requests
from datetime import datetime
import re

KEYWORD = '美妆'
CSV_FILE = 'DepartmentStore.csv'
id = 3538
dratenums = 5
drate = 5
num = 5

# 创建EdgeOptions对象
options = Options()

# 设置Edge WebDriver的路径
webdriver_path = 'G:\\大三下暑期实训基于电商商品推荐平台\\爬虫\\a\\msedgedriver.exe'
service = Service(webdriver_path)

# 初始化Edge WebDriver
driver = webdriver.Edge(service=service, options=options)

# 窗口最大化
driver.maximize_window()

wait = WebDriverWait(driver, 15)

def search_goods(start_page, total_pages):
    print('正在搜索: ')
    try:
        driver.get('https://www.taobao.com')
        time.sleep(10)
        driver.execute_cdp_cmd("Page.addScriptToEvaluateOnNewDocument",
                               {"source": """Object.defineProperty(navigator, 'webdriver', {get: () => undefined})"""})
        input = wait.until(EC.presence_of_element_located((By.CSS_SELECTOR, "#q")))
        submit = wait.until(
            EC.element_to_be_clickable((By.CSS_SELECTOR, '#J_TSearchForm > div.search-button > button')))
        input.send_keys(KEYWORD)
        submit.click()
        time.sleep(10)

        if start_page != 1:
            driver.execute_script("window.scrollTo(0, document.body.scrollHeight);")
            random_sleep(1, 3)
            pageInput = wait.until(EC.presence_of_element_located(
                (By.XPATH, '//*[@id="root"]/div/div[3]/div[1]/div[1]/div[2]/div[4]/div/div/span[3]/input')))
            pageInput.send_keys(start_page)
            admit = wait.until(EC.element_to_be_clickable(
                (By.XPATH, '//*[@id="root"]/div/div[3]/div[1]/div[1]/div[2]/div[4]/div/div/button[3]')))
            admit.click()

        get_goods()

        for i in range(start_page + 1, start_page + total_pages):
            page_turning(i)
    except TimeoutException:
        print("search_goods: error")
        return search_goods(start_page, total_pages)

def page_turning(page_number):
    print('正在翻页: ', page_number)
    try:
        submit = wait.until(
            EC.element_to_be_clickable((By.XPATH, '//*[@id="sortBarWrap"]/div[1]/div[2]/div[2]/div[8]/div/button[2]')))
        submit.click()
        wait.until(EC.text_to_be_present_in_element(
            (By.XPATH, '//*[@id="sortBarWrap"]/div[1]/div[2]/div[2]/div[8]/div/span/em'), str(page_number)))
        get_goods()
    except TimeoutException:
        page_turning(page_number)

def random_sleep(timeS, timeE):
    random_sleep_time = random.uniform(timeS, timeE)
    time.sleep(random_sleep_time)

def scroll_smoothly(duration):
    total_height = driver.execute_script("return document.body.scrollHeight")
    viewport_height = driver.execute_script("return window.innerHeight")
    steps = 30  # 分成30步
    step_duration = duration / steps  # 每步的时间
    step_height = (total_height - viewport_height) / steps  # 每步的高度

    for i in range(steps):
        driver.execute_script(f"window.scrollBy(0, {step_height});")
        time.sleep(step_duration)

def get_goods():
    global id, drate, dratenums, num  # 声明使用全局变量 id
    random_sleep(2, 4)
    # 滑动浏览器滚轮,向下滑动
    scroll_smoothly(4)
    random_sleep(4, 4)  # 等待页面加载
    html = driver.page_source
    doc = pq(html)
    items = doc(
        'div.PageContent--contentWrap--mep7AEm > div.LeftLay--leftWrap--xBQipVc > div.LeftLay--leftContent--AMmPNfB > div.Content--content--sgSCZ12 > div > div').items()

    for item in items:
        title = item.find('.Title--title--jCOPvpf span').text()
        price_int = item.find('.Price--priceInt--ZlsSi_M').text()
        price_float = item.find('.Price--priceFloat--h2RR0RK').text()
        if price_int and price_float:
            price = float(f"{price_int}{price_float}")
        else:
            price = 0.0
        deal = item.find('.Price--realSales--FhTZc7U').text()
        location = item.find('.Price--procity--_7Vt3mX').text()
        shop = item.find('.ShopInfo--TextAndPic--yH0AZfx a').text()
        postText = item.find('.SalesPoint--subIconWrapper--s6vanNY span').text()
        result = 1 if "包邮" in postText else 0
        image = item.find('.MainPic--mainPicWrapper--iv9Yv90 img').attr('src')
        # 图片的URL
        image_url = image
        pattern = r"https:\/\/.*?\.jpg"

        match = re.search(pattern, image_url)
        if match:
            print("Extracted URL:", match.group(0))
        else:
            print("No match found")
        image_url = match.group(0)

        # 保存图片的文件夹
        save_folder = "shopping_cover"

        # 确保保存路径存在
        if not os.path.exists(save_folder):
            os.makedirs(save_folder)

        # 将图片文件名固定为 '1.jpg'
        image_name = str(id) + ".jpg"

        # 完整的保存路径
        save_path = os.path.join(save_folder, image_name)

        # 获取当前日期
        current_date = datetime.now()

        # 格式化日期为 'yyyy-mm-dd'
        formatted_date = current_date.strftime('%Y-%m-%d')

        imdblink = item.find('.Card--doubleCardWrapper--L2XFE73 a').attr('href')

        # 下载图片并保存
        try:
            with requests.get(image_url, stream=True) as response:
                response.raise_for_status()
                with open(save_path, 'wb') as f:
                    for chunk in response.iter_content(chunk_size=8192):
                        if chunk:  # filter out keep-alive new chunks
                            f.write(chunk)
            print(f"图片已保存到: {save_path}")
            product = {
                'id': id,
                'name': title,
                'director': shop,
                'country': location,
                'years': formatted_date,
                'leader': price,
                'd_rate_nums': dratenums,
                'd_rate': drate,
                'intro': deal + str(result),
                'num': num,
                'orign_image_link': image,
                'image_link': save_folder + '/' + image_name,
                'imdb_link': imdblink
            }
            save_to_csv(product)
            id += 1
        except requests.RequestException as e:
            print(f"下载图片失败:{e}")

        # 直接滑动浏览器滚轮到最顶部
        driver.execute_script("window.scrollTo(0, 0);")

def save_to_csv(result):
    try:
        with open(CSV_FILE, mode='a', newline='', encoding='utf-8') as file:
            writer = csv.writer(file)
            writer.writerow([result['id'], result['name'], result['director'], result['country'], result['years'], result['leader'], result['d_rate_nums'], result['d_rate'], result['intro'], result['num'], result['orign_image_link'], result['image_link'], result['imdb_link']])
        print('存储到CSV成功: ', result)
    except Exception as e:
        print('存储到CSV出错: ', result, e)

def main():
    try:
        # 检查文件是否存在,如果不存在则创建并写入标题行
        if not os.path.exists(CSV_FILE):
            with open(CSV_FILE, mode='w', newline='', encoding='utf-8') as file:
                writer = csv.writer(file)
                writer.writerow(['id', 'name', 'director', 'country', 'years', 'leader', 'd_rate_nums', 'd_rate', 'intro', 'num', 'orign_image_link', 'image_link', 'imdb_link'])

        pageStart = int(input("输入您想开始爬取的页面数: "))
        pageAll = int(input("输入您想爬取的总页面数: "))
        search_goods(pageStart, pageAll)
    except Exception as e:
        print('main函数报错: ', e)

if __name__ == '__main__':
    main()

这份完整版的代码已经上传至CSDN官方,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费获取【保证100%免费】。
在这里插入图片描述

原创: 慕仙少白

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/898824.html

如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!

相关文章

VMware中Ubuntu安装

VMware官网:https://www.vmware.com/products/desktop-hypervisor/workstation-and-fusion 先在官网下载VMware,一直根据默认点下一步就好了,记得更改安装地址哦,否则默认下在C盘里。 先下载好Ubuntu映像文件:https://…

[电子科大]王丽杰 离散数学 第二讲 特殊集合和集合间关系 笔记

1.2 特殊集合与集合间关系 空集 不含任何元素的集合叫做空集(empty set),记作∅. 空集可以符号化为 ∅ { x ∣ x ≠ x } ∅ \{ x|x ≠ x\} ∅{x∣x​x} . 空集是绝对唯一的。 全集 针对一个具体范围,我们考虑的所有对象的集合叫做全集(universal …

JMeter模拟并发请求

PostMan不是严格意义上的并发请求工具,实际是串行的,如果需要测试后台接口并发时程序的准确性,建议采用JMeter工具。 案例:JMeter设置20个并发卖票请求,查看后台是否存在超卖的情况 方式一:一共10张票&…

视觉分析在烟火检测中的应用

随着城市化进程的加快,烟火安全问题日益突出。传统的烟火检测方式依赖人工巡查和基础传感器,容易受到人为因素和环境条件的影响,导致检测效率低下和误报率高。为了解决这一问题,烟火检测算法的引入为我们提供了一种全新的解决方案…

前端根据某数组是否有数据渲染按钮

代码:React TypeScript 由于这个data可能是undefined,所以报错了,问了chatgpt,可以进行的检查方式有以下几种: 1、使用可选链 或者这样写: 我个人比较喜欢用第二种,因为比较简洁 2、类型守卫…

python中使用库pandas来创建excel表格

先需要pip或者conda下载这个pandas 源码如下: import pandas as pdsList_1 [1,2,3,4,5] List_2 [软件,硬件,结构,产品经理,项目经理] List_3 [杭州,南京,河南,合肥,成都] List_4 [21,22,23,24,25] List_5 [2000,3000,1400,1500,2000]TitleData { # 用字典设…

KUKA机器人选定程序时提示“选择非法”的处理方法

KUKA机器人选定程序时提示“选择非法”的处理方法 如下图所示,选中某个程序,点击选定时, 系统提示:选择非法, 具体处理方法可参考以下内容: 选中该程序后,在右下角打开【编辑】菜单键,再选择【属性】,打开后可以看到程序的一般说明、信息模块和参数等信息,如下图所示…

ERP、SCM与CRM:三大系统的区别与整合策略

ERP(企业资源规划)、SCM(供应链管理)和CRM(客户关系管理)系统的关系与区别可以概括为:ERP整合企业内部资源和流程,SCM优化供应链环节,CRM关注客户关系和销售管理。这三个…

[前端] ✨【如何用课程设计提升工程能力?】✨笔记

✨【如何用课程设计提升工程能力?】✨ 📚 课程设计真的在语言工具类课程中占据了“C位”!👑设计得好的课程简直像一个实战训练营,既能帮助学生巩固理论,又能培养解决复杂问题的能力,还能让他们…

13_渲染器的设计

目录 渲染器与响应式系统的结合渲染器的基本概念自定义渲染器 渲染器与响应式系统的结合 渲染器与响应式系统是相辅相成的,渲染器负责将响应式系统中的响应式数据渲染到视图中,而响应式系统则负责监听数据的变化并通知渲染器进行更新。 渲染器在浏览器…

第13篇:无线与移动网络安全

目录 引言 13.1 无线网络的安全威胁 13.2 无线局域网的安全协议 13.3 移动通信中的安全机制 13.4 蓝牙和其他无线技术的安全问题 13.5 无线网络安全的最佳实践 13.6 总结 第13篇:无线与移动网络安全 引言 无线和移动网络的发展为我们的生活带来了极大的便利…

爱快路由器配置腾讯云动态域名DDNS详细说明

直白点说就是让爱快路由器自动配置当前公网IP地址给域名,动态域名DDNS不清楚的请自行百度, 这里就可以看见操作日志,那么我们一步一步来配置它吧,首先登录爱快路由器,如下图: 那么腾讯云我们怎么找到ID和…

使用python自制桌面宠物,好玩!——枫原万叶桌宠,可以直接打包成exe去跟朋友炫耀。。。

大家好,我是小黄。 今天我们使用python实现一个桌面宠物。只需要gif动态图片就行。超级简单容易上手。 #完整源代码可在下方图片免费获取 一:下载相关的库文件。 我们本次使用到的库文件为:tkinter和pyautogui 下载命令: pip…

做一个简单的图片验证码生成,避免被 ai 简单识别出文本

做一个简单的图片验证码生成,避免被 ai 简单识别出文本 缘由腾讯云的收费标准网易的收费标准 编写一个图片验证码生成c# 示例 缘由 在很多场合,我们会对用户进行一个真实性人工验证,避免各种注册机、机器人之类的,对我们的正常工…

力扣143.重排链表

通过画图分析,可以从反转后链表与原链表中按顺序各自取一个结点来构建结果,不过要注意的这两个链表只会用到一半,结合 链表的中间结点 和 反转链表 进行解题。 /*** Definition for singly-linked list.* struct ListNode {* int val;* …

nginx在access日志中记录请求头和响应头用作用户身份标识分析

在应用系统中,有时将请求的用户信息和身份认证信息放到请求头中,服务器认证通过后,通过cookie返回客户端一个标识,在后续的请求时,客户端需要带上这个cookie,通过这个cookie,服务器就知道请求的…

如何将数据从 AWS S3 导入到 Elastic Cloud - 第 2 部分:Elastic Agent

作者:来自 Elastic Hemendra Singh Lodhi 了解将数据从 AWS S3 提取到 Elastic Cloud 的不同选项。 这是多部分博客系列的第二部分,探讨了将数据从 AWS S3 提取到 Elastic Cloud 的不同选项。 在本博客中,我们将了解如何使用 Elastic Agent…

【C++】进阶:类相关特性的深入探讨

⭐在对C 中类的6个默认成员函数有了初步了解之后,现在我们进行对类相关特性的深入探讨! 🔥🔥🔥【C】类的默认成员函数:深入剖析与应用(上) 【C】类的默认成员函数:深入剖…

Linux基础知识和常用基础命令

家目录 每个用户账户的专用目录。家目录的概念为用户提供了一个独立的工作空间,它是用户在文件系统中的主要工作区域,包含了用户的个人文件、配置文件和其他数据。 家目录通常位于 /home/用户名 路径下。例如,如果用户名为 1,那…

[Windows] 很火的开源桌面美化工具 Seelen UI v2.0.2

最近,一款来自Github的开源桌面美化工具突然在网上火了起来,引发了大家的关注,不少小伙伴纷纷开始折腾了起来。而折腾的目的,无非是为了一点点乐趣而已,至于结果如何,并不是最要紧的,反倒是体验…