广告位联系
返回顶部
分享到

利用python对月饼数据进行可视化(看看哪家最划算)

python 来源:互联网 作者:佚名 发布时间:2022-09-10 07:32:23 人浏览
摘要

前言 中秋节,又称拜月节、月光诞、月夕等,节期在每年的农历八月十五日(九月十)。 中秋节自古以来就有祭月、赏月、吃月饼、玩花灯、赏桂花、饮桂花酒等民俗,流传经久不息

前言

中秋节,又称拜月节、月光诞、月夕等,节期在每年的农历八月十五日(九月十)。

中秋节自古以来就有祭月、赏月、吃月饼、玩花灯、赏桂花、饮桂花酒等民俗,流传经久不息。

马上有临近中秋,这不得好好准备~于是准备对月饼数据进行可视乎

数据

代码

1

2

3

4

# 导包

import pandas as pd

import numpy as np

import re

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

# author:Dragon少年

# 导入爬取得到的数据

df = pd.read_csv("月饼.csv", encoding='utf-8-sig', header=None)

df.columns = ["商品名", "价格", "购买人数", "店铺", "地址"]

# 去除重复的数据

df.drop_duplicates(inplace=True)

print(df.shape)

# 删除购买人数0的记录

df['购买人数'] = df['购买人数'].replace(np.nan,'0人付款')

 

df['num'] = [re.findall(r'(\d+\.{0,1}\d*)', i)[0] for i in df['购买人数']]  # 提取数值

df['num'] = df['num'].astype('float')  # 转化数值型

# 提取单位(万)

df['unit'] = [''.join(re.findall(r'(万)', i)) for i in df['购买人数']]  # 提取单位(万)

df['unit'] = df['unit'].apply(lambda x:10000 if x=='万' else 1)

# 计算销量

df['销量'] = df['num'] * df['unit']

 

# 删除没有发货地址的店铺数据 获取省份

df = df[df['地址'].notna()]

df['省份'] = df['地址'].str.split(' ').apply(lambda x:x[0])

# 删除多余的列

df.drop(['购买人数', '地址', 'num', 'unit'], axis=1, inplace=True)

# 重置索引

df = df.reset_index(drop=True)

df.to_csv('月饼清洗数据.csv')

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

# 导入包

from pyecharts.charts import Bar

from pyecharts import options as opts

 

# 计算月饼总销量Top10的店铺

shop_top10 = df.groupby('店铺')['销量'].sum().sort_values(ascending=False).head(10)

 

# 绘制柱形图

bar1 = Bar(init_opts=opts.InitOpts(width='600px', height='450px'))

bar1.add_xaxis(shop_top10.index.tolist())

bar1.add_yaxis('销量', shop_top10.values.tolist())

bar1.set_global_opts(title_opts=opts.TitleOpts(title='销量Top10店铺-Dragon少年'),

                     xaxis_opts=opts.AxisOpts(axislabel_opts=opts.LabelOpts(rotate=-30)))

bar1.render("销量Top10店铺-Dragon少年.html")

bar1.render_notebook()

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

# 导入包

from pyecharts.charts import Bar

from pyecharts import options as opts

 

# 计算销量top10月饼

shop_top10 = df.groupby('商品名')['销量'].sum().sort_values(ascending=False).head(10)

 

# 绘制柱形图

bar0 = Bar(init_opts=opts.InitOpts(width='750px', height='450px'))

bar0.add_xaxis(shop_top10.index.tolist())

bar0.add_yaxis('销量', shop_top10.values.tolist())

bar0.set_global_opts(title_opts=opts.TitleOpts(title='销量Top10月饼-Dragon少年'),

                     xaxis_opts=opts.AxisOpts(axislabel_opts=opts.LabelOpts(rotate=-30)))

bar0.render("销量Top10月饼-Dragon少年.html")

bar0.render_notebook()

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

32

33

from pyecharts.charts import Pie

 

def price_range(x): #按照淘宝推荐划分价格区间

    if x <= 50:

        return '50元以下'

    elif x <= 150:

        return '50-150元'

    elif x <= 500:

        return '150-500元'

    else:

        return '500元以上'

 

df['price_range'] = df['价格'].apply(lambda x: price_range(x))

price_cut_num = df.groupby('price_range')['销量'].sum()

data_pair = [list(z) for z in zip(price_cut_num.index, price_cut_num.values)]

print(data_pair)

 

 

# 饼图

pie1 = Pie(init_opts=opts.InitOpts(width='750px', height='350px'))

# 内置富文本

pie1.add(

        series_name="销量",

        radius=["35%", "55%"],

        data_pair=data_pair,

        label_opts=opts.LabelOpts(formatter='{b}—占比{d}%'),

)

 

pie1.set_global_opts(legend_opts=opts.LegendOpts(pos_left="left", pos_top='30%', orient="vertical"),

                     title_opts=opts.TitleOpts(title='不同价格月饼销量占比-Dragon少年'))

 

pie1.render("不同价格月饼销量占比-Dragon少年.html")

pie1.render_notebook()

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

from pyecharts.charts import Map

 

# 计算销量

province_num = df.groupby('省份')['销量'].sum().sort_values(ascending=False)

 

# 绘制地图

map1 = Map(init_opts=opts.InitOpts(width='950px', height='600px'))

map1.add("", [list(z) for z in zip(province_num.index.tolist(), province_num.values.tolist())],

         maptype='china'

        )

map1.set_global_opts(title_opts=opts.TitleOpts(title='各省月饼销量分布-Dragon少年'),

                     visualmap_opts=opts.VisualMapOpts(max_=1500000)

                    )

map1.render("各省月饼销量分布-Dragon少年.html")

map1.render_notebook()

效果


版权声明 : 本文内容来源于互联网或用户自行发布贡献,该文观点仅代表原作者本人。本站仅提供信息存储空间服务和不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权, 违法违规的内容, 请发送邮件至2530232025#qq.cn(#换@)举报,一经查实,本站将立刻删除。
原文链接 : https://blog.csdn.net/python56123/article/details/126724068
相关文章
  • Python Django教程之实现新闻应用程序

    Python Django教程之实现新闻应用程序
    Django是一个用Python编写的高级框架,它允许我们创建服务器端Web应用程序。在本文中,我们将了解如何使用Django创建新闻应用程序。 我们将
  • 书写Python代码的一种更优雅方式(推荐!)

    书写Python代码的一种更优雅方式(推荐!)
    一些比较熟悉pandas的读者朋友应该经常会使用query()、eval()、pipe()、assign()等pandas的常用方法,书写可读性很高的「链式」数据分析处理代码
  • Python灰度变换中伽马变换分析实现

    Python灰度变换中伽马变换分析实现
    1. 介绍 伽马变换主要目的是对比度拉伸,将图像灰度较低的部分进行修正 伽马变换针对的是对单个像素点的变换,也就是点对点的映射 形
  • 使用OpenCV实现迷宫解密的全过程

    使用OpenCV实现迷宫解密的全过程
    一、你能自己走出迷宫吗? 如下图所示,可以看到是一张较为复杂的迷宫图,相信也有人尝试过自己一点一点的找出口,但我们肉眼来解谜
  • Python中的数据精度问题的介绍

    Python中的数据精度问题的介绍
    一、python运算时精度问题 1.运行时精度问题 在Python中(其他语言中也存在这个问题,这是计算机采用二进制导致的),有时候由于二进制和
  • Python随机值生成的常用方法

    Python随机值生成的常用方法
    一、随机整数 1.包含上下限:[a, b] 1 2 3 4 import random #1、随机整数:包含上下限:[a, b] for i in range(10): print(random.randint(0,5),end= | ) 查看运行结
  • Python字典高级用法深入分析讲解
    一、 collections 中 defaultdict 的使用 1.字典的键映射多个值 将下面的列表转成字典 l = [(a,2),(b,3),(a,1),(b,4),(a,3),(a,1),(b,3)] 一个字典就是一个键对
  • Python浅析多态与鸭子类型使用实例
    什么多态:同一事物有多种形态 为何要有多态=》多态会带来什么样的特性,多态性 多态性指的是可以在不考虑对象具体类型的情况下而直
  • Python字典高级用法深入分析介绍
    一、 collections 中 defaultdict 的使用 1.字典的键映射多个值 将下面的列表转成字典 l = [(a,2),(b,3),(a,1),(b,4),(a,3),(a,1),(b,3)] 一个字典就是一个键对
  • Python淘宝或京东等秒杀抢购脚本实现(秒杀脚本

    Python淘宝或京东等秒杀抢购脚本实现(秒杀脚本
    我们的目标是秒杀淘宝或京东等的订单,这里面有几个关键点,首先需要登录淘宝或京东,其次你需要准备好订单,最后要在指定时间快速
  • 本站所有内容来源于互联网或用户自行发布,本站仅提供信息存储空间服务,不拥有版权,不承担法律责任。如有侵犯您的权益,请您联系站长处理!
  • Copyright © 2017-2022 F11.CN All Rights Reserved. F11站长开发者网 版权所有 | 苏ICP备2022031554号-1 | 51LA统计