前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >小案例(五):销量预测(python)

小案例(五):销量预测(python)

作者头像
三猫
发布2018-04-10 11:24:51
3.3K1
发布2018-04-10 11:24:51
举报

案件回顾

饭团销售额下滑

  1. 现有冰激凌店一年的历史销售数据
  2. 数据包括单日的销售量、气温、周几(问题:如何用这些数据预测冰激凌的销量?)
  • 模拟实验与分析

将数据存储为csv格式,导入python。并画出散点图,观察气温和销售量的关系。

import pandas as pd icecream = pd.read_csv("icecream.csv") import matplotlib.pyplot as plt import pylab plt.rcParams['font.sans-serif'] = ['SimHei'] plt.scatter(icecream.iloc[:,1],icecream.iloc[:,0]) plt.xlabel("气温") plt.ylabel("销售量") pylab.show()

计算两者间的相关系数。

icecream.iloc[:,0:2].corr()

结果为:

销售量

气温

销售量

1.000000

0.844211

气温

0.844211

1.000000

销售量和气温的相关系数为0.84,结合散点图,认为两者相关。下面用回归分析的方法,通过气温来预测冰激凌销量。

from sklearn.linear_model import LinearRegression model = LinearRegression() feature_cols = ['气温'] X = icecream[feature_cols] y = icecream.销售量 model.fit(X,y) plt.scatter(icecream.气温, icecream.销售量) plt.plot(icecream.气温, model.predict(X) , color='blue') plt.xlabel('气温') plt.ylabel('销售量') plt.show() print("截距与斜率:",model.intercept_,model.coef_)

截距与斜率: 57.1673282152 [ 5.21607823]

于是,散点图中的线函数式为y=5.2X+57.2。所以,当气温为25度时,预测的销售量为5.2*25+57.2=187.52,约188个。

  • 几个小概念

回归分析:预测数据时的简便手法。在此例中,销售量为反应变量,也叫因变量,气温为解释变量,也叫自变量。虽然影响销售量的因素除了气温外还有很多,但回归分析中我们要把现实情况简化并公式化,这个过程叫做建模。本例中只用1个解释变量进行模型化称为一元线性回归,如果反应变量同时受到多个解释变量的影响,称为多元线性回归。

后台回复“冰激凌”,可获得本例中数据


机器学习养成记

本文参与 腾讯云自媒体分享计划,分享自微信公众号。
原始发表:2017-09-17,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 机器学习养成记 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
相关产品与服务
数据保险箱
数据保险箱(Cloud Data Coffer Service,CDCS)为您提供更高安全系数的企业核心数据存储服务。您可以通过自定义过期天数的方法删除数据,避免误删带来的损害,还可以将数据跨地域存储,防止一些不可抗因素导致的数据丢失。数据保险箱支持通过控制台、API 等多样化方式快速简单接入,实现海量数据的存储管理。您可以使用数据保险箱对文件数据进行上传、下载,最终实现数据的安全存储和提取。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档