NBA体育决策和数据挖掘分析

news2025/1/21 9:27:06

 业务挑战

体育运用大数据主要体现在以下三个方面: 预测比赛结果和奖牌归属;更好地训练运动员 。数据和模型驱动体育决策让获胜和成功变得更有可能,体育统计(Sports Analytics)成为体育竞争的“杀手锏”。最近我们被客户要求撰写关于体育统计的研究报告,包括一些图形和统计输出。

具体服务

要在运动中有效地使用分析,我们要知道如何处理数据、识别数据源、收集数据、组织和准备进行分析、从数据构建模型。

 从面向体育组织的咨询工作中,推动“数据科学即服务”。最终,实施我们的想法和模式。

数据源准备

随着网络的发展,数据来源丰富,有文本数据以及数字数据。通过爬虫技术抓取网络并利用应用程序编程接口(API),可以从公共数据源中获取很多信息。

构造

想要更好地了解在这些场景中大数据是如何进行预测性分析的,我们需要考虑在预测比赛时所需处理的数据性质。

首先确定关键指标,可用数据包括国别、赛事、成绩、运动员姓名、年龄、过往表现记录、赛场温度、观众出席率、昼夜等。

划分训练集和测试集

确定指标后,把数据分成两个子数据集,即训练数据集和测试数据集。

数据洞察

球员薪酬情况

职业运动队在劳动力市场上相互竞争,而明星球员的劳动力供不应求。薪资上限是保持竞争平衡所必需的,工资也帮助球队限制球员的支出。

美国最专业的运动员有薪资上限。NFL队的2016年薪金上限为5328万美元,平均工资约为270万美元。NBA球队在16赛季的薪金上限为7000万美元,球队的薪金上限以服务年限。例如,拥有十年经验的勒布朗·詹姆斯,最高工资为2300万美元。安东尼·戴维斯的平均工资为2900万美元,是NBA球员中最高的 。2016年MLB的年薪最低为505,700美元。底特律老虎队Miguel Cabrera(MLR)的MLB年薪最高为3100万美元。

下图显示了2016年8月MLB,NBA和NFL的球员薪酬情况。

【大数据部落】NBA体育决策和数据挖掘分析

【大数据部落】NBA体育决策和数据挖掘分析

【大数据部落】NBA体育决策和数据挖掘分析

【大数据部落】NBA体育决策和数据挖掘分析

NFL球员的平均工资约为170万美元,中位数为63万美元。 NBA球员的平均工资约为510万美元,中位数为280万美元。 MLB玩家的平均工资约为410万美元,中位数为110万美元。同时可以看到明星球员的薪资远高于普通球员,拉高了平均水平。

团队支出和胜率的关系

【大数据部落】NBA体育决策和数据挖掘分析

从2016赛季初的团队支出和在常规赛中胜率的关系图中,我们可以看到团队支出对是否能赢得比赛有直接影响。

出席观众和日期的关系

【大数据部落】NBA体育决策和数据挖掘分析

从中我们可以发现日期和出席情况的关系,从而找到用于预测和评估出席率的模型。

球队实力表现

根据15年到16年NBA常规赛的20项指标进行综合分析,我们对 NBA参赛球队进行排序,评出最具实力的球队。

【大数据部落】NBA体育决策和数据挖掘分析

建模

预测观众出席人数——线性模型

【大数据部落】NBA体育决策和数据挖掘分析

估计获胜概率——蒙特卡罗模拟

当我们发现胜率符合经验分布的时候,使用蒙特卡罗模拟方法来估计某个队伍的获胜概率。

【大数据部落】NBA体育决策和数据挖掘分析

预测结果

【大数据部落】NBA体育决策和数据挖掘分析

可以看出,预测值的趋势已经基本与真实趋势保持一致。

模拟结果

通过对比赛日双方球队的表现模拟,我们得到下面的获胜概率热图,从ROC曲线的表现来看,模拟效果理想。

【大数据部落】NBA体育决策和数据挖掘分析

【大数据部落】NBA体育决策和数据挖掘分析

展望

除了以上列举的一些方法, 已经在尝试更复杂的体育统计模型,如深度学习(Long Short-Term Memory网络、卷积神经网络(CNN))等;同时需要考虑到模型的可解释性、可落地性和可扩展性、避免“黑箱”预测;还在尝试采用混合的机器学习模型,比如GLM+SVR,GAM+ NNET等。

用数据驱动体育决策,这种看待体育的独特视角让我们能更好地察觉趋势、选取角度,同时帮助体育爱好者更深入地理解他们喜爱的运动队。


本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/43783.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

鲲鹏devkit性能分析工具介绍(一)

鲲鹏devkit性能分析工具介绍(一) 鲲鹏性能分析工具由四个子工具组成,分别为:系统性能分析、Java性能分析、系统诊断和调优助手。 系统性能分析是针对基于鲲鹏的服务器的性能分析工具,能收集服务器的处理器硬件、操作…

从2022安洵杯[babyPHP]看Soap+CLRF造成SSRF漏洞

提示:文章写完后,目录可以自动生成,如何生成可参考右边的帮助文档 目录 前言 一、PHP SOAP 二、漏洞成因 三、 题目知识准备 1、PHP Session反序列化 2、题目相关函数 四、[LCTF 2018]bestphps revenge 五、2022安洵杯 BabyPHP 前言 …

基于ASP.net的服装商城设计

目录 海秀衣城系统 2 1.概 述 2 1.1 网上购物的发展 2 1.2 三层架构技术简介 2 2. 系统总体设计 4 2.1 开发以及运行环境 4 2.2项目结构分析 4 2.3系统功能总体结构图 5 2.4系统功能结构分解图 5 3. 数据库设计 6 3.1 数据库设计 6 3.2 数据表 7 4. 模块设计 10 4.1 前端功能模…

SpringCloud微服务实践之七 网关(Gateway)

一、网关基本概念 (一)网关功能 身份认证和权限校验服务路由、负载均衡请求限流 (二)网关技术选型 SpringCloud提供了两个组件都可以实现网关功能: gatewayzuul 其中,Zuul是基于Servlet的实现&#xff…

SQL注入漏洞 | 数字型

文章目录前言MySQL 数字型前言 SQL注入漏洞 | iwebsec MySQL 数字型 页面观察:测试看回显 注入点判断:发现有sql注入漏洞 AND 可在 where 子语句中把两个或多个条件结合起来。如果第一个条件和第二个条件都成立,则 AND 运算符显示一条记录…

HBuilder X实现tabBar底部导航记录

首先,打开uniapp官网,找到tarbar官方文档,仔细阅读,具体位置如下,全局配置下面的pages.json页面路由里面找到tabBar,点击查看: 重点注意这两句话: 找到文档我们就可以按照上面的提示…

迭代器模式(Iterator)

参考: 迭代器设计模式 (refactoringguru.cn) [design-patterns-cpp/Iterator.cpp at master JakubVojvoda/design-patterns-cpp GitHub 文章目录一、什么是迭代器模式?二、实现三、优缺点优点缺点一、什么是迭代器模式? 提供一种方法&…

QFont-使用外部字体文件的问题

我们程序里面定义了某个结构体(这里简单描述为AStruct),AStruct包含了一个QFont 类型的成员变量: struct AStruct {QFont ft; }; 在具体业务上,AStruct中的QFont会被传递给QPainter去绘制文本。 保存工程/加载工程时时&#xff0…

用Python写个爬虫,赚了!

前言 编程语言排行榜(Tiobe)发布了11月新榜,Python仍领先Java和C,在全球众多的老牌编程语言中,以其他对手无法企及的极高份额稳居榜单第一位。 榜单数据是客观真实的,当下Python的使用者越来越多,已经远超使用其他十…

【Linux初阶】认识冯诺依曼结构

🌟hello,各位读者大大们你们好呀🌟 🍭🍭系列专栏:【Linux初阶】 ✒️✒️本篇内容:计算机的冯诺依曼组成结构、冯诺依曼结构的数据交换特性,以宏观视角理解冯诺依曼下的网络数据传输…

Spring Cloud Alibaba 容器化部署最佳实践 | 本地部署版本详解

环境声明 在运行本地示例之前,需要保证本机具备以下的基础环境,如果您的本地没有当前的环境,下面会一步步进行搭建,演示搭建过程。 Nacos 服务端Seata 服务端RocketMQ 服务端MySQL 服务端 可在国内https://gitee.com/mirrors/S…

低代码在离散制造业的实践

大家上午好,非常感谢明道云给我这个机会,来展示一下这个上海电气在明道云上面的应用。我的题目是《低代码在离散制造业的实践》。 引入明道云的背景 首先介绍一下我们电气数字科技有限公司。它是在2018年的时候,上海电气集团内部成立的数科…

捷码全新快速表单功能解读

在最近的更新中,捷码迎来了比较多的功能上新,其中最受大家关注的是全新的表单功能。无论是从功能丰富度还是操作便利性上都做了大量设计。本文将从重点功能设置操作流程上进行演示说明。 表单控件和关联 ——1对1、1对n、n对n 支持多场景 首先是表单控…

航空货运数据挖掘那些事|航班换季

目录前言航班换季航班换季对航空货运业务有哪些影响参考文献前言 就在上个月月底,即2022年10月29日到2022年10月30日,中国民航完成了2022年的夏秋季航季到2022/23年冬春航季切换工作,俗称航班换季,那么何为航班换季呢&#xff0c…

流媒体传输 - RTMP 协议

RTMP 是 Real Time Messaging Protocol(实时消息传输协议)的首字母缩写。它是由 Adobe 公司提出的一种应用层的协议,用来解决多媒体数据传输流的多路复用(Multiplexing)和分包(packetizing)的问…

氨基苯酚/多巴胺仿生修饰碳纳米管/α-氧化铝/ CNTs-Ag纳米复合材料

小编下面和大家来看间氨基苯酚/多巴胺仿生修饰碳纳米管/α-氧化铝/ CNTs-Ag纳米复合材料的制备! 多巴胺仿生修饰材料的研究: 通过表面聚多巴胺层与银离子的螯合作用,通过表面聚多巴胺与银离子的螯合作用,利用葡萄糖作还原剂,在聚多巴胺修饰的聚酯纤维表…

HarmonyOS应用API手势方法-PanGesture

描述:用于触发拖动手势事件,滑动的最小距离为5vp时拖动手势识别成功。 Api:从API Version 7开始支持 接口: PanGesture(value?: { fingers?: number; direction?: PanDirection; distance?: number } | PanGestureOptions)…

IT6225/IT6225B Type-C转HDMI 4K60设计方案

ITE(新联阳)的IT6225/IT6225B,是一款Type-C转HDMI 460K的视频转换芯片 通过USB Type-C连接器将DP RX视频信号转换为HDMI/DVI TX视频信号。DP信号转接只用2lane,另外2lane可以输出USB 3.0/3.1信号,同时兼容PD 3.0&…

Zabbix自动监控windows端口(主动监控方式)

第一部分:服务器上的操作(脚本&配置) 创建脚本文件 在客户端新建discovertcpport.bat文件,放在C:\Program Files\Zabbix Agent目录中,内容如下: echo off echo { echo "data":[ f…

[附源码]计算机毕业设计springboot创意摄影交流平台

项目运行 环境配置: Jdk1.8 Tomcat7.0 Mysql HBuilderX(Webstorm也行) Eclispe(IntelliJ IDEA,Eclispe,MyEclispe,Sts都支持)。 项目技术: SSM mybatis Maven Vue 等等组成,B/S模式 M…