您现在的位置是:首页 > IT基础架构 > 软件与服务 >

利用三类工具实现BI落实需求的支撑力

2009-09-08 15:41:00作者: 来源:

摘要商业智能(后面简称BI)的各类角色用户必须借助和使用工具实现其需求。BI角色分为业务、业务融合技术、技术这三类,对于其相应的应用需求(含演绎型和归纳型)和管控开发需求,需要借演绎型需求支撑工具和归纳型需求支撑工具,及管控开发型工具来予以实现。...

商业智能(后面简称BI)的各类角色用户必须借助和使用工具实现其需求。BI角色分为业务、业务融合技术、技术这三类,对于其相应的应用需求(含演绎型和归纳型)和管控开发需求,需要借演绎型需求支撑工具和归纳型需求支撑工具,及管控开发型工具来予以实现。本篇先讲述演绎型需求支撑的7种工具,其可分为描述统计工具、经营技术与方法、经济预测方法与模型、OLAP分析、知识发现工具、专家系统以及决策方法与模型。管控开发支持型工具一般包括系统管理工具、开发工具;

笔者认为BI以认识论和组织理论为基本原理,采取相适宜的“工具”,旨在帮助 “相关角色”对职责范围内的“有关内容”做出最佳决定的整体解决方案。它由“三维模式”和“三层漏斗”组成,是辅助整个企业集理念,组织,流程,技术为一体的整体决策支持方案(详细内容见http://www.amteam.org/column/18.html  《商业智能(BI)的三维框架----商业智能的“操作性和提升性”转换》)。三维模式由角色维、内容维和工具维构成,体现了BI的主体、客体和工具等一般性原理。根据BI的定义,只有清晰划分相关角色并据以确定需求,并借助工具才能实现BI辅助主体对职责范围的有关事项做出最佳决定的宗旨。

BI的业务类角色、技术类角色以及业务融合技术类角色(详见《商业智能(BI)角色维探讨-----三维框架的分解》 http://www.amteam.org/column/18.html  ),对应存在着业务应用需求(指业务类的演绎型需求和业务融合技术类的归纳型需求)和技术应用需求,即管控开发型需求。这种需求能否得以有效实现和提升,必须借助工具。针对三大类角色的两种需求,BI的工具分为应用型支撑型工具和管控开发支持型工具。鉴于文章的范围,硬件支撑工具的内容请参见相关书籍。

应用支撑工具可以分为描述统计工具、经营技术与方法、经济预测方法与模型、OLAP分析、知识发现工具、专家系统以及决策方法与模型。管控开发支持型工具一般包括系统管理工具、开发工具。一般来说,这些工具以软件包的形式形成产品。鉴于BI对于业务应用的重要作用及业务应用成功对BI的重要意义,本文着重分析BI的应用型支撑工具,并对有关产品作简单介绍。

一、实现演绎型需求的7种工具

BI的演绎型内容可以分为三个层次:报表查询、综合分析、决策选择( http://www.amteam.org/column/18.html  见《商业智能的内容维探讨》)。如下图所示,BI的演绎型需求通过描述性统计工具、报表与展示工具、经济预测方法与模型、经营技术与工具、OLAP分析及专家系统工具、决策方法与模型来实现。

上图中,描述性统计工具帮助用户在报表查询层次实现对事实的充分了解;综合分析以逻辑的方式帮助相关主体寻求原因或对简单问题直接获得建议,需要运用经济预测方法与模型、经营技术与工具及OLAP分析来得以实现。专家系统和决策方法与模型是实现定量和部分定性决策的有力工具。通过该类工具,用户在决策选择时通过评价各个方案的优劣来辅助主体选择最优,得出结论。BI 演绎型应用的三层次结构合理、有步骤地解决了前提、逻辑规则和结论这一演绎型思维方法的迁移应用。

(一)描述性统计工具

统计的基本意义在于利用统计指标,通过指标值的对比关系和发展变化来研究社会经济现象的数量和数量关系,表明其变化发展的过程、结果及其规律。作为统计学两大基本内容之一的描述性统计是整个统计学的基础和统计研究工作的第一步,它包括数据的收集、整理、显示,对数据中有用信息的提取和分析,而对变量的集中趋势和离中趋势的分析则是其主要内容。描述性统计工具指为实现相关主体对基本事实了解的需求而需利用基本指标。这些基本统计指标包括总量指标、相对指标、平均指标和变异指标。

总量指标:表明具体社会经济现象总体的规模、水平或工作总量的数值,是计算各种派生指标的基础。如某集团公司年销量即是总量指标。它可分为总体单位总量、总体标志总量和时期总量(如某个事业部门的总销量)、时点总量(如月末库存)。总量指标可通过直接计算和间接计算求出。

相对指标:表明两个互有联系的社会、经济现象之间数量对比关系的统计指标。如竞争企业之间库存周转率的对比,或行业内某企业销量与行业总销量的对比等等;常用的同比和环比也是相对指标的运用。相对指标反映了社会经济现象的实质及其数量的对比关系,从现象间数量对比关系中清晰地认识事物 。其次,可使原来无法直接比较的现象,找到共同的基础进行科学地对比分析。相对指标又包括:计划完成程度指标、结构相对指标(高中低档产品利润在全部利润中的各自占比)、比例相对指标(产品A与产品B的对比)、比较相对指标(某企业销量增长率与竞争企业销量增长率的对比)、强度相对指标(如烟草行业销售情况中条/人指标的对比)、动态相对指标(如历年的销售额的比较)。运用时,要正确选择对比的基数、确定可比的对比指标、相对指标要与对比基数结合使用。

平均指标:反映同质总体内各单位某一数量标志的一般水平,可以对比总体的一般水平,如分公司年平均销量与总公司平均销量的对比,可以进行数量上的推算和预测。平均指标有算术平均数、调和平均数(较少用,主要用于已知标志总量而不知单位总量的情况)、几何平均数(一般用于计算平均发展速度)、众数(一组序列中出现次数最多的数)、中位数(按大小顺序排列的数据中处于中间的数)五种。使用平均数时要与变异指标结合使用,有时需要用组平均数补充总体平均数。

标志变异指标:说明总体各单位某一标志数值差异程度,通过变异指标可以揭示被平均指标掩盖了的差异情况,也可作为衡量平均指标代表性的尺度。可分为:全距、平均差、标准差、标志变异系数。全距是标志值最大值与最小值之差,如2006年某产品在全国各省中最高销量与最低销量之差;平均差是各个标志值与总体算术平均数的离差的绝对值。标准差为各个标志值与总体算术平均数的离差的平方和的正平方根,其值越大表明差异越大,平均值不能很好代表一般水平;标准差与算术平均数的比值称为标志变异系数,用以两个平均数指标不相等时的对比。

描述性统计工具在当前BI的行业应用中非常普遍。值得关注的是,当前一般BI的报表查询应用涉及更多是描述性统计的总量指标、平均指标和比较指标,而对于描述离中趋势的标志变异指标运用得相当不够。事实上,标志变异指标可以解决B I的应用主体很多实质性问题,比如在众多品牌中找到销量不稳定的品牌,在众多客户中找到交易额波动大的客户,这些信息为BI的应用有关主体在研发、生产、采购、销售、库存方面起到较为关键的作用。

(二)报表与展示工具

以报表应用类别区分,BI系统能利用报表与展示工具来生成统计报表和查询报表。查询报表较为简单,根据用户的需求可以较容易地定制。由于中国式统计报表众多的表头项以及表头中首格的一重甚至多种斜线的特征,甚至在表头项中又切分子表头的复杂情况,致使生成统计报表较为困难。国外的BI产品在生成统计报表方面和国内的某些产品相比,如水晶报表,操作过程较繁锁。对于报表的展示,一是产生表格,二是产生与表格对应的图形,如曲线图、柱形图、三维图等。一般来说,要求报表与图形连动。即当报表数据发生变动时,图形跟着变动。或者相反,图形的变动要带来报表数据的变动。这是在钻取时较容易产生的情况。如SAS的Business Intelligence和BO的图形互动功能都能实现此种需求。

报表与展示工具注重实现报表的灵活性,更强调图形展示的美观、图形色彩的模板化定,强调图形种类的多样。这是BI工具的基本功能。前两年大家谈到BI时,更容易评判到某个厂家的BI的界面制作的是否美观等等,这是当时人们对BI应用认识不够造成的。现在厂家在宣传BI时,不仅注重更深层次的综合分析功能和预测、决策功能,更扩大到数据集成与整合,数据存储和元数据管理等全套BI平台上。

 

SAS报表与展示工具:表格与图形的互动

(三)经济预测方法与模型

经济预测方法与模型是统计学中统计推断部分的运用,复杂且灵活。它是BI在综合分析层次上的应用。该方法满足业务类用户展望未来的需求。统计推断一般包括参数估计、假设检验以及分类与选择。经济预测方法是参数估计的应用推广,包含了点估计和参数估计,如某上时间段销量的预测值,或者预测值所处的区间。经济预测模型是在预测方法的指导下,根据行业的实际经过修正后建立的预测模型。

预测方法可分为定量预测和定性预测。定量预测主要分为时间序列预测和回归预测两大类,如下图所示。

 

 

定量的预测方法实战中可以建立很多模式,此处以时间序列预测为主简要介绍经济预测方法与模型的运用。

时间序列预测法是动态分析法的一种运用。动态分析法是在统计研究中,把经济现象在不同时间上的数量进行对比,以了解现象变动的方向、速度、趋势和规律,并据此预测未来的方法。动态趋势分析与预测是动态分析法的重要用途。时间序列是动态分析研究的一个主要方面,其前提是编制时间序列,并形成时间序列预测法。当前时间序列有100种左右的预测方法,但其基本方法一般包括简单平均、移动平均、指数平滑、最小二乘等,可以运用到直线趋势预测和曲线趋势预测方面。时间序列影响时间序列的值变化的四种因素:趋势变动、季节变动、循环变动、不规则变动,循环变动在短期预测中通常不考虑。将这四个因素从时间序列值中分解出来的方法称为分解分析法。如2月份在某地的某品牌白酒销量为60箱,通过分解技术,可获知趋势变动(平均水平与增长势头)的影响值为40,中秋的季节变动影响值为15,但不规则变动影响值是5,所以即销量为60。时间序列预测的基本方法结合上述四种因素并运用到直线预测和曲线预测中,就形成了近100种的具体预测方法,如加权平均,加权移动平均、温特斯法等。温特斯法是以指数平滑法为基本模型,结合季节因素并运用到直线趋势中而形成的季节直线趋势和季节变动指数平滑模型。下图分别是直线趋势和曲线趋势预测的结果。

实战中运用经济预测方法与模型,一方面要根据适用范围和数据状况正确选择预测方法,另一方面也必须要从方法论的角度从整体上考虑预测体系、清晰预测的流程、正确评价预测结果,如此方能实现在实际应用中以预测方法为基础,建立预测模型和调整预测模型。


(本文不涉密)
责任编辑:

站点信息

  • 运营主体:中国信息化周报
  • 商务合作:赵瑞华 010-88559646
  • 微信公众号:扫描二维码,关注我们