文档章节

互联网金融正面临的挑战:大数据

 数据分析师
发布于 2016/05/26 23:49
字数 1608
阅读 2
收藏 0

一、大数据信息有效性不足

虽然信息时代使得人们面对的信息规模扩大和沟通效率提高, 但是这并不意味着有价值的数据信息获取就变得更加迅捷和容易。

首先,有价值的数据信息获取面临挑战。网络信息资源在扩大人们信息来源渠道和提高信息获取效率的同时,也不可避免的会促使人们遭受大量虚假、无用数据信息的困扰。信息大爆炸造成的信息环境污染和“噪音信息”的蔓延增加了人们识别、判定和利用有效信息的困难。

大数据

其次,有价值的数据信息整合面临挑战。使用大数据面临的一大挑战就是如何将社会经济各个主体之间的数据信息能够方便和有效地整合在一起。要想让大数据更有效地服务于人类社会,就必须将存在于社会各个主体中多种格式的海量数据通过统一的数据格式构建融合人、机、物三元世界的统一信息系统。最后,有价值的数据信息生成存在算法演化问题。在现实中,大数据往往是根据各个社会经济主体行为被动产生的,但是数据生成者的商业模式等行为会影响大数据的生成机制,导致其提供的信息不具有时间前后的可比性。以谷歌公司为例,其商业模式的主要目标是更快速地为使用者提供准确的信息。为此,谷歌不断改进搜索算法,使用者可以通过后续谷歌推荐的相关词快捷地获得有用信息。这一模式改变了数据生成机制,容易出现数据使用者搜索的关键词并非其本意的现象。

二、大数据样本选择困难

人们希望通过海量数据信息的收集减少信息不对称,但是这些庞大的数据可能对我们解决问题并不会起到正面的作用。当前,大数据使企业或者机构获取每一个客户的信息、构建客户群的总体数据成为可能。但是,这种大数据并不一定就是我们所要研究对象的全部数据总体。如果我们误将掌握的海量数据当作所要研究对象的数据总体,那么基于大数据分析得出的结论就很有可能是错误的。因此,在分析和研究某个问题时,我们不能迷信大数据的作用。

以“谷歌流感趋势”(GFT) 项目为例,2008 年11 月谷歌公司启动该项目,目标是预测美国疾控中心(CDC) 报告的流感发病率。2009 年,GFT 团队在《自然》杂志发表文章报告,只需分析数十亿搜索中45 个与流感相关的关键词,GFT 就能比CDC 提前两周预报2007-2008 季流感的发病率。但是,2014 年美国《科学》杂志报道,2009 年GFT 没有能预测到非季节性流感A-H1N1;从2011 年8 月到2013 年8 月的108 周里,GFT 有100 周高估了CDC 报告的流感发病率。其中,2011-2012 季期间,GFT 预测的发病率是CDC 报告值的1.5 倍多;2012-2013 季期间,GFT 流感发病率是CDC 报告值的2 倍多。另外,2007 年美国爆发的次贷危机也是一个例证。自20 世纪90 年代起, 美国无论是抵押贷款和信用卡的申请还是资产证券化产品的定价和评级,都是建立在较为成熟的大数据基础上的。但是,金融机构仍然做出了系统性错误的金融决策,成为金融危机爆发的导火索。

三、大数据数据处理技术更新缓慢

大数据虽然可以通过扩大数据样本规模和提升数据处理能力来管理日常经营性的风险,但是代表金融创新风险等未来事件是无法用历史数据进行预测和分析的。

首先,大数据处理技术面临数据生成者学习行为的挑战。大数据处理技术和评估标准影响数据生成者行为,同样数据生成者行为也会影响大数据处理技术和评估标准。以我国大数据重要来源之一的社交媒体为例,这种大数据来源的有效性是有前提条件的,即人们在社交媒体分享的信息都是真实的、自发的、不受大数据处理技术和各种评估标准的影响。但是,人们在互联网时代运用网络学习的能力是不断提高的。如果人们通过学习大数据处理技术和各种评估标准而相应改变社交媒体的信息,就会导致大数据生成机制发生质变。因此,在对大数据进行技术处理时,简单地认为数据生成者都是无意识地生产大数据,忽略了数据生产者行为背后趋利避害的动机,可能就会得出错误的判断和结论。

其次,大数据处理技术面临去冗降噪挑战。在现实中,大数据一般来自于不同的社会主体,以动态数据流的形式产生,人们在方便获取数据的同时,也会使得虚假数据、无效数据等噪声数据的生产成本降低。面对大数据中包含众多不同形态的噪声数据,如何通过数据处理技术的革新来挖掘有价值的信息是我们自始至终都要面临的一项技术挑战。这如同人类社会医学技术创新与病毒变异之间的“竞赛”一样是长期存在的。

----------------------------------------------------------------------------------------------------------------------------

了解更多商业智能行业资讯,BI解决方案以及商业智能软件下载请访问FineBI商业智能官网www.finebi.com

© 著作权归作者所有

粉丝 31
博文 1645
码字总数 2338861
作品 0
邢台
私信 提问
“第二届金融CIO班”与“第三届互联网CIO-CTO班”结业典礼隆重举行

2016年11月13日,“第二届金融CIO班”与“第三届互联网CIO-CTO班”结业典礼在北京大学中关新园隆重举行,“第二届金融CIO班”与“第三届互联网CIO-CTO班”的学员参加了最后一个单元的学习,并...

玄学酱
2018/05/09
0
0
聚焦企业安全核心问题 WOT技术峰会再扬风帆

如今,无论是传统企业还是互联网企业,所有的业务都在持续被互联网变革。云计算、大数据、智能硬件、物联网……这些大家耳熟能详的互联网新兴技术,在给IT行业源源不断注入活力的同时,也给企...

玄学酱
2018/05/22
0
0
如何利用DevOps为金融领域注入崭新动力

  近年来在互联网技术与金融服务融合的过程中,互联网金融企业依托信息技术和客户流量等优势,开始全面布局支付、借贷、财富管理、交易结算等领域,这无疑对传统银行业务带来了巨大冲击。而...

it168网站
2018/05/16
0
0
“第二届金融CIO班”开学典礼隆重举行

2016年6月24日,“第二届金融CIO班”开学典礼在北京大学隆重举行,来自全国各地的36名金融行业的学员参与了本期金融CIO班的学习。 合影留念 本次开学典礼由CIO时代信息化学院教务主管胡颖女士...

玄学酱
2018/05/22
0
0
【数据资讯】大数据应用正深入经济生活

  目前,我国互联网、移动互联网用户规模均居全球第一,有着丰富的数据资源和显著的应用市场优势。随着打造“数字中国”战略的推进,大数据产业正成为经济社会发展的新引擎,受到广泛关注。...

cryacq2798
2018/11/15
0
0

没有更多内容

加载失败,请刷新页面

加载更多

OSChina 周六乱弹 —— 早上儿子问我他是怎么来的

Osc乱弹歌单(2019)请戳(这里) 【今日歌曲】 @凉小生 :#今日歌曲推荐# 少点戾气,愿你和这个世界温柔以待。中岛美嘉的单曲《僕が死のうと思ったのは (曾经我也想过一了百了)》 《僕が死の...

小小编辑
今天
2.1K
14
Excption与Error包结构,OOM 你遇到过哪些情况,SOF 你遇到过哪些情况

Throwable 是 Java 中所有错误与异常的超类,Throwable 包含两个子类,Error 与 Exception 。用于指示发生了异常情况。 Java 抛出的 Throwable 可以分成三种类型。 被检查异常(checked Exc...

Garphy
今天
38
0
计算机实现原理专题--二进制减法器(二)

在计算机实现原理专题--二进制减法器(一)中说明了基本原理,现准备说明如何来实现。 首先第一步255-b运算相当于对b进行按位取反,因此可将8个非门组成如下图的形式: 由于每次做减法时,我...

FAT_mt
昨天
40
0
好程序员大数据学习路线分享函数+map映射+元祖

好程序员大数据学习路线分享函数+map映射+元祖,大数据各个平台上的语言实现 hadoop 由java实现,2003年至今,三大块:数据处理,数据存储,数据计算 存储: hbase --> 数据成表 处理: hive --> 数...

好程序员官方
昨天
61
0
tabel 中含有复选框的列 数据理解

1、el-ui中实现某一列为复选框 实现多选非常简单: 手动添加一个el-table-column,设type属性为selction即可; 2、@selection-change事件:选项发生勾选状态变化时触发该事件 <el-table @sel...

everthing
昨天
20
0

没有更多内容

加载失败,请刷新页面

加载更多

返回顶部
顶部