大数据应用---之---互联网金融---客户风险控制

一. 前言

  • 互联网 金融!"是指传统金融机构与互联网企业利用互联网技术和信息通信技术实现资金融通、支付、投资和信息中介服务的新型金融业务模式。互联网金融不仅仅是互联网和金融业的简单结合,还是在实现安全、移动等网络技术的基础上,被用户熟悉接受后,自然而然地为适应新的需求而产生的新模式及新业务。是传统金融行业与互联网精神相结合而衍生出的新兴领域。

  • 互联网金融最重要的三要素为平台、数据、金融。目前市场不只是平台之争,特别随着这两年互联网金融爆发式的发展,已经形成了平台、数据、金融相互影响的格局。在这种形势下,破局点就在于连接平台、用户、金融等方面的工具一大数据, 谁能合理利用大数据,谁就能掌握这场数据之争的未来市场。

二. 大数据在互联网金融的应用

  • 金融企业是大数据的先行者,早在大数据技术兴起之前,金融行业的数据量和对数据的应用探索就已经涉及大数据的范畴了。而今随着大数据技术应用日趋深入,大数据理念渐入人心,金融机构在保有原有数据技术能力的同时,通过内部传统数据和外部信息源的有效融合,在金融企业内部的客户管理、产品管理、营销管理、系统管理、风险管理、内部管理及优化等诸多方面得到有效提升。接下来我们介绍几种大数据的典型应用方向2。

1. 金融反欺诈与分析

  • 在互联网经济的冲击下,各类终端、渠道经常遭遇各类攻击,随着银行互联网化,银行在开展各类网络金融创新业务时,更是面临严峻挑战。然而,目前大部分欺诈分析模型都只是在账户有了欺诈企图和尝试之后才能够检测的,潜在的欺诈信号识别往往比较模糊。

  • 对此,金融企业可以通过收集多方位的数据源信息,构建精准全面的反欺诈信息库和反欺诈用户行为画像,结合大数据分析技术和机器学习算法进行欺诈行为路径的分析和预测,并对欺诈触发机制进行有效识别。同时与业务部门合作,进行反欺诈运营支持,并帮助银行构建欺诈信息库。最终,帮助银行提前预测欺诈行为的发生,准确获得欺诈路径,极大地减少因欺诈而造成的损失。

2. 构建更全面的信用评价体系

  • 如何进行风险控制一直是金融行业的核心重点,也是金融企业的核心竞争力之一,而完善的信用评价体系不仅可以帮助金融企业有效降低信贷审批成本,而且能有效地控制信贷风险。构建信用评价体系,绝对不能以单纯的贷款标准去衡量-一个客户能否贷款、能贷到多少款项,而必须融合外部交易信息和深入到行业中用行业标准衡量。大数据技术从以下3个方面帮助金融机构建立更为高效精准的信用评价体系:

  • (1)基于企业传统数据库丰富的客户基础信息、财务及金融交易数据,结合从社交媒体、互联网金融平台获取的客户信用数据,构建完备的客户信用数据平台。

  • (2)利用大数据技术,融合金融企业专业量化的信用模型和基于互联网的进货、销售、支付清算、物流等交易积累的信用和对企业的还款能力及还款意愿的评估结论,以及行业标准还原真实经营情况,对海量客户信用数据进行分析,建立完善的信用评价模型。

  • (3)应用大数据技术进行信用模型的分布式计算部署,快速响应,高效评价,快速放款,实现小微企业小额贷款和信用产品的批量发放。

3. 高频交易和算法交易

  • 交易者为获得利润,利用硬件设备和交易程序的优势,快速获取、分析、生成和发送交易指令,在短时间内多次买入卖出,且一般不持有大量未对冲的头寸过夜。现在的高频交易主要采取“战略顺序交易”,即通过分析金融大数据,以识别特定市场参与者留下的足迹。例如,如果一只共同基金通常在收盘前一分钟的第一 秒执行大额订单, 能够识别出这一模式的算法将预判出该基金在其余交易时段的动向,并执行相同的交易。该基金继续执行交易时将付出更高的价格,使用算法的交易商可趁机获利。

4. 产品和服务的舆情分析

  • 随着互联网的普及和发展,金融企业不仅将越来越多的业务扩展到了互联网上,客户们也越来越多地选择通过各种网络渠道发声,金融企业的一些负面舆情迅速在网络平台进行传播,可能会给金融业乃至经济带来巨大的风险。

  • 金融机构需要借助舆情采集与分析技术,通过大数据爬虫技术,抓取来自社交渠道与金融机构及产品相关的信息,并通过自然语言处理技术和数据挖掘算法进行分词、聚类、特征提取、关联分析和情感分析等,找出金融企业及其产品的市场关注度、评价正负性,以及各类业务的用户口碑等,尤其是对市场负面舆情的及时追踪与预警,可以帮助企业及时发现并化解危机。同时,金融企业也可以选择关注同行业竞争对手的正负面信息,以作为自身业务优化的借鉴,避免错过商机。

三. 客户风险控制

  • 传统金融的风险控制,主要是基于央行的征信数据及银行体系内的生态数据,依靠人工审核完成。在国内的征信服务远远不够完善的情况下,互联网金额风险控制的真正核心在于可以依靠互联网获取的大数据,如BAT等公司拥有大量的用户信息,这些数据可以用来更加全面地预测小额贷款的风险。而机器学习将是大数据时代互联网金融企业构建自动化风控系统的利器。

  • 在企业数据的应用的场景下,最常用的主要是监督学习和无监督学习的模型,在金融行业中一个天然而又典型的应用就是风险控制中对借款人进行信用评估。因此互联网金融企业依托互联网获取用户的网上消费行为数据、通信数据、信用卡数据、第三方征信数据等丰富而全面的数据,借助机器学习的手段搭建互联网金融企业的大数据风控系统。除了在放贷前的信用审核外,互联网金融企业还可以借助机器学习在放贷过程中对借款人还贷能力进行实时监控,以及时对后续可能无法还贷的人进行事前干预,从而减少因坏账带来的损失。

  • 目前互联网金融企业以及第三方征信公司在信用评估这方面比较常用的架构是规则引擎加信用评分卡。

1. 信用评分算法

  • 说到信用评分卡,最常用的算法是Logistic Regresiols,这也是被银行信用卡中心或金融工程方面奉为法宝的算法。的确,Logistic Regression因其简单、易于解释、开发及运维成本较低而受到追捧。

  • 在信用评估领域,假定有二值变量y,它表示贷款申请人的“好”与“坏”,y=I时表示“坏”,y=0时表示“好”,现在我们要预测P(=1)。对申请者而言,其y=1发生的概率越高,则这个申请者的信用评分越低,反之亦然。理论上,信用分数是概率(y发生的概率)的一种单调数学变换,信用分数与概率之间是一一对应关系。

2. 分类模型的性能评估

  • 分类模型应用较多的除上面讲的Logistic Regression, 还有Decision Tree、 SVM、Random forestll等。 实际应用中不仅要知道会选用这些模型,更重要的是要懂得对所选用的模型的性能做评估与监控。

  • 涉及评估分类模型的性能指标有很多,常见的有Confusion Matrix ( 混淆矩阵),ROC, AUC, Recall, Performance, lift, Gini, K-S之类。其实这些指标之间是相关与互通的,实际应用时只需选择其中几个或者是你认为重要的几个即可,无须全部关注。

猜你喜欢

转载自blog.csdn.net/qq_38132105/article/details/107123762