爱吧机器人网 » 技术 > 大数据 > 正文

芝麻开门 大数据征信体系揭秘

1月28日,蚂蚁金融服务集团(下称“蚂蚁金服”)旗下的芝麻信用首次测试个人征信系统,这也是1月5日央行发布允许8家机构进行个人征信业务准备工作通知后,首家推出该系统的公司。据21世纪经济报道记者了解,在1月5日央行发布通知后,蚂蚁金服便迅速注册公司,组建团队。其骨干成员大部分为数据科学 家,同时开始大规模招聘相关人员。芝麻信用总经理则从招商银行“挖”来胡滔担任。据悉,这8家机构目前均处于准备阶段,既无行政许可,也无牌照。按照通知 要求,准备期为6个月。

芝麻信用采取和支付宝钱包合作的方式,用户在支付宝钱包8.5版本“财富”栏中可看到这一功能。但目前只有参与测试的用户才能看到信用分数。相比传统意义上的央行征信报告,芝麻信用采用的形式更加简单——信用分。芝麻信用分最低350分、最高950分,分数越高代表信用程度越好,违约可能性越低。

芝麻信用测试版推出意味着市场化的个人征信在中国正式起步,未来越来越多的机构将为每个人建立起一套信用档案,它将成为每个用户的一张名片。

但就目前而言,无论对于用户,还是征信机构,都将面临一个长期的认知和构建过程。如何采集个人信息、如何形成信用分数、如何使用个人信用、个人信用对用户意味着什么等都是一个全新的挑战。

构建信用维度

芝麻信用背靠阿里巴巴,而阿里巴巴目前覆盖数亿计 互联网 用户,仅支付宝就拥有超过3亿用户。同时,芝麻信用拥有阿里的电商交易数据和蚂蚁金服的 互联网 金融数据,比纯粹的网络社交数据含金量更高,这也成为芝麻信用进入征信行业的一大独特优势。

传统的金融机构征信多采用借贷领域的数据,并且覆盖人群有限。据之前的一份统计数据显示,截止到2013年底,央行银行个人征信系统中收录有信贷记录的自然人约3.2亿,还不到总人口数的1/4,而在美国征信体系的覆盖率已经达到了85%。

“在信用领域我们更多是央行征信的补充。”蚂蚁金服信用业务拓展负责人邓一鸣曾在一次小范围沟通会上表示。这也意味着,市场化、 互联网 化的个人征信将大大拓展覆盖人群范围和增加个人信用评判维度。

但在实践中,如何构建一个如此庞大而又重要的体系,在国内目前并未有成熟的案例参考。阿里巴巴虽然有如此庞大的数据,形成产品仍将是一件系统性的工程。

首先是维度,蚂蚁金服公关部张道生接受21世纪经济报道记者采访时表示,芝麻信用分这一看似简单的分数,背后是芝麻信用对海量信息数据的综合处理和评估,芝麻信用建立个人信用维度方面也参照了美国著名的征信机构FICO。

蚂蚁金服首席信用数据科学家俞吴杰介绍了国外的一些经验,归纳起来可分为,一、基本信息,包括职业、收入、工作稳定性、街区、放假及居住稳定性;二、借贷信息,包括车贷、房贷、信用卡和学生贷等;三、消费信息,商场和网络消费频次、额度等;四、公共信息。法院判决、税务拖欠、地铁逃票、交通违章、亲友欠款等。这也就意味着,个人信用当中涵盖了每个人生活工作中的各个方面。他还举例称,用户的公益行为也会影响到个人信用。

据了解,在此基础上,芝麻信用则采用了五大维度:用户信用历史、行为偏好、履约能力、身份特质、人脉关系,分别对应过往信用账户还款记录及信用账户历史;在购物、缴费、转账、理财等活动中的偏好及稳定性;享用各类信用服务并确保及时履约;在使用相关服务过程中留下的足够丰富和可靠的个人基本信息;好友的身份特征以及跟好友互动程度。

数据来源和计算

阿里巴巴拥有淘宝、天猫、聚划算等电商平台以及蚂蚁金服的 互联网 金融平台,同时业务开始深入水电煤缴费、打车、医疗等领域,本身已积累了大量的数据。

张道生表示,和传统征信数据主要来源于借贷领域有所不同,脱胎于 互联网 的芝麻信用数据来源更广、种类更丰富,时效性也更强,涵盖了信用卡还款、网购、转账、理财、水电煤缴费、租房信息、住址搬迁历史、社交关系等方方面面。

互联网 产生的数据最大的特征是实时,留有痕迹,容易追踪,相对于传统线下的采集和整合更加全面和准确。

就阿里巴巴的业务而言,其通过其电商、支付、 互联网 金融、打车、“未来医院”计划等各业务线已经积累了庞大的数据。但要实现更全面的覆盖,这样的数据量显然不够。 张道生称,芝麻信用的数据来源可以分为三部分,一部分是阿里已有的数据;一部分是和公共服务(包括部分政府部门)对接的数据;未来芝麻信用也将推出一个用户自行提交数据平台,根据这些数据打分。

但在获取外部数据时存在两大问题,首先,外部数据如何提供,免费还是付费;第二,不同机构的数据类型不尽相同。

俞吴杰以国外为例称,收费和付费模式都有,此外还有一种资源互换,比如银行,一家银行向一家征信机构调取数据了,国外有一个互惠条约,银行必须把一些违约信息反馈给征信机构,否则征信机构就

不让银行调取数据,而对银行而言,如果不用征信公司的数据,成本非常高,本身是一种交换;此外,征信机构也会自己向水电煤机构采集,也有付费的,相对来说比较便宜。

对于数据类型,则需要通过技术的方式解决。

搜集数据之后,如何通过数据模型计算出用户的信用,这是征信机构也是用户最为关心的事情。张道生解释说,并非某个行为的变化就会引起用户芝麻信用分的变化,除非出现重大的违约事件,都是通过庞大的数据来计算的,因此并非你在淘宝上消费的越多,芝麻信用分就越高。同时,用户的违约记录会有一个保留期,如果期间信用记录呈正向,信用分也会提升。

上一页12下一页

上一篇:Coursera 数据工程师分享大数据的迷离身世
下一篇:大数据时代:要知道what 不是why
精选推荐
美国喷气推进实验室的AI驱动无人机挑战人类飞行员
美国喷气推进实验室的AI驱动无人机挑战人类飞行员

[2017-12-08]  随着无人机及其组件越来越小,效率越来越高,功能越来越强大,我们已经看到越来越多的研究开始让无人机自主飞行在半结构化的环境中,而不依赖于外部定位。 宾夕法尼亚大学在......

比利时研发出可以自我愈合伤口的软体机器人
比利时研发出可以自我愈合伤口的软体机器人

[2017-09-03]  软体机器人是机器人技术的新兴领域; 他们“可以与人类相互作用,而不会杀死他们,并拿起像西红柿这样柔软的物体。” 从长远来看,布鲁塞尔大学队伍正在努力创建一个类似的材......

深度神经网络揭示了大脑喜欢看什么
深度神经网络揭示了大脑喜欢看什么

[2019-11-06]  爱吧机器人网编者按:近日,《自然-神经科学》发表了一篇论文,研究人员创建了一种深度人工神经网络,能够准确预测生物大脑对视觉刺激所产 ...

哈佛大学《自然》发表新驱动技术,让飞行机器人悬停且不受损伤
哈佛大学《自然》发表新驱动技术,让飞行机器人悬停且不受损伤

[2019-11-06]  哈佛大学研究人员发表在《自然》杂志上的一项最新研究,他们开发了一种由柔软的人造肌肉驱动的机器人蜜蜂(RoboBee),这种机器人在撞墙、 ...

美国Natilus公司试飞水上无人货机 设计简单成本降低
美国Natilus公司试飞水上无人货机 设计简单成本降低

[2017-12-28]  Natilus创业公司成立于2014年,其梦想是建造大型无人机,以半价提供比船舶快得多国际货运。在十二月份,Natilus计划在旧金山湾测试一个9米翼展的小型原型无人机的水上滑行能力......

MIT用深度学习处理3D点云数据 应用于无人汽车等领域
MIT用深度学习处理3D点云数据 应用于无人汽车等领域

[2019-10-23]  如果你见过自动驾驶汽车,也许会对车顶上那个一直在旋转的圆柱体感到好奇。这是一个雷达传感器,无人驾驶汽车依靠它在现实世界中进行导航。 ...

助力卷积神经网络时空特征学习 史上最大行人重识别视频数据集被提出
助力卷积神经网络时空特征学习 史上最大行人重识别视频数据集被提出

[2017-12-25]  本文提出了一个大型的、长序列的、用于行人重识别的视频数据集,简称LVreID。与现有的同类数据集相比,该数据集具有以下特点:1)长序列:平均每段视频序列长为200帧,包含丰......

机器人iCub作为嵌入式AI的标准机器人研究平台的重要性
机器人iCub作为嵌入式AI的标准机器人研究平台的重要性

[2017-12-24]  机器人的研究在过去10年中得益于一个具有嵌入式人工智能(AI)的标准化开源平台——人形机器人iCub。iCub最初在意大利被创建,如今在欧洲、美国、韩国、新加坡和日本的实验室......

本周栏目热点

做为一名大数据新手 应该通过这篇文章了解大数据

[2018-07-23]  一、大数据是什么?大数据,big data,《大数据》一书对大数据这么定义,大数据是指不能用随机分析法(抽样调查)这样捷径,而采用所有数据进 ...

BAT大数据野心:数据生产全链条浮现

[2016-07-12]   本报记者 周慧 北京报道导读以BAT为代表的中国 互联网 企业,在数据领域各有千秋,百度的搜索数据、阿里的电商数据、腾讯的社交数 ...

为什么说发展大数据是有道理的

[1970-01-01]   近日,习主席考察贵州时提到:贵州发展大数据确实有道理。那么为什么说发展大数据是有道理的?从历史的 ...

《时代周刊》:用形象化的老办法对付大数据

[1970-01-01]   《时代周刊》最新一期封面文章称,我们每天被数据海洋淹没,只有让冷冰冰的数据形象化,变成看得见摸得 ...

从Facebook社交媒体情绪实验看大数据道德困境

[1970-01-01]   今年曝光的Facebook私自进行社交媒体用户情绪实验的新闻引起了不小的争议,这把很多数据实验卷入到社会 ...