“百分点大数据技术沙龙——管中窥豹:用大数据洞察用户”在Binggo咖啡已圆满落幕.共有涵盖金融、电信、能源、互联网等10多个行业的大数据技术、产品、市场相关人员参加.“百分点大数据技术沙龙”是由百分点发起的为大数据领域相关技术人员举办的系列技术沙......

“百分点大数据技术沙龙——管中窥豹:用大数据洞察用户”在Binggo咖啡已圆满落幕。共有涵盖金融、电信、能源、互联网等10多个行业的大数据技术、产品、市场相关人员参加。“百分点大数据技术沙龙”是由百分点发起的为大数据领域相关技术人员举办的系列技术沙龙,本次百分点技术专家刘译璟博士和李海峰为大家分享了百分点大数据用户画像的概念和方法,以及如何构建和应用,中关村大数据产业联盟副秘书长陈新河作为特邀嘉宾从宏观的视野分析了大数据发展路径。

陈新河分享了《画像——大数据征程的起点》主题报告。他认为,大数据是物理世界在网络世界的映射,是一场人类空前的网络画像运动。网络世界与物理世界不是孤立的,网络世界是物理世界层次的反映。数据是无缝连接网络世界与物理世界的DNA。发现数据DNA、重组数据DNA是人类不断认识、探索、实践大数据的持续过程。

图1大数据发展路径

陈新河把网络画像分为行为画像、健康画像、企业信用画像、个人信用画像、静态产品画像、旋转设备画像、社会画像和经济画像等八类,并通过实践案例进行了阐释。

未来,人生的每个历程无时无刻不由数据驱动。、

图2数据驱动人生

未来,设备全生命周期也将由数据驱动。

图3数据驱动汽车全生命周期(海略咨询)

刘译璟博士首先从百分点推荐引擎开始,深入探讨了四大引擎。

场景引擎:个性化的核心,判断用户处于哪个购物环节,有什么样的购物目标;

规则引擎:业务的核心,结合用户、场景、算法输出数据和业务KPI,决定为用户推荐哪些内容;

算法引擎:计算用户之间的相似度、商品之间的相似度、用户对商品的评分、用户分群、热门排行……

展示引擎:将推荐内容以最佳的展示方式呈现在用户面前。

推荐引擎的核心是将购物流程数据化,而其前提是将用户数据化。如何将用户数据化呢?就是用户画像。

刘译璟博士用几个生活中画像的例子生动地阐释了什么是用户画像。

用户画像的目标、方式、组织、标准和验证等几个特点。

他认为用户侧写可能更加准确的描述“用户画像”这个词,因为我们是通过有限的信息来描述一个人,而非通过全息相机照相的模式来描述一个人。

从技术角度来看,人在网络空间是一个比特流,人们认识人的方式发生重大改变,由物理空间的“相面”转变为网络空间比特流解析,更重要的是教会机器按照人类交给他的规则从这些比特流进行自动识别。能够从千万计的用户中找出金融诈骗者、恐怖分子等。

如何实现这一过程?这就需要一种类似成像技术中的像素来对人的特征进行刻画,这就是画像中的标签。

大数据用户画像其实就是对现实用户做的一个数学模型,在整个数学模型中,其核心是,怎么描述业务知识体系,而这个业务知识体系就是本体论,本体论很复杂,我们找到了一个特别朴素的实现,就是标签。建好模型以后,要在业务的实践中去检验,并且不断完善,不断丰富这个模型,来达到利用比特流对人越来越精确的理解。用户画像不是一个数学游戏,不是一个技术问题,实际上是一个业务问题。因为最核心的是你去如何理解用户,了解你的用户。它是技术与业务最佳的结合点,也是一个现实跟数据的最佳实践。

李海峰分享了百分点在用户画像方面的实践和案例。

他首先以自己为例分享了画像样例。基于他这个人可以知道他所在的城市是在北京,男性,公司在百分点,喜欢的品类是男鞋、运动鞋,喜欢的品牌有耐克、阿迪达斯等等。每一个标签都有一个权重值。可以看到,耐克的权重值比阿迪达斯更高一些。

这幅图是通过云图的方式对百分点创始人/董事长兼CEO苏萌进行的特征画像。

百分点的画像标签体系包括:人口属性、上网特征、营销特征、内容偏好、兴趣偏好等。

以手机商品属性为例,包括品牌、品类、型号、上市时间、价格、颜色、网络、操作系统、分辨率、屏幕尺寸等等。

标签管理体系具有如下特性。

有多种标识方式对用户进行识别,这就像社会生活中的身份证号码一样,只不过换成了网络空间的手机号、Cookie、IMEI、Email、微博、微信账号等,在处理过程中,这些信息都是加密的,机器知道但人不知道。

百分点用户画像逻辑架构如下图所示,通过对电商、社区、移动应用、微博、微信等多种类别的数据源进行采集,然后对用户进行画像,最终在个性化推荐、用户洞察、精准营销等方面进行应用。百分点的数据源多且庞大,服务的客户超过了1500多家,覆盖行业超过了40多个。举例来说,一个网民,他在访问一个电商A,同时又访问了一个电商B,这两个电商本身的知识体系是不一样的。比如说这个用户他访问一双鞋,他在电商A上的品类可能是鞋-男鞋-运动鞋,在网站B上可能是运动-户外-男鞋,品类描述可能是不一样的。所以百分点打造了这么一个系统,叫商品画像系统。通过这个系统,所有的标签就有了一个标签规划,之后就可以去构建这个用户在全网的用户画像标签。用户画像只是一个起点,而不是一个结束。基于此,还可以打造一系列的服务,比如精准营销、个性化推荐等。

下图是用户画像的技术架构图。我们可以看到总共分为五层:第一是数据源;第二层是数据采集服务,百分点有一堆数据采集服务,包括我们的数据探头,能够对用户的行为进行一个实时采集;第三层是数据预处理,主要是结构化;第四层是商品画像,这一块都是我们的用户画像服务。我们可以看到用户画像是分两大块,实时处理更偏重于预测用户画像的需求,离线处理更偏重于用户的长期偏好;第五是统一的数据接口,还有就是集群,上面可以接入各种各样的应用。

下图是用户标签产出流程示例。

用户在互联网上的行为主要分为电商类、社交类和媒体类。每种行为差异很大,电商类行为包括浏览、搜索、添加购物车、收藏、支付等,而社交类则是点赞、转发、评论等。

接着下一步需要对页面标签进行抽取,在做这件事情之前需要训练模型,首先准备训练数据,通过标注和规则生成,再就是对于序列集做一个序列化处理。首先会得到一个弱模型,最终得到一个强模型,然后把自己的参数都保留下来。这个时候我们会加一个决策,如果说效果不太好的话,我们会进行下一轮的优化。当这个模型设置之后,我们就可以去做预测了。我们的预测总共分为四大块,包括输入、输入预处理、预测和产出。也就是说用户这个标签已经有了,这个标签对用户的信誉度是1还是0?这个时候就到了用户行为建模。用户行为建模的背后思想主要可以认为有两大块,成本越高行为权重越高,下单就比浏览更高一些,时间越近的行为权重越高,比如我今天看了一个手机,一定比我一周前看了一次电脑权重要高一些。我们可以按场景去分,首先是产生需求,再就是决策,然后是结束,百分点基于业务考虑,实行标签权重积累的机制。

这是我们的客户某航空公司的案例,项目目的是挖掘高价值旅客,希望通过分析旅客出行偏好优化运力资源。最终百分点帮他构建了5个标签大类,75个标签小类,数万个小标签,以下是当时的一些效果截图。

刚才讲的都是百分点已经做的事情,但是百分点做得还远远不够。接下来可能会在四大方面深入思考和实践:一是不同的场景,也就是说用户在家里和在办公环境下代表的偏好是不一样的;二是用户心理学特征,比如当一个用户看一件女装的时候,她这个时候是无聊去逛还是有目的的逛,反映在标签权重上是不一样的;三是让用户主动反馈反感点,我们强调了许多,一般都是在强调用户喜欢什么,但是用户不喜欢什么,我们做得还不够,我们应该让用户主动告诉我们他不喜欢什么,比如他不喜欢吃葱,他不喜欢吃羊肉串,这样我们预测的时候会准得多;四是用户的兴趣转移快速捕获,一开始我们使用的是一个半衰期的,而且按频率细分,我们是否可以按人去分?比如按访次去分?比如针对品类手机这个标签,对于手机发烧友,可能过了一年他依然会对手机比较感兴趣,但是对于像我这种,只有想购买的时候才去看,可能我两天不看,就表示这个兴趣已经衰减为零了。

【读PPT】管中窥豹:用大数据洞察“用户画像”的秘密!相关推荐

  1. 关于如何用大数据做“用户画像”调查报告(持续更新)

    关于如何用大数据做"用户画像"调查报告(持续更新) 什么是用户画像 用户画像又称用户角色,作为一种勾画目标用户.联系用户诉求与设计方向的有效工具,用户画像在各领域得到了广泛的应用. ...

  2. 【干货】产品经理如何使用大数据构建用户画像

    送给真正的互联网人一顿干货早餐 [小咖导读]文自"数据挖掘与数据分析",伴随着大数据应用的讨论.创新,个性化技术成为了一个重要落地点.相比传统的线下会员管理.问卷调查.购物篮分析, ...

  3. 基于大数据的用户画像构建小百科全书

    来源:http://suo.im/6aVjHQ 一. 什么是用户画像 用户画像是指根据用户的属性.用户偏好.生活习惯.用户行为等信息而抽象出来的标签化用户模型.通俗说就是给用户打标签,而标签是通过对用 ...

  4. bootstrap-table真实交互数据_博思远略:基于AI交互场景数据构建用户画像的几点思考...

    什么是用户,就是那些藏在每台电脑.手机.pad.智能watch屏幕背后的使用产品或服务恰如你我--有血有肉.有情绪.有想法.有阅历.有逻辑.有思考.固守某种习惯且独一无二.形形色色的人. 用户画像本质 ...

  5. 大数据标签获取处理步骤_用大数据给用户“打标签”,精准营销就是这么简单!...

    原标题:用大数据给用户"打标签",精准营销就是这么简单! 在互联网逐渐步入大数据时代后,不可避免的为企业及消费者行为带来一系列改变与重塑.其中最大的变化莫过于,消费者的一切行为在企 ...

  6. 如何快速全面建立自己的大数据知识体系? 大数据 ETL 用户画像 机器学习 阅读232 作者经过研发多个大数据产品,将自己形成关于大数据知识体系的干货分享出来,希望给大家能够快速建立起大数据

    如何快速全面建立自己的大数据知识体系? 大数据 ETL 用户画像 机器学习 阅读232  作者经过研发多个大数据产品,将自己形成关于大数据知识体系的干货分享出来,希望给大家能够快速建立起大数据产品的体 ...

  7. RS(2)--从文本数据到用户画像

    点击上方"算法猿的成长",关注公众号,选择加"星标"或"置顶" 总第 122 篇文章,本文大约 5100 字,阅读大约需要  15 分钟 上 ...

  8. Axure高保真移动端智能数据监控+用户画像+饼状图+条形图+折线图数据统计+抖音直播app用户数据统计+智慧移动端主播粉丝、评论、播放量大数据统计+套餐购买、续费套餐prd流程

    作品介绍:Axure高保真移动端智能数据监控+用户画像+饼状图+条形图+折线图数据统计+直播app用户数据统计+智慧移动端主播粉丝.评论.播放量大数据统计+套餐购买.续费套餐prd流程 原型演示及下载 ...

  9. 利用大数据构建用户画像的好处

    大数据时代,不仅普通用户可以享受到技术带来的便利,企业也可以从数据中提取有商业价值的信息,构建出用户画像,从而对用户行为进行分析和预测.虽然用户画像不是什么新鲜的概念,但是大数据技术的出现使得用户画像 ...

  10. 【大数据相关】电商大数据之用户画像介绍

    因为平时工作中接触的跟大数据有关,于是学习了一下大数据 第一篇学习的是:慕课网 -- 大数据 --  电商大数据之用户画像介绍 笔记--基本概念介绍: 1.用户画像的价值 --- 有利于精准营销,营销 ...

最新文章

  1. iOS中引用计数内存管理机制分析
  2. Scala中没有break和continue, 如何退出循环
  3. 中国python之父是谁-Python之父重回决策层
  4. 008PHP文件处理——文件操作r w (用的比较多) a x(用的比较少) 模式 rewind 指针归位:...
  5. 【Windows8系统控制面板和电脑设置在哪个位置】
  6. Java-标识符和关键字
  7. dubbo服务化最佳实践
  8. (器) 构建自由通行的IOS开发者地图
  9. python_day3
  10. 活着是一种罪过,是上帝对你的另一种眷顾,叫做惩罚!活着痛苦!
  11. Python 进阶 —— 可变参数(*args, **kw)与参数收集的逆过程
  12. android模拟器模拟nfc功能吗,打开NFC模拟器不适用于Android模拟器
  13. 直播盒子源码开发合作
  14. xp系统打开itunes显示服务器失败,windowsxp系统安装不了itunes的两种解决方法
  15. PNG-的IDAT解析
  16. 蓝牙配对,解决蓝牙多次连接不上的问题
  17. 基于Azure Kinect SDK获取物体rgb图、深度图、红外IR图和点云数据并保存到本地
  18. python下载pip3_pip3 离线下载安装
  19. 【NDN实验】ndnSIM: NDN simulator for NS-3 全文翻译
  20. Java压缩图片大小

热门文章

  1. 清华大学计算机课程对应教材,清华大学计算机专业大一到四的课程 教材详细名字...
  2. 使用ActivityGroup来切换Activity和Layout,android入门开发与实战
  3. 据我爱无人机网-英国政府向无人机研发项目提供3000万资助
  4. windows7安装cuda10.2
  5. 关于计算机Excel中的试题,2015年职称计算机考试EXCEL练习试题及答案
  6. MIT线性代数习题全解
  7. SylixOS学习三—— SylixOS的引导与安装1
  8. 地统计学中的基台值问题
  9. 无监督学习K-means文本聚类实践
  10. ALM11(QC11)官方中文安装包下载