-
2021-02-08 12:17:49
大数据是什么?
多大的数据叫大数据?
很多没有接触过大数据的人,都很难清楚地知道,究竟多大的数据量才可以称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。
企业端(B端)数据近十万的级别,就可以称为大数据;个人端(C端)的大数据要达到千万级别。收集渠道没有特定要求,PC端、移动端或传统渠道都可以,重点要达到这样数量级的有效数据,形成数据服务即可。很有趣,大家可以看到2B和2C,两类大数据差了两个数量级。
有些小公司,数据只有千到万级的规模,但经过收集分析,也能从中有针对性的总结出这一群体的原则,同样能指导企业进行一定程度的用户分析、获取或者是服务工作,但这并不是大数据,而是一般性的数据挖掘。
刚刚天小妹分享的那个案例,说今年年初有个用50块本金摆地摊卖水果的中年人,他并不懂得大数据,但是他对水果的收成了若指掌:他知道哪个地方下了多少雨,水果的甜度会到多少,哪些地方的消费者会喜欢吃这个甜度的水果。卖到最后卖出了137家门店、4.7亿的年销售额。
这确实是一种小的数据挖掘,但并不是数据分析。大数据分析虽然脱胎于此,但大数据面向的是更海量的一个数据,借助了更广义的知识数据库的分析方法。大部分的数据公司的数据来源是海量的,它的收集和分析,并不是局限于个体,而是以一个非常非常广泛的群体为对象展开的。
大数据的产业链是怎样的?
我在接受采访的时候,依照大数据公司在产业链的上下游关系,提出把它们分成三种不同类别:
大数据采集公司
所谓“找数据”,内部可以再分两种:
1).在自身正常运营的过程中就能产生大量数据源;
2).通过跟电信运营商、金融企业合作,获取数据源。
大数据分析公司
这一类公司,基本上都有自己的套模型,但大部分数据库模型源于相同的几个机理,包括统计学模型、深度学习算法等等。也基于美国IBM、cloudera公司开发的应用型分析模块等等。
大数据销售公司
虽然说是卖数据,但出售的并不是单一数据,而是基于数据的全套解决方案,比如精准营销等等。
这三类公司是如何协作,并把大数据作用于我们的生活呢?最容易理解的就是现在在微信朋友圈上投放的广告。
腾讯在把广告推广给每个用户的时候,都已经对用户做过精准的分析。通过收集人们在微信上使用习惯,进而分析用户的消费能力、消费习惯,形成一套精准营销方案后,给广告商生成一些定向的广告。
比如说,兰蔻的广告就从来不会推广给男性用户、豪车广告也不会推给应届毕业生。整个的微信广告体系都用到了大数据的分析模式,大家普遍反馈,在腾讯上投放的广告比网易、新浪等平台上投放的广告转化率高,正是得益于腾讯的大数据基础。
大数据公司的投资价值
如何理解大数据的投资价值?
大数据如今这么火,其商业价值显而易见,但是能真正兑现的人并不多。
要兑现大数据的商业价值,第一个要求,就是达到大数据的数据量级。那么目前,在数据量上最有优势是BAT三家。在PC时代,百度在数据上的优势非常强,但到移动时代,腾讯和阿里实现了反超。
腾讯有微信、QQ,拿到了移动端数据生成量的九成;阿里利用它的消费数据资源,更有垂直性。那么对于中小企业、创业企业而言,兑现商业价值的重点就变成了,如何在自身规模较小的时候,利用别人的大数据资源为自己的创业更好的服务。这是需要深层次判断和挖掘的。
所以,对于数据相关的公司,在投资判断的时候,不单是看现有业务的发展,更重要的是在他不断的发展的过程中,能不能积累有效数据、积累高准确性的数据,实现数据的实时更新性。这样的企业才能够更好地建立起竞争壁垒。
比如,在开发者服务领域,比如talkingdata极光等等,我们复星昆仲在看项目时非常看重的一点,就是现在项目所经营的业务是单一为开发者提供服务?还是在服务之余,给自己的积累有效数据,形成长期壁垒?
2B是大数据行业的突破口
我之前有提到BAT对大数据收集是垄断性的,创业企业想要在C端达到海量数据(千万级甚至上亿的C端用户)非常难。目前,国内月活真正过亿的app只有15个,渗透率前10的app都是BAT所控制的,比如微信、QQ、淘宝、UC浏览器等。如果绕开BAT,能拥有C端海量数据的,就只有相对传统的电信业、金融业等等。
可见,如果想投资大数据领域的公司,从C端下手难度很高。所以,我觉得在如果想在大数据行业布局,2B领域才是关键:一方面2B发展较晚,BAT还没有形成垄断;第二,开发门槛相对较高的;第三,数据量需求量相对较少,达到十万级别就可以为大数据的分析服务,所以如果想在大数据领域进行投资,要关注的主要领域是2B领域。
在2B领域,有三个不同的类别:
第一类,是现在很火的企业服务,以SaaS为主;比如客户管理的CRM、人力板块的HRM等等。他们在得到用户许可并保证数据安全的前提下,通过服务大量的企业来积累企业用户,和企业员工数据。比如理才网等等。
第二类,是B2B交易平台;目前的趋势,基本上是行业垂直领域的电子商务交易平台,核心竞争力就是打破买卖双方的信息不对称、不透明。所以这种领域公司的关键点并不是记录交易量,而是每一个有效的数据信息。在这个领域,我们投资过惠民网,主要服务于中小商超和其供货商的交易平台,再比如各种“找”系列项目等等。
第三类,是针对于开发者的服务;云存储、运行数据的统计推送以及app内的即时通信等。
复星昆仲主要是在这三类的2B项目当中的进行投资,因为这些项目的2B业务模式可以有效积累大数据。这就是为什么复星同时关注大数据和2B领域的企业服务——因为在2B领域的企业服务,能够找到最好最有效的大数据。
2B行业的未来投资标的
如果我们预测一下这个行业的未来,我有以下几个观点。
拥有丰富大数据源的企业,会成为整个行业内最炙手可热的投资标的。
在大数据行业里,分析算法上的差别,造成的分析结果准确性、实用性的差异是93分和95分的区别。而因数据源质量造成的差别,是60分和90分的不同。特别是,一个不断更新的大数据,是能够验证这个算法准确性并不断优化大数据分析结果的有效途径。
先行绑定最急需数据的需求方的项目,将获得胜利。
目前,在大数据领域最愿意买单的基本都是金融领域的客户,银行、保险公司等等。他们要对用户进行多方位的分析和服务,所以购买意愿非常强。下一层,是新兴的互联网公司,为了更精准的获取用户、提高转化率,也比较愿意买单,比如说像新美大等等。下一步,可能会过渡到消费品行业当中去。
基于大数据的那些商机
SaaS类项目凭什么火?
很多人其实不明白SaaS模式和传统的软件服务到底有什么区别,为什么说它是一个基于大数据而兴起的行业呢?
SaaS和传统软件服务,中间有非常多的区别。最基础的区别,就是他们整个架构是不同的:SaaS是建立在公有云上的,标准化的模块服务,数据也储存在SaaS的公有云平台上。而传统的软件服务基本上是部署在局域网内的。这种架构上的区别决定所有的其他区别。
比如,因为SaaS架构在云端,而且秉承标准化、普适化原则,所以,实施过程非常快。至少,实施前的现场搭建工作要少很多,那么获取用户也相应的加快。能传统模式要很长时间才能累计几百个客户,而SaaS模式可以在短时间内累积上千、上万的客户都不难。
再比如,付费模式上的不同,传统软件有前期实施费、每年更新的费用、专门的定制服务费用、故障解决费用等等。整体来讲,费用高、缴费繁复,往往只有大企业才消费的起。而SaaS一方面减少了初期部署成本、且系统和架构可以服务于多个用户。它的收费模式基本上,是收月费或者年费,一个月只有几百块,很多中小企业,都可以享受到服务。
智能硬件和人工智能的收获期还很漫长
大数据和智能硬件相结合的模式,其实目前还很有挑战性,最主要的原因还是出在大数据的数量级上。目前智能硬件的出货量远不能匹配大数据所需的数量级。目前,国内出货量最大的是小米手环,第二是360儿童卫士。剩下的智能硬件出货量,往往在十几万到几十万就是比较好的量级。这跟C端大数据千万、亿级的要求还相差百倍呢。
人工智能领域相对好一些,属于如日方升的情况。在海外的谷歌、亚马逊、软银,已经在投资一些投资标的,但是依然是一些概念领域的项目,不是立即可以商业化的服务。包括谷歌的无人车,就算已经能够积累了上百万英里的安全驾驶里程,但要应用还是有一定过程。国内也有少数的天使、早期机构,已经看好这个领域开始投资,但它的开花结果期那可能还要至少再等五年。
所以,这个领域的投资要有一定耐心,目前比较有希望兑现的领域,包括语音语义识别、AR/VR、无人机等。
Q&A环节
Q:小散参与大数据、AI的SaaS的投资是否可行呢?
A:我觉得,目前小散想要参与这一领域投资的唯一途径,可能就是通过股权众筹。这些项目的行业门槛决定了,小散要想投这类项目最好还是通过专业性的众筹平台。
具体而言,原因有几个方面:
项目的门槛高。我们小散接触项目往往是通过自己的朋友圈子,但这类项目的创业者基本都是专业人员,我们的小散是接触不到的。
这类项目对创始人的专业经验要求高,小散难以进行这种专业性的项目尽调。而专业的众筹平台,在把项目推广给各位于中小投资人之前,就已经对项目做过背景调查。实现对于小散投资实现一个保护。
总而言之,这类项目行业门槛高,专业性要求高,小散想投资一定要找天使客这样负责任的众筹平台
Q:大家都说我们现在处于互联网时代,您强调我们现在是数据信息时代。这怎么理解?
A:我们现在就已经处在大数据信息时代,大数据和互联网移动互联网是不相冲突的,而且恰恰是互联网,特别是移动互联网的出现,使得可以有效采集的大数据大大提升,所以大数据时代是和移动互联网手挽手一起走过来的。
更多相关内容 -
大数据是什么?多大的数据叫大数据?
2019-05-17 11:06:38很多没有接触过大数据的人,都很难清楚地知道,究竟多大的数据量才可以称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。 大数据是什么? 多大的数据叫大数据? 很多没有...很多没有接触过大数据的人,都很难清楚地知道,究竟多大的数据量才可以称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。
大数据是什么?
多大的数据叫大数据?
很多没有接触过大数据的人,都很难清楚地知道,究竟多大的数据量才可以称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。
企业端(B端)数据近十万的级别,就可以称为大数据;个人端(C端)的大数据要达到千万级别。收集渠道没有特定要求,PC端、移动端或传统渠道都可以,重点要达到这样数量级的有效数据,形成数据服务即可。很有趣,大家可以看到2B和2C,两类大数据差了两个数量级。
有些小公司,数据只有千到万级的规模,但经过收集分析,也能从中有针对性的总结出这一群体的原则,同样能指导企业进行一定程度的用户分析、获取或者是服务工作,但这并不是大数据,而是一般性的数据挖掘。
刚刚天小妹分享的那个案例,说今年年初有个用50块本金摆地摊卖水果的中年人,他并不懂得大数据,但是他对水果的收成了若指掌:他知道哪个地方下了多少雨,水果的甜度会到多少,哪些地方的消费者会喜欢吃这个甜度的水果。卖到最后卖出了137家门店、4.7亿的年销售额。
这确实是一种小的数据挖掘,但并不是数据分析。大数据分析虽然脱胎于此,但大数据面向的是更海量的一个数据,借助了更广义的知识数据库的分析方法。大部分的数据公司的数据来源是海量的,它的收集和分析,并不是局限于个体,而是以一个非常非常广泛的群体为对象展开的。
大数据的产业链是怎样的?
我在接受采访的时候,依照大数据公司在产业链的上下游关系,提出把它们分成三种不同类别:
大数据采集公司
所谓“找数据”,内部可以再分两种:
1).在自身正常运营的过程中就能产生大量数据源;
2).通过跟电信运营商、金融企业合作,获取数据源。
大数据分析公司
这一类公司,基本上都有自己的套模型,但大部分数据库模型源于相同的几个机理,包括统计学模型、深度学习算法等等。也基于美国IBM、cloudera公司开发的应用型分析模块等等。
大数据销售公司
虽然说是卖数据,但出售的并不是单一数据,而是基于数据的全套解决方案,比如精准营销等等。
这三类公司是如何协作,并把大数据作用于我们的生活呢?最容易理解的就是现在在微信朋友圈上投放的广告。
腾讯在把广告推广给每个用户的时候,都已经对用户做过精准的分析。通过收集人们在微信上使用习惯,进而分析用户的消费能力、消费习惯,形成一套精准营销方案后,给广告商生成一些定向的广告。
比如说,兰蔻的广告就从来不会推广给男性用户、豪车广告也不会推给应届毕业生。整个的微信广告体系都用到了大数据的分析模式,大家普遍反馈,在腾讯上投放的广告比网易、新浪等平台上投放的广告转化率高,正是得益于腾讯的大数据基础。
大数据公司的投资价值
如何理解大数据的投资价值?
大数据如今这么火,其商业价值显而易见,但是能真正兑现的人并不多。
要兑现大数据的商业价值,第一个要求,就是达到大数据的数据量级。那么目前,在数据量上最有优势是BAT三家。在PC时代,百度在数据上的优势非常强,但到移动时代,腾讯和阿里实现了反超。
腾讯有微信、QQ,拿到了移动端数据生成量的九成;阿里利用它的消费数据资源,更有垂直性。那么对于中小企业、创业企业而言,兑现商业价值的重点就变成了,如何在自身规模较小的时候,利用别人的大数据资源为自己的创业更好的服务。这是需要深层次判断和挖掘的。
所以,对于数据相关的公司,在投资判断的时候,不单是看现有业务的发展,更重要的是在他不断的发展的过程中,能不能积累有效数据、积累高准确性的数据,实现数据的实时更新性。这样的企业才能够更好地建立起竞争壁垒。
比如,在开发者服务领域,比如talkingdata极光等等,我们复星昆仲在看项目时非常看重的一点,就是现在项目所经营的业务是单一为开发者提供服务?还是在服务之余,给自己的积累有效数据,形成长期壁垒?
2B是大数据行业的突破口
我之前有提到BAT对大数据收集是垄断性的,创业企业想要在C端达到海量数据(千万级甚至上亿的C端用户)非常难。目前,国内月活真正过亿的app只有15个,渗透率前10的app都是BAT所控制的,比如微信、QQ、淘宝、UC浏览器等。如果绕开BAT,能拥有C端海量数据的,就只有相对传统的电信业、金融业等等。
可见,如果想投资大数据领域的公司,从C端下手难度很高。所以,我觉得在如果想在大数据行业布局,2B领域才是关键:一方面2B发展较晚,BAT还没有形成垄断;第二,开发门槛相对较高的;第三,数据量需求量相对较少,达到十万级别就可以为大数据的分析服务,所以如果想在大数据领域进行投资,要关注的主要领域是2B领域。
在2B领域,有三个不同的类别:
第一类,是现在很火的企业服务,以SaaS为主;比如客户管理的CRM、人力板块的HRM等等。他们在得到用户许可并保证数据安全的前提下,通过服务大量的企业来积累企业用户,和企业员工数据。比如理才网等等。
第二类,是B2B交易平台;目前的趋势,基本上是行业垂直领域的电子商务交易平台,核心竞争力就是打破买卖双方的信息不对称、不透明。所以这种领域公司的关键点并不是记录交易量,而是每一个有效的数据信息。在这个领域,我们投资过惠民网,主要服务于中小商超和其供货商的交易平台,再比如各种“找”系列项目等等。
第三类,是针对于开发者的服务;云存储、运行数据的统计推送以及app内的即时通信等。
复星昆仲主要是在这三类的2B项目当中的进行投资,因为这些项目的2B业务模式可以有效积累大数据。这就是为什么复星同时关注大数据和2B领域的企业服务——因为在2B领域的企业服务,能够找到最好最有效的大数据。
2B行业的未来投资标的
如果我们预测一下这个行业的未来,我有以下几个观点。
拥有丰富大数据源的企业,会成为整个行业内最炙手可热的投资标的。
在大数据行业里,分析算法上的差别,造成的分析结果准确性、实用性的差异是93分和95分的区别。而因数据源质量造成的差别,是60分和90分的不同。特别是,一个不断更新的大数据,是能够验证这个算法准确性并不断优化大数据分析结果的有效途径。
先行绑定最急需数据的需求方的项目,将获得胜利。
目前,在大数据领域最愿意买单的基本都是金融领域的客户,银行、保险公司等等。他们要对用户进行多方位的分析和服务,所以购买意愿非常强。下一层,是新兴的互联网公司,为了更精准的获取用户、提高转化率,也比较愿意买单,比如说像新美大等等。下一步,可能会过渡到消费品行业当中去。
基于大数据的那些商机
SaaS类项目凭什么火?
很多人其实不明白SaaS模式和传统的软件服务到底有什么区别,为什么说它是一个基于大数据而兴起的行业呢?
SaaS和传统软件服务,中间有非常多的区别。最基础的区别,就是他们整个架构是不同的:SaaS是建立在公有云上的,标准化的模块服务,数据也储存在SaaS的公有云平台上。而传统的软件服务基本上是部署在局域网内的。这种架构上的区别决定所有的其他区别。
比如,因为SaaS架构在云端,而且秉承标准化、普适化原则,所以,实施过程非常快。至少,实施前的现场搭建工作要少很多,那么获取用户也相应的加快。能传统模式要很长时间才能累计几百个客户,而SaaS模式可以在短时间内累积上千、上万的客户都不难。
再比如,付费模式上的不同,传统软件有前期实施费、每年更新的费用、专门的定制服务费用、故障解决费用等等。整体来讲,费用高、缴费繁复,往往只有大企业才消费的起。而SaaS一方面减少了初期部署成本、且系统和架构可以服务于多个用户。它的收费模式基本上,是收月费或者年费,一个月只有几百块,很多中小企业,都可以享受到服务。
智能硬件和人工智能的收获期还很漫长
大数据和智能硬件相结合的模式,其实目前还很有挑战性,最主要的原因还是出在大数据的数量级上。目前智能硬件的出货量远不能匹配大数据所需的数量级。目前,国内出货量最大的是小米手环,第二是360儿童卫士。剩下的智能硬件出货量,往往在十几万到几十万就是比较好的量级。这跟C端大数据千万、亿级的要求还相差百倍呢。
人工智能领域相对好一些,属于如日方升的情况。在海外的谷歌、亚马逊、软银,已经在投资一些投资标的,但是依然是一些概念领域的项目,不是立即可以商业化的服务。包括谷歌的无人车,就算已经能够积累了上百万英里的安全驾驶里程,但要应用还是有一定过程。国内也有少数的天使、早期机构,已经看好这个领域开始投资,但它的开花结果期那可能还要至少再等五年。
所以,这个领域的投资要有一定耐心,目前比较有希望兑现的领域,包括语音语义识别、AR/VR、无人机等。
Q&A环节
Q:小散参与大数据、AI的SaaS的投资是否可行呢?
A:我觉得,目前小散想要参与这一领域投资的唯一途径,可能就是通过股权众筹。这些项目的行业门槛决定了,小散要想投这类项目最好还是通过专业性的众筹平台。
具体而言,原因有几个方面:
项目的门槛高。我们小散接触项目往往是通过自己的朋友圈子,但这类项目的创业者基本都是专业人员,我们的小散是接触不到的。
这类项目对创始人的专业经验要求高,小散难以进行这种专业性的项目尽调。而专业的众筹平台,在把项目推广给各位于中小投资人之前,就已经对项目做过背景调查。实现对于小散投资实现一个保护。
总而言之,这类项目行业门槛高,专业性要求高,小散想投资一定要找天使客这样负责任的众筹平台
Q:大家都说我们现在处于互联网时代,您强调我们现在是数据信息时代。这怎么理解?
A:我们现在就已经处在大数据信息时代,大数据和互联网移动互联网是不相冲突的,而且恰恰是互联网,特别是移动互联网的出现,使得可以有效采集的大数据大大提升,所以大数据时代是和移动互联网手挽手一起走过来的。
在这里我还是要推荐下我自己建的大数据学习交流qq裙:522189307 , 裙 里都是学大数据开发的,如果你正在学习大数据 ,小编欢迎你加入,大家都是软件开发党,不定期分享干货(只有大数据开发相关的),包括我自己整理的一份最新的大数据进阶资料和高级开发教程,欢迎进阶中和进想深入大数据的小伙伴。上述资料加群可以领取
-
大数据治理大数据可视化大数据平台大数据安全建设方案汇总共50份.zip
2022-04-03 21:38:12大数据中心建设方案.pptx 大数据云计算平台解决方案.pptx 大数据产品及解决方案.pptx 大数据介绍及应用.pptx 大数据内容营销解决方案.pptx 大数据分析平台介绍PPT.pptx 大数据分析技术架构解决方案.pptx 大数据前沿... -
【精品推荐】大数据治理和大数据分析及大数据可视化应用方案汇总共12份.zip
2022-03-04 11:42:24大数据治理和大数据分析及大数据可视化应用方案汇总共12份 大数据治理平台解决方案共35页.pptx 大数据治理数据支撑平台与数据管控平台建设方案共53页.pptx 大数据治理方案共27页.pptx 大数据治理解决方案共62页.pptx... -
【精品推荐】大数据可视化+大数据安全+大数据运维+大数据治理方案汇总共5份.zip
2022-03-16 21:30:04大数据中心IT开发运维一体化平台建设规划方案共28页.pptx 大数据中心(大数据信息中心)...大数据安全解决方案共16页.pptx 大数据方案大数据可视化平台数据治理方案共227页.doc 大数据管理与应用解决方案共30页.pptx -
什么是大数据 究竟多大才算是大数据,大数据怎么学习?
2019-12-23 19:47:54多大的数据叫大数据?红火一时的数据分析走向了我们,纷纷称不分析数据企业将长久不了,可是究竟什么样的数据才是大数据呢,什么样的数据才是最大的呢? 如果你没有接触过大数据,那么你就不知道大数据究竟有多大,...大数据,什么是大数据呢?多大的数据叫大数据?红火一时的数据分析走向了我们,纷纷称不分析数据企业将长久不了,可是究竟什么样的数据才是大数据呢,什么样的数据才是最大的呢?
如果你没有接触过大数据,那么你就不知道大数据究竟有多大,大到什么样的数据才能称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。
大数据开发学习有一定难度,零基础入门首先要学习Java语言打基础,一般而言,Java学习SE、EE,需要约3个月的时间;然后进入大数据技术体系的学习,主要学习Hadoop、Spark、Storm等。
什么是大数据 究竟多大才算是大数据
大数据是什么?
多大的数据叫大数据?
很多没有接触过大数据的人,都很难清楚地知道,究竟多大的数据量才可以称之为大数据。那么,根据数据收集的端口,企业端与个人端之间,大数据的数量级别是不同的。
企业端(B端)数据近十万的级别,就可以称为大数据;个人端(C端)的大数据要达到千万级别。收集渠道没有特定要求,PC端、移动端或传统渠道都可以,重点要达到这样数量级的有效数据,形成数据服务即可。很有趣,大家可以看到2B和2C,两类大数据差了两个数量级。
有些小公司,数据只有千到万级的规模,但经过收集分析,也能从中有针对性的总结出这一群体的原则,同样能指导企业进行一定程度的用户分析、获取或者是服务工作,但这并不是大数据,而是一般性的数据挖掘。
刚刚天小妹分享的那个案例,说今年年初有个用50块本金摆地摊卖水果的中年人,他并不懂得大数据,但是他对水果的收成了若指掌:他知道哪个地方下了多少雨,水果的甜度会到多少,如果你对大数据开发感兴趣,想系统学习大数据的话,可以加入大数据技术学习交流扣群:458数字345数字782获取学习资源哪些地方的消费者会喜欢吃这个甜度的水果。卖到最后卖出了137家门店、4.7亿的年销售额。
这确实是一种小的数据挖掘,但并不是数据分析。大数据分析虽然脱胎于此,但大数据面向的是更海量的一个数据,借助了更广义的知识数据库的分析方法。大部分的数据公司的数据来源是海量的,它的收集和分析,并不是局限于个体,而是以一个非常非常广泛的群体为对象展开的。
大数据的产业链是怎样的?
我在接受采访的时候,依照大数据公司在产业链的上下游关系,提出把它们分成三种不同类别:
大数据采集公司
所谓“找数据”,内部可以再分两种:
在自身正常运营的过程中就能产生大量数据源;
通过跟电信运营商、金融企业合作,获取数据源。
大数据分析公司
这一类公司,基本上都有自己的套模型,但大部分数据库模型源于相同的几个机理,包括统计学模型、深度学习算法等等。也基于美国IBM、cloudera公司开发的应用型分析模块等等。
大数据销售公司
虽然说是卖数据,但出售的并不是单一数据,而是基于数据的全套解决方案,比如精准营销等等。
这三类公司是如何协作,并把大数据作用于我们的生活呢?最容易理解的就是现在在微信朋友圈上投放的广告。
腾讯在把广告推广给每个用户的时候,都已经对用户做过精准的分析。通过收集人们在微信上使用习惯,进而分析用户的消费能力、消费习惯,形成一套精准营销方案后,给广告商生成一些定向的广告。
比如说,兰蔻的广告就从来不会推广给男性用户、豪车广告也不会推给应届毕业生。整个的微信广告体系都用到了大数据的分析模式,大家普遍反馈,在腾讯上投放的广告比网易、新浪等平台上投放的广告转化率高,正是得益于腾讯的大数据基础。
大数据公司的投资价值
如何理解大数据的投资价值?
大数据如今这么火,其商业价值显而易见,但是能真正兑现的人并不多。
要兑现大数据的商业价值,第一个要求,就是达到大数据的数据量级。那么目前,在数据量上最有优势是BAT三家。在PC时代,百度在数据上的优势非常强,但到移动时代,腾讯和阿里实现了反超。
腾讯有微信、QQ,拿到了移动端数据生成量的九成;阿里利用它的消费数据资源,更有垂直性。那么对于中小企业、创业企业而言,兑现商业价值的重点就变成了,如何在自身规模较小的时候,利用别人的大数据资源为自己的创业更好的服务。这是需要深层次判断和挖掘的。
所以,对于数据相关的公司,在投资判断的时候,不单是看现有业务的发展,更重要的是在他不断的发展的过程中,能不能积累有效数据、积累高准确性的数据,实现数据的实时更新性。这样的企业才能够更好地建立起竞争壁垒。
比如,在开发者服务领域,比如talkingdata极光等等,我们复星昆仲在看项目时非常看重的一点,就是现在项目所经营的业务是单一为开发者提供服务?还是在服务之余,给自己的积累有效数据,形成长期壁垒?
2B是大数据行业的突破口
我之前有提到BAT对大数据收集是垄断性的,创业企业想要在C端达到海量数据(千万级甚至上亿的C端用户)非常难。目前,国内月活真正过亿的app只有15个,渗透率前10的app都是BAT所控制的,比如微信、QQ、淘宝、UC浏览器等。如果绕开BAT,能拥有C端海量数据的,就只有相对传统的电信业、金融业等等。
可见,如果想投资大数据领域的公司,从C端下手难度很高。所以,我觉得在如果想在大数据行业布局,2B领域才是关键:一方面2B发展较晚,BAT还没有形成垄断;第二,开发门槛相对较高的;第三,数据量需求量相对较少,达到十万级别就可以为大数据的分析服务,所以如果想在大数据领域进行投资,要关注的主要领域是2B领域。
在2B领域,有三个不同的类别:
第一类,是B2B交易平台;目前的趋势,基本上是行业垂直领域的电子商务交易平台,核心竞争力就是打破买卖双方的信息不对称、不透明。所以这种领域公司的关键点并不是记录交易量,而是每一个有效的数据信息。在这个领域,我们投资过惠民网,主要服务于中小商超和其供货商的交易平台,再比如各种“找”系列项目等等。
第二类,是现在很火的企业服务,以SaaS为主;比如客户管理的CRM、人力板块的HRM等等。他们在得到用户许可并保证数据安全的前提下,通过服务大量的企业来积累企业用户,和企业员工数据。比如理才网等等。
第三类,是针对于开发者的服务;云存储、运行数据的统计推送以及app内的即时通信等。
复星昆仲主要是在这三类的2B项目当中的进行投资,因为这些项目的2B业务模式可以有效积累大数据。这就是为什么复星同时关注大数据和2B领域的企业服务——因为在2B领域的企业服务,能够找到最好最有效的大数据。
2B行业的未来投资标的
如果我们预测一下这个行业的未来,我有以下几个观点。
拥有丰富大数据源的企业,会成为整个行业内最炙手可热的投资标的。
在大数据行业里,分析算法上的差别,造成的分析结果准确性、实用性的差异是93分和95分的区别。而因数据源质量造成的差别,是60分和90分的不同。特别是,一个不断更新的大数据,是能够验证这个算法准确性并不断优化大数据分析结果的有效途径。
先行绑定最急需数据的需求方的项目,将获得胜利。
目前,在大数据领域最愿意买单的基本都是金融领域的客户,银行、保险公司等等。他们要对用户进行多方位的分析和服务,所以购买意愿非常强。下一层,是新兴的互联网公司,为了更精准的获取用户、提高转化率,也比较愿意买单,比如说像新美大等等。下一步,可能会过渡到消费品行业当中去。
基于大数据的那些商机
智能硬件和人工智能的收获期还很漫长
大数据和智能硬件相结合的模式,其实目前还很有挑战性,最主要的原因还是出在大数据的数量级上。目前智能硬件的出货量远不能匹配大数据所需的数量级。目前,国内出货量最大的是小米手环,第二是360儿童卫士。剩下的智能硬件出货量,往往在十几万到几十万就是比较好的量级。这跟C端大数据千万、亿级的要求还相差百倍呢。
人工智能领域相对好一些,属于如日方升的情况。在海外的谷歌、亚马逊、软银,已经在投资一些投资标的,但是依然是一些概念领域的项目,不是立即可以商业化的服务。包括谷歌的无人车,就算已经能够积累了上百万英里的安全驾驶里程,但要应用还是有一定过程。国内也有少数的天使、早期机构,已经看好这个领域开始投资,但它的开花结果期那可能还要至少再等五年。
所以,这个领域的投资要有一定耐心,目前比较有希望兑现的领域,包括语音语义识别、AR/VR、无人机等。
SaaS类项目凭什么火?
很多人其实不明白SaaS模式和传统的软件服务到底有什么区别,为什么说它是一个基于大数据而兴起的行业呢?
SaaS和传统软件服务,中间有非常多的区别。最基础的区别,就是他们整个架构是不同的:SaaS是建立在公有云上的,标准化的模块服务,数据也储存在SaaS的公有云平台上。而传统的软件服务基本上是部署在局域网内的。这种架构上的区别决定所有的其他区别。
比如,因为SaaS架构在云端,而且秉承标准化、普适化原则,所以,实施过程非常快。至少,实施前的现场搭建工作要少很多,那么获取用户也相应的加快。能传统模式要很长时间才能累计几百个客户,而SaaS模式可以在短时间内累积上千、上万的客户都不难。
再比如,付费模式上的不同,传统软件有前期实施费、每年更新的费用、专门的定制服务费用、故障解决费用等等。整体来讲,费用高、缴费繁复,往往只有大企业才消费的起。而SaaS一方面减少了初期部署成本、且系统和架构可以服务于多个用户。它的收费模式基本上,是收月费或者年费,一个月只有几百块,很多中小企业,都可以享受到服务。
Q&A环节
Q:小散参与大数据、AI的SaaS的投资是否可行呢?
A:我觉得,目前小散想要参与这一领域投资的唯一途径,可能就是通过股权众筹。这些项目的行业门槛决定了,小散要想投这类项目最好还是通过专业性的众筹平台。
具体而言,原因有几个方面:
项目的门槛高。我们小散接触项目往往是通过自己的朋友圈子,但这类项目的创业者基本都是专业人员,我们的小散是接触不到的。
这类项目对创始人的专业经验要求高,小散难以进行这种专业性的项目尽调。而专业的众筹平台,在把项目推广给各位于中小投资人之前,就已经对项目做过背景调查。实现对于小散投资实现一个保护。
总而言之,这类项目行业门槛高,专业性要求高,小散想投资一定要找天使客这样负责任的众筹平台
Q:大家都说我们现在处于互联网时代,您强调我们现在是数据信息时代。这怎么理解?
A:我们现在就已经处在大数据信息时代,大数据和互联网移动互联网是不相冲突的,而且恰恰是互联网,特别是移动互联网的出现,使得可以有效采集的大数据大大提升,所以大数据时代是和移动互联网手挽手一起走过来的。
什么是大数据,究竟多大的数据才能称之为大数据,你知道了吗,如果想要学习大数据技术,那就努力吧,在未来的路上,懂得分析数据,你才能掌握未来!
-
大数据数据治理及大数据可视化解决方案汇总共20份.zip
2022-03-02 13:34:23大数据分析平台介绍PPT.pptx 大数据分析技术架构解决方案.pptx 大数据可视化平台规划及架构建设方案.pptx 大数据可视化的发展演变和应用实例.pptx 大数据平台介绍方案.pptx 大数据平台整体解决方案.pptx 大数据应用... -
大数据挖掘weka大数据分类实验报告材料.docx
2022-07-03 11:11:00大数据挖掘weka大数据分类实验报告材料.docx大数据挖掘weka大数据分类实验报告材料.docx大数据挖掘weka大数据分类实验报告材料.docx大数据挖掘weka大数据分类实验报告材料.docx大数据挖掘weka大数据分类实验报告材料... -
大数据如何采集数据?大数据的数据从何而来?
2021-08-25 09:37:20大数据一直都是一个比较神秘的行业,近年来因为大数据杀熟才被多的普通人所了解,那么你有没有想过大数据不论是开发还是分析,里面的数据都是从何而来的呢? 1.通过自有产品收集 简单的方式就是通过自有的产品收集...大数据一直都是一个比较神秘的行业,近年来因为大数据杀熟才被多的普通人所了解,那么你有没有想过大数据不论是开发还是分析,里面的数据都是从何而来的呢?
1.通过自有产品收集
简单的方式就是通过自有的产品收集用户数据,我们无论使用任何的app都需要注册个人账号才可以使用,这个账号内存储的就是我们的数据,这个时候相关企业就可以通过我们的数据来分析潜在需求进行不同的推荐。
2.收购其他公司
细心的同学会发现有一些大公司特别热衷于收购其他公司,你有想过为什么吗?其中很大的原因就是被收购的公司有他们需要的用户数据,通过收购直接获取想要数据是方便的方式,所以你才会发现那么多大公司这么热衷于收购其他公司。
3.爬虫
第三种方式就是通过爬虫获取数据了,不过这种方式获取数据比较局限,只能去获得网络上的数据,而一些用户数据还是很难得到的。
其实大数据开发或者分析重要的是如果通过这些大量的数据去筛选出自己想要的数据并通过数据进一步去分析用户下一步可能的操作,所以同学们对数据来源有了解即可不需要过多去深入了解。
本文来自千锋教育,转载请注明出处。
-
【精品推荐】大数据可视化+大数据治理+大数据运维+大数据安全方案汇总共5份.zip
2022-03-16 21:31:45大数据与大数据安全介绍与应用共58页.pptx 大数据可视化平台技术架构及应用方案共63页.ppt 大数据平台数据治理体系建设和管理方案共62页.docx 大数据平台规划方案大数据平台数据治理规划方案大数据应用融合规划方案... -
【精品推荐】大数据可视化+大数据运维+大数据治理+大数据安全方案汇总共5份.zip
2022-03-16 21:29:01基于大数据的安全运维一体化解决方案共47页.ppt 大数据(云平台)安全保护技术及产品共18页.pptx 大数据平台数据治理和挖掘解决方案共65页.ppt ...智慧运维大数据分析管理平台建设综合解决方案共229页.doc -
大数据看板、大屏展示、数据可视化原型
2020-07-27 18:02:55大数据看板、大屏展示、数据可视化原型大数据看板、大屏展示、数据可视化原型大数据看板、大屏展示、数据可视化原型大数据看板、大屏展示、数据可视化原型大数据看板、大屏展示、数据可视化原型大数据看板、大屏展示... -
第一章 数据与大数据
2021-01-23 15:03:41这一章讲的是一些关于数据的定义以及大数据所面临的一些挑战、从国家层面制定的一些将大数据运用到生活中的政策等问题。 1.1 数据---->大数据---->多边定义和理解出发(价值期望)不同的领域对于大数据有着... -
中国大学数据科学与大数据技术专业排名!2021软科排名
2021-11-14 00:59:45在数据科学与大数据技术专业排名中,共有309所高校上榜,A+层次的高校依次为哈尔滨工业大学、北京大学、中国科学技术大学、电子科技大学、同济大学、华东师范大学、复旦大学、中国人民大学、北京理工大学、西北工业... -
2022年大数据治理大数据平台解决方案PPT合集(26份).zip
2022-03-23 13:30:21市大数据中心大数据资源平台概要设计方案.pptx 政务大数据平台建设方案.pptx 政务大数据资源平台建设解决方案.pptx 数据大脑智慧工厂数据平台建设方案.pptx 新型智慧城市-城市大数据应用解决方案.pptx 新型智慧城市... -
大数据开发跟大数据分析的区别是什么?
2019-06-01 13:15:18做大数据开发好还是大数据分析比较好一些?哪个薪资高? 零基础学习大数据开发,还是大数据分析?哪方面比较好? 今天我们来从技术角度和薪资角度全面进行分析,方便你的选择。 技术区别 在做选择之前,需要了解... -
大数据学习方法:大数据采集,大数据分析,大数据存储就该这样学!
2019-02-27 17:21:39大数据采集 01 — 概览 02 — 相关延展 系统日志数据的采集 Scribe是Facebook开源的日志收集系统,在Facebook内部已经得到大量的应用。它够从各种日志源上收集日志,存储到一个中央存储系统上,以便于... -
基于大数据挖掘----浅谈大数据与大数据挖掘
2019-01-21 14:38:51基于大数据挖掘----浅谈大数据与大数据挖掘 一、大数据技术 1.1大数据的定义 大数据是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现... -
Hive在大数据分析和大数据仓库中应用实战
2019-06-11 10:11:56随着大数据技术的不断发展壮大, Hive不再是大数据技术生态圈中一个普通的工具,而是在大数据分析和大数据仓库中占据着几乎不可替代的重要作用,大数据分析中Hive和Hbase、Hive和Spark SQL、Hive和Impala的结合使用... -
大数据概述:传统数据与大数据的区别
2019-11-27 21:17:19传统数据处理介绍 数据来源: 1、企业内部管理系统 ,如员工考勤(打卡)记录。 2、客户管理系统(CRM) 数据特征: 1、数据增长速度比较...1、数据量越来越大、数据处理的速度越来越慢。 2、数据种类越来越多,出现... -
大数据开发涉及到的关键技术有哪些?
2021-01-07 03:38:51大数据关键技术涵盖数据存储、处理、应用等多方面的技术,根据大数据的处理过程,可将其分为大数据采集、大数据预处理、大数据存储及管理、大数据处理、大数据分析及挖掘、大数据展示等。 大数据采集技术 大数据... -
传统数据与大数据的区别
2020-10-14 20:16:521)多个硬盘制作一个逻辑卷,即将多个物理磁盘制作成一个大的逻辑硬盘 大数据 1.系统硬盘 1)两块硬盘做一个RAID1 2)引导分区: 200M 3)交换分区: 可以不设置或设置的很小。因为在大数据中需要将其关闭 4)根分区... -
大数据开发、大数据分析、大数据运维主要工作各是什么?哪个好?
2019-02-15 16:11:23大数据开发、大数据分析、大数据运维都围绕着大数据展开。如果我们把大数据去掉,就只剩下,开发,分析,运维。当然还有其它的工作,例如运营,产品,讲师,测试等。 加上了大数据,只是我们的工作内容,或者说是... -
从0到1搭建大数据平台之数据采集篇
2022-03-31 14:07:17大数据平台基础理论之数据集成篇。 -
大数据开发、大数据分析、大数据运维主要工作各是什么?哪个好?谢谢?
2020-02-15 15:26:32大数据开发、大数据分析、大数据运维都围绕着大数据展开。如果我们把大数据去掉,就只剩下,开发,分析,运维。当然还有其它的工作,例如运营,产品,讲师,测试等。 加上了大数据,只是我们的工作内容,或者说是... -
数据集成-7-大数据&数据集成
2022-03-15 09:03:42数据集成-7-大数据&数据集成 -
比较传统数据与大数据
2019-10-11 19:55:49二、比较传统数据挖掘与大数据挖掘 1、技术背景的差异: 传统数据挖掘基于数据库、数据仓库及互联网发展背景下,实现从独立、横向到纵向数据挖掘的发展。 大数据是在大数据背景下得益于云计算、物联网、移动终端... -
什么是大数据?什么是数据科学
2019-12-24 17:17:41适用于大数据的技术,包括大规模并行处理(MPP)数据库,数据挖掘电网,分布式文件系统,分布式数据库,云计算平台,互联网,和可扩展的存储系统。 大数据的特点 具体来说,大数据具有4个基本特征: 一是... -
大数据,多大算“大
2019-02-25 11:08:48在数据“泛滥”的今天,人人都在提“大数据”,但多大的数据才算“大”呢?如果盲目的强调“大”,结果只会被数据淹没,从而导致信息过量,最终对决策不仅没有帮助反而使人困惑、不知所措。今天,我们来谈一谈信息...