返回
繁体
首页

还好我重生了!

视觉:
关灯
护眼
字体:
大
中
小

第五百二十四章 大数据布局(2 / 3)
拿着39%的股权日後还有夺权的可能,马云才想引入陈学兵,在上市之前把雅虎这个隐患剔除。

    「你们想跑起一个购物节,必须要有a集群,或者.……找我,给你们搞备用机柜,甚至是分布式资料库。」

    陈总一步步端出了他真正想聊的话题。

    马云兀地清醒,犹疑道:「就是你那个……大数据中心?」

    :

    「对。」陈学兵笑道:「我们很快会在前海建造大数据中心,第一批项目只要上马,起码能帮你扛起静态流量,订单、支付、库存暂时靠你们的al和bm自己扛,等你把数据交给我们,我们以後就可以研发分布式资料库,解决高并发处理问题。」

    albm,初建的数据中心肯定替代不了,但是专业伺服器群比阿里的普通电信机房可强很多,只要伺服器内存够大、性能够强,就可以把经常查的数据放内存里,从以前的用户点一下→查一次资料库,变成用户点一下→伺服器自己内存里就有,从而不用查资料库,通过这种方式帮他把商品图片、页面、搜索、列表,缓存这些问题扛了。

    这样阿里自己的albm压力就会小很多。

    马云是不可能为了一天购物节就去买一大堆专业伺服器的,跟他合作,是最好的方案。

    但马云一听这个话题,顿时有点警惕了:「你要我们的数据?怎麽可能给你?」

    「我要的只是你们的历史日志,研究规律而已,你把用户数据脱敏了再交给我们不就行了。」

    这个问题,陈学兵早就找自家的工程师请教明白了。其实也不复杂。

    大数据中心的发展,必须有海量的数据支撑才能模拟各种场景,研究出对应的伺服器分配、分层算法,最好要有平台支撑,才能验证出真正好用的引擎,乃至高效的存储系统,高可用,容灾方案等等。

    他已经有微博这个平台。

    但是微博是轻社交,短文本,低频次的,数据还太单薄了,有一定社交系统的验证能力,但还撑不起分布式存储、高并发、实时计算、推荐算法、用户画像、风控这些真正值钱的大数据能力。

    而阿里的数据,是目前中国网际网路唯一的全量商业数据。

    淘宝加支付宝,加上b2b板块的1688,那就太全面了,商品,GG,支付,信用,一应俱全。

    但阿里的数据不可能轻易交给别人,做网际网路的都有这个意识。

    他今天把双11这个话题提出来,就是想一次性打破阿里「温水煮青蛙」、慢慢研究分布式引擎以缓解压力的想法,必须让马云看到利益就在眼前,才有足够的动力和他全面合作。

    其实他还准备了一些关於购物节的说辞,但马云既然已经提出「借用超市购物日」的精准说法,就说明对方不是没有产生过这种想法,只是没能力做。

    只需加强对方信念即可。

    :

    「我给你们挑了一天,11月11日,网上有种说法,叫光棍节,现在在校园里传播非常广,而且11月是零售行业淡季,在这种没有节日竞争的月份做促销,非常容易集中引爆流量.……双11购物节,你觉响不响亮?」陈总眼神带着诱惑。

    马云吞了口口水。

    双11,听着真不错啊。

    「这……下个月就双11,来不及了吧?」

    搞这种促销活动,也有货啊。

    到时候货不够,伺服器准备也不足,玩什麽?

    「你b2商城都没上线,我说的当然是明年了,花一年的时间去准备,才有可能一炮打响。」

    陈学兵说完,重提自己的方案:「年底之前我就开始建大数据中心,第一批伺服器明年秋季之前就可以上柜,明年秋季,我来尝试给你们伺服器减负,同步帮你研究分布式引擎,11月之前帮你缓解资料库压力60%以上,三年之内,我帮你搞定分布式资料库方案。」

    「至於数据脱敏的问题……」他朝着对面的吴炯昂了昂下巴,「我谘询过了,挺简单的,你问问你们吴总就知道。」

    话到这里,其实房间里的人都在关注二人的对话了。

    马云抬眼看过去,首席技术官吴炯轻微点了下头。

    脱敏就是删掉用户标识,然後替换成随机数,一个普通工程师写个小脚本,几分钟就能跑完,挺简单的。脱敏以後看不到用户是谁,某用户买了啥,也看不到电话、地址、帐户,但流量规律、压力波形、卡顿点全部保留。

    马云皱了皱眉:「你们上个月不是说这种大数据中心模式不可行吗?」

    这一下露了底,原来阿里内部早就讨论过。

    「是不行,陈总,你们这样的商业模式怎麽坚持下来呢?」

    :

    吴炯立马又开口,一一列举缺点:

    「一台伺服器只能跑一个系统,服务一个网站,虚拟化技术目前很差,性能消耗巨大,怎麽可能把同一台机器切给很多家公司共用?

    「而且安全