ClickHouse集群面对大量数据查询性能优异,但是具有难扩容、建表繁琐、Zo... 展开 >







郭炜,人称“郭大侠”,ClickHouse 中国社区发起人,Apache Foundation Member,Apache DolphinScheduler PMC。中国软件行业协会智能应用服务分会副主任委员,TGO 北京董事会学习委员,全球中小企业创业联合会副会长,人民大学大数据商业分析研究中心客座研究员。
郭大侠曾任易观 CTO,联想研究院大数据总监,万达电商数据部总经理,并曾在中金、IBM、Teradata 公司担任大数据方向重要岗位,对大数据前沿领域研究做出过卓越贡献。
郭大侠一直致力于让“数据能力平民化”的事业上,本人参与多个开源项目,非常擅长深入简出地讲解复杂的大数据和开源概念,被评为虎啸 10 年杰出数字人物。郭大侠在易观从 0 到 1 打造了一支技术团队,建设了 6.8Pb、月活用户 6.02 亿大数据平台,完成易观千帆、方舟等多个商业数据产品,促进了 Apache Dolphin Scheduler 开源并成为 Apache 顶级项目。
ClickHouse集群面对大量数据查询性能优异,但是具有难扩容、建表繁琐、ZooKeeper瓶颈、不支持高并发等痛点。本专题将结合大型厂商的ClickHouse集群真实实践案例,从短期、中期、长期使用经验三个层次,由浅入深地给你带来应用ClickHouse集群的痛点问题的解决方案,帮助你得心应手地驾驭这匹ClickHouse黑马。
随着 ClickHouse 越来越火热,很多公司都迫切地想体验一下这匹来自战斗民族的黑马,但体验这匹黑马,首先需要解决原有 Hive 数据仓库的数据和 ClickHouse 的互通问题。
本次分享主要带来唯品会如何选型组件 Sea Tunnel (原 Waterdrop) 完成 ClickHouse 和 Hive 的数据出仓入仓,内容包括过程中唯品会遇到了哪些痛点,是怎么解决的,在原有的功能上做了哪些优化等等,希望能和大家互相学习,交流经验。
演讲提纲:
听众受益:
ClickHouse 的实时处理能力强悍,网易使用 ClickHouse 搭建了数据平台,承担数据存储和指标计算任务。但是数据平台在使用过程中,我们发现了 ClickHouse 的一些痛点问题:
网易是如何解决这些问题的?这是我今天要分享的重点,希望能和你一起交流讨论,给你在使用 ClickHouse 时提供一些帮助。
演讲提纲:
听众受益:
2016 年 ClickHouse 刚开源时,云智慧就被它强悍的查询性能和可以支撑的数据规模所吸引到,期望能将它应用于 AIOps 的场景中。随着 ClickHouse 本身的迭代完善和对其不断学习和研究,到 2018 年我们已经将 ClickHouse 作为了我们 AIOps 产品运维主数据的存储引擎,其以成本优势、支撑的数据规模和查询性能在实际项目中得到了不少客户的认可。迄今为止,已经服务了约数百个大中型的客户,在这个过程中,也遇到了不少问题和挑战,很高兴能和广大 ClickHouse 的用户和爱好者进行分享和交流,希望能互相学习共同进步。
演讲提纲:
你将获得:
在使用 ClickHouse 集群时,很多人都以为必须使用 ZooKeeper。实际上 ZooKeeper 只是起到了一个辅助作用,可以让不熟练的人快速上手。事实上,用了 ZooKeeper 会在数据录入上导致不小的麻烦。因此,本次我分享的重点是联想如何去除 ZooKeeper 的依赖。
演讲提纲:
你将获得:
微信丰富多样的业务生态对数据分析产生了巨大的需求,如何对无时无刻不在产生的海量数据进行分析也成了一个艰巨的挑战。ClickHouse 作为当前 OLAP 领域的一匹快马,目前已成为微信团队实现数据驱动的重要载具。本次分享将聚焦 ClickHouse 的海量数据接入问题,分享微信 OLAP 团队在 ClickHouse 数据接入层累积的经验。
演讲提纲:
针对业务日志信息的统计是一种常见的需求场景,实现方法也多种多样。中国移动在数据千亿条的场景下,先尝试了 ETL+MySQL,可处理的数据量又无法满足需求,又尝试了 ETL+Hive,但计算性能较差。我们希望在满足容量需求的情况下,能达到较好的性能,对整体架构进行了优化。本次分享将给大家带来使用 ClickHouse 实现千亿条日志数据统计的架构落地及优化,以及 ClickHouse 在这个过程中有哪些优势又有哪些问题。
演讲提纲:
你将获得:



微信咨询

电话咨询
微信联系我们
