我瞎说,你瞎听。今天讲想法。你脑海中常见的想法是什么时候开始形成的呢。有多少想法是最近获得的。你有多久没有更新换代自己的想法看法了呢。是不是三年前的观念和现在一样。你是不是在一直成长? 20260420续 我们很多时候觉得,现在的自己就是最清醒、最成熟的自己。但你仔细扒拉扒拉脑子里的那些所谓“根深蒂固”的观点,很多其实是在你很小的时候,被长辈潜移默…
我瞎说,你瞎听。世界是不连续的,在事物与事物之间有缝隙。就像电影胶卷一样,看似连续的画面其实在画面与画面之间有间隙。今天我们来讲生活中的巇。 你入职了一家新公司,或者换了一个新项目,这时候你对这个行业内工作已游刃有余,你在看新项目的资料,着急又不着急,这时候你会感觉到巇。又比方说临近年底,大部分工作已做完剩下的着急又不着急,新的工作明年才能到来,这…
我瞎说,你瞎听。今天我们讲什么是无用之用,方为大用。一个事物有着体和用。比方说有一个铁杯子,他是个杯子,这就是体,我们用来喝水这就是用。如果我们只用这个杯子来喝水,那么就是小用。只有当我们忘记他是个杯子,暂时舍弃他的体之后,才能显出大用。一个铁杯子,能否用来防身呢?能否用来当导线呢?能否用来当装饰品呢?等等等等。 平时生活中的事,如果尝试用这个角度…
知识的跃迁 我瞎说,你瞎听,今天讲知识的跃迁。如何快速了解大英图书馆里所有知识?其实就是要靠知识的跃迁,知识的架构类似于金字塔,当你明白了上一层的知识后,再花经历去了解下一层的便无足轻重。在学习过程中自身不断向上跃迁,直至覆盖所有知识。但并不是意味着你可以直接来到金字塔塔尖。就像到达山顶一样。如果你选择直接爬悬崖当然是最短最快的一条路,但是也充满着…
Hadoop特性优点 扩容能力(scalability)。Hadoop是在可用的计算机集群间分配数据并完成计算任务的,这些集群可方便灵活的方式扩展到数以千计的节点。 成本低(economical)。Hadoop集群允许通过部署普通廉价的机器组成集群来处理大数据,以至于成本很低。看重的是集群整理能力。 效率高(efficiency)。通过并发数据,H…
Doris概述篇 前言 Doris由百度大数据部研发,之前叫百度Palo,于2017年开源,2018年贡献到 Apache 社区后,更名为Doris。 Doris简介 Apache Doris是一个现代化的基于MPP(大规模并行处理)技术的分析型数据库产品。 简单来说,MPP是将任务并行的分散到多个服务器和节点上,在每个节点上计算完成后,将各自部分…
Flink安装部署与快速入门 Flink概述 Flink组件栈 各层详细介绍: 物理部署层:Flink 支持本地运行、能在独立集群或者在被 YARN 管理的集群上运行, 也能部署在云上,该层主要涉及Flink的部署模式,目前Flink支持多种部署模式:本地、集群(Standalone、YARN)、云(GCE/EC2)、Kubenetes。Flink…
案例介绍 在陌陌中,每天都有数千万的用户聊天消息需要存储。而且,这些消息都是需要进行大量地保存,而读取会少很多。想想:我们在使用微信的时候,大多数时候,我们都是在发消息,而不是每时每刻查询历史消息。要存储这样海量的数据,HBase就非常适合了,HBase本身也非常适合存储这种写多读少的应用场景。本案例,将结合陌陌聊天业务背景,以HBase来存储海量…
简介 Hadoop 从 1970 年开始,大多数的公司数据存储和维护使用的是关系型数据库 大数据技术出现后,很多拥有海量数据的公司开始选择像Hadoop的方式来存储海量数据 Hadoop使用分布式文件系统HDFS来存储海量数据,并使用 MapReduce 来处理。Hadoop擅长于存储各种格式的庞大的数据,任意的格式甚至非结构化的处理 Hadoop…
Apache Flume简介 概述 Flume是Cloudera提供的一个高可用的,高可靠的,分布式的海量日志采集、聚合和传输的软件。 Flume的核心是把数据从数据源(source)收集过来,再将收集到的数据送到指定的目的地(sink)。为了保证输送的过程一定成功,在送到目的地(sink)之前,会先缓存数据(channel),待数据真正到达目的地…