知识点总结及感悟

算法学习第一天

一、数据结构

线性表顺序存储结构上的基本运算

1.查找操作

① 按序号查找GetData(L,i):查找顺序表中第i个数据元素。

根据顺序表L的存储特性,表中元素在L的elem数组中顺序存放,故GetData(L,i)的核心语句为L.elem[i-1]。

按内容查找Locate(L,e):查找顺序表L中与给定值e相等的数据元素。

在顺序表L中如找到与e相等的元素,则返回该元素在表中的序号;若找不到,则返回一个空序号标识,如-1。

【算法思想】查找运算可采用顺序查找,即从第一个元素开始,依次将表中元素与e相比较,若相等则查找成功,返回该元素在表中的序号;若e与表中的所有元素都不相等,则查找失败,返回-1。

【算法描述】顺序表的按内容查找运算

int Locate(SeqList L,ElemType e)/ * 在顺序表L中查找与e相等的元素,若L.elem[i]==e,则找到该元素并返回i+;若找不到,返回-1 * /

{

int i=0;/ * i为扫描计数器,初值为0,即从第一个元素开始比较 * / 

while(i<=L.last)&&(L.elem[i]!=e))/ * 顺序扫描表,直到找到值为e的元素,或扫描到表尾而找到 * /

i++;

if(i<=L.last)

return(i+1);/ *若找到值为e的元素,则返回其序号 * /

else

return(-1);/ * 若没找到,则返回空序号 * /

知识点总结

一、Hadoop入门

1.1 狭义上的Hadoop:

Apache软件基金会的一款开源软件,允许用户使用简单的编程模型实现跨机器集群对海量数据进行分布式计算处理。

1.2 广义上的Hadoop:

围绕Hadoop打造的大数据生态圈。

1.3 Hadoop核心组件:

HDFS(分布式文件存储系统):解决海量数据存储

YARN(集群资源管理和任务调度框架):解决资源任务调度

MapReduce(分布式计算框架):解决海量数据计算

1.4 Hadoop集群

Hadoop集群包括两个集群:HDFS集群,YARN集群

HDFS集群:

NameNode:集群当中的主节点,主要用于管理集群当中的各种数据

DataNode:集群当中的从节点,主要用于存储集群当中的各种数据

Secondary NameNode:主要能用于hadoop当中元数据信息的辅助管理

YARN集群:

ResourceManager:接收用户的计算请求任务,并负责集群的资源分配

NodeManager:负责执行主节点分配的任务

1.5 分布式与集群的区别

分布式:多台服务器集中在一起,每台服务器都实现总体中的不同业务,做不同的事情。

集群:一组独立的计算机系统构成的一多处理器系统,它们之间通过网络实现进程间的通信,让若干台计算机联合起来工作(服务),可以是并行的,也可以是做备份。

1.6 Hadoop模块之间的关系

  1. MapReduce 计算需要的数据和产生的结果需要HDFS来进行存储。

  2. MapReduce的运行需要由Yarn集群来提供资源调度。

今日感悟

在老师的带领下初步入门Hadoop,大概了解Hadoop的部分内容,同时在跟老师的交流过程中,本来还处于迷茫阶段的我,借着这个机会督促自己着手复习数据结构算法的相关内容,每天坚持完成一个算法问题,从简单到困难,一点点进步,有明确的目标再去做一件事,确实会让人专注地想要做完美。

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值