从A—Z 归纳常见的大数据术语表.docx

从A—Z 归纳常见的大数据术语表.docx

ID:28359002

大小:27.23 KB

页数:9页

时间:2018-12-09

从A—Z 归纳常见的大数据术语表.docx_第1页
从A—Z 归纳常见的大数据术语表.docx_第2页
从A—Z 归纳常见的大数据术语表.docx_第3页
从A—Z 归纳常见的大数据术语表.docx_第4页
从A—Z 归纳常见的大数据术语表.docx_第5页
资源描述:

《从A—Z 归纳常见的大数据术语表.docx》由会员上传分享,免费在线阅读,更多相关内容在学术论文-天天文库

1、从A——Z归纳常见的大数据术语表2015-02-26BDA1213中关村大数据产业联盟一个常见的大数据术语表大数据的出现带来了许多新的术语,但这些术语往往比较难以理解。因此,我们通过本文给出一个常用的大数据术语表,抛砖引玉,供大家深入了解。其中部分定义参考了相应的博客文章。当然,这份术语表并没有100%包含所有的术语,如果你认为有任何遗漏之处,请告之我们。A·聚合(Aggregation)–搜索、合并、显示数据的过程·算法(Algorithms)–可以完成某种数据分析的数学公式·分析法(Analytics)–用于发现数据的内在涵义·异

2、常检测(Anomalydetection)–在数据集中搜索与预期模式或行为不匹配的数据项。除了“Anomalies”,用来表示异常的词有以下几种:outliers,exceptions,surprises,contaminants.他们通常可提供关键的可执行信息·匿名化(Anonymization)–使数据匿名,即移除所有与个人隐私相关的数据·应用(Application)–实现某种特定功能的计算机软件·人工智能(ArtificialIntelligence)–研发智能机器和智能软件,这些智能设备能够感知周遭的环境,并根据要求作出相应

3、的反应,甚至能自我学习B·行为分析法(BehaviouralAnalytics)–这种分析法是根据用户的行为如“怎么做”,“为什么这么做”,以及“做了什么”来得出结论,而不是仅仅针对人物和时间的一门分析学科,它着眼于数据中的人性化模式·大数据科学家(BigDataScientist)–能够设计大数据算法使得大数据变得有用的人·大数据创业公司(Bigdatastartup)–指研发最新大数据技术的新兴公司·生物测定术(Biometrics)–根据个人的特征进行身份识别·B字节(BB:Brontobytes)–约等于1000YB(Yott

4、abytes),相当于未来数字化宇宙的大小。1B字节包含了27个0!·商业智能(BusinessIntelligence)–是一系列理论、方法学和过程,使得数据更容易被理解C·分类分析(Classificationanalysis)–从数据中获得重要的相关性信息的系统化过程;这类数据也被称为元数据(metadata),是描述数据的数据·云计算(Cloudcomputing)–构建在网络上的分布式计算系统,数据是存储于机房外的(即云端)·聚类分析(Clusteringanalysis)–它是将相似的对象聚合在一起,每类相似的对象组合成一

5、个聚类(也叫作簇)的过程。这种分析方法的目的在于分析数据间的差异和相似性·冷数据存储(Colddatastorage)–在低功耗服务器上存储那些几乎不被使用的旧数据。但这些数据检索起来将会很耗时·对比分析(Comparativeanalysis)–在非常大的数据集中进行模式匹配时,进行一步步的对比和计算过程得到分析结果·复杂结构的数据(Complexstructureddata)–由两个或多个复杂而相互关联部分组成的数据,这类数据不能简单地由结构化查询语言或工具(SQL)解析·计算机产生的数据(Computergenerateddat

6、a)–如日志文件这类由计算机生成的数据·并发(Concurrency)–同时执行多个任务或运行多个进程·相关性分析(Correlationanalysis)–是一种数据分析方法,用于分析变量之间是否存在正相关,或者负相关·客户关系管理(CRM:CustomerRelationshipManagement)–用于管理销售、业务过程的一种技术,大数据将影响公司的客户关系管理的策略D·仪表板(Dashboard)–使用算法分析数据,并将结果用图表方式显示于仪表板中·数据聚合工具(Dataaggregationtools)-将分散于众多数据源

7、的数据转化成一个全新数据源的过程·数据分析师(Dataanalyst)–从事数据分析、建模、清理、处理的专业人员·数据库(Database)–一个以某种特定的技术来存储数据集合的仓库·数据库即服务(Database-as-a-Service)–部署在云端的数据库,即用即付,例如亚马逊云服务(AWS:AmazonWebServices)·数据库管理系统(DBMS:DatabaseManagementSystem)–收集、存储数据,并提供数据的访问·数据中心(Datacentre)–一个实体地点,放置了用来存储数据的服务器·数据清洗(Da

8、tacleansing)–对数据进行重新审查和校验的过程,目的在于删除重复信息、纠正存在的错误,并提供数据一致性·数据管理员(Datacustodian)–负责维护数据存储所需技术环境的专业技术人员·数据道德准则(Dat

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。