常见的大数据术语表(中英对照简版):亚博网页版登陆界面
发布时间:2021-09-16  

亚博网页版登陆界面

亚博网页版登陆界面:大数据的泛起带来了许多新的术语,但这些术语往往比力难以明白。因此,我们通过本文给出一个常用的大数据术语表,抛砖引玉,供大家深入相识。其中部门界说参考了相应的博客文章。

固然,这份术语表并没有100%包罗所有的术语,如果你认为有任何遗漏之处,请告之我们。A聚合(Aggregation) – 搜索、合并、显示数据的历程算法(Algorithms) – 可以完成某种数据分析的数学公式分析法(Analytics) – 用于发现数据的内在涵义异常检测(Anomaly detection) – 在数据集中搜索与预期模式或行为不匹配的数据项。除了“Anomalies”,用来表现异常的词有以下几种:outliers, exceptions, surprises, contaminants.他们通常可提供关键的可执行信息匿名化(Anonymization) – 使数据匿名,即移除所有与小我私家隐私相关的数据应用(Application) – 实现某种特定功效的盘算机软件人工智能(Artificial Intelligence) – 研发智能机械和智能软件,这些智能设备能够感知周遭的情况,并凭据要求作出相应的反映,甚至能自我学习B行为分析法(Behavioural Analytics) – 这种分析法是凭据用户的行为如“怎么做”,“为什么这么做”,以及“做了什么”来得出结论,而不是仅仅针对人物和时间的一门分析学科,它着眼于数据中的人性化模式大数据科学家(Big Data Scientist) – 能够设计大数据算法使得大数据变得有用的人大数据创业公司(Big data startup) – 指研发最新大数据技术的新兴公司生物测定术(Biometrics) – 凭据小我私家的特征举行身份识别B字节 (BB: Brontobytes) – 约即是1000 YB(Yottabytes),相当于未来数字化宇宙的巨细。

1 B字节包罗了27个0!商业智能(Business Intelligence) – 是一系列理论、方法学和历程,使得数据更容易被明白C分类分析(Classification analysis) – 从数据中获得重要的相关性信息的系统化历程; 这类数据也被称为元数据(meta data),是形貌数据的数据云盘算(Cloud computing) – 构建在网络上的漫衍式盘算系统,数据是存储于机房外的(即云端)聚类分析(Clustering analysis) – 它是将相似的工具聚合在一起,每类相似的工具组合成一个聚类(也叫作簇)的历程。这种分析方法的目的在于分析数据间的差异和相似性冷数据存储(Cold data storage) – 在低功耗服务器上存储那些险些不被使用的旧数据。但这些数据检索起来将会很耗时对比分析(Comparative analysis) – 在很是大的数据集中举行模式匹配时,举行一步步的对比和盘算历程获得分析效果庞大结构的数据(Complex structured data) – 由两个或多个庞大而相互关联部门组成的数据,这类数据不能简朴地由结构化查询语言或工具(SQL)剖析盘算机发生的数据(Computer generated data) – 如日志文件这类由盘算机生成的数据并发(Concurrency) – 同时执行多个任务或运行多个历程相关性分析(Correlation analysis) – 是一种数据分析方法,用于分析变量之间是否存在正相关,或者负相关客户关系治理(CRM: Customer Relationship Management) – 用于治理销售、业务历程的一种技术,大数据将影响公司的客户关系治理的计谋D仪表板(Dashboard) – 使用算法分析数据,并将效果用图表方式显示于仪表板中数据聚合工具(Data aggregation tools) – 将疏散于众多数据源的数据转化成一个全新数据源的历程数据分析师(Data analyst) – 从事数据分析、建模、清理、处置惩罚的专业人员数据库(Database) – 一个以某种特定的技术来存储数据荟萃的堆栈数据库即服务(Database-as-a-Service) – 部署在云端的数据库,即用即付,例如亚马逊云服务(AWS: Amazon Web Services)数据库治理系统(DBMS: Database Manage亚博网页版登陆界面ment System) – 收集、存储数据,并提供数据的会见数据中心(Data centre) – 一个实体所在,放置了用来存储数据的服务器数据清洗(Data cleansing) – 对数据举行重新审查和校验的历程,目的在于删除重复信息、纠正存在的错误,并提供数据一致性数据治理员(Data custodian) – 卖力维护数据存储所需技术情况的专业技术人员数据道德准则(Data ethical guidelines) – 这些准则有助于组织机构使其数据透明化,保证数据的简练、宁静及隐私数据订阅(Data feed) – 一种数据流,例如Twitter订阅和RSS数据集市(Data marketplace) – 举行数据集买卖的在线生意业务场所数据挖掘(Data mining) – 从数据集中掘客特定模式或信息的历程数据建模(Data modelling) – 使用数据建模技术来分析数据工具,以此洞悉数据的内在涵义数据集(Data set) – 大量数。

本文来源:亚博网页版登陆界面-www.tfldt.com

亚博网页版登陆界面

下一篇:亚博网页版登陆界面| 新媒体·新起点!——我校团委被团省委授予首批新媒体中心校园事情站 上一篇: 119宣传月——消防宣传车走街串巷 普及消防宁静知识