返回试卷 在打印对话框中选择「另存为 PDF」即可下载

2026年湖南省计算机《大数据基础知识及应用》考前点题卷二

大数据基础知识及应用 / 考前点题 共 60 题 更新于 2026-09-27

一、单选题

下列每小题的选项中,只有一项是最符合题意的正确答案,多选、错选或不选均不得分。

1.
并行数据库的主要优势是什么?( )
  • A.提供更强的数据安全性。
  • B.简化数据库管理任务。
  • C.通过并行处理提升查询速度。
  • D.优化存储空间使用效率。

参考答案C

解析并行数据库是多个处理单元并行协同处理数据,核心优势是利用并行处理来提升查询速度。A选项,并行数据库重点不在数据安全;B选项,并行数据库反而可能使管理更复杂;D选项,并行数据库主要目的不是优化存储效率。所以答案选C。
2.
在协同过滤推荐中,"用户-物品矩阵"主要用于( )
  • A.存储物品的内容特征
  • B.表示用户对物品的评分数据
  • C.记录专家推荐结果
  • D.分析搜索引擎查询日志

参考答案B

解析用户 - 物品矩阵是用矩阵形式呈现用户对物品的评分等数据。A选项存储物品内容特征不是其主要用途;C选项记录专家推荐结果和D选项分析搜索引擎查询日志与用户 - 物品矩阵无关。答案:B
3.
生物信息学的目标是:( )
  • A.避免使用计算工具
  • B.仅进行物理实验
  • C.忽略数据整合
  • D.揭示生物机制和疾病基础

参考答案D

解析生物信息学是综合运用数学、计算机科学和生物学的各种工具来研究生物信息,其主要目标是通过对生物数据的分析等揭示生物机制和疾病基础。A选项,生物信息学需借助计算工具;B选项,不只是进行物理实验;C选项,数据整合是重要环节。所以答案选D。
4.
并行数据库“共享内存”架构的特点是( )
  • A.多个处理器共享同一内存空间
  • B.每个处理器拥有独立的内存
  • C.数据分散存储在多个磁盘上
  • D.将查询分解为多个子查询执行

参考答案A

解析共享内存架构就是多个处理器共享同一内存空间。B是共享磁盘架构特点;C不对应共享内存架构特点;D是并行查询处理的操作,并非共享内存架构特点。答案:A
5.
以下哪项是大数据治理的核心目标?( )
  • A.提升数据的价值和可用性
  • B.增加企业的原始数据总量
  • C.降低数据存储的硬件成本
  • D.加快数据在网络中的传输速度

参考答案A

解析大数据治理是对数据资产进行管理,核心是让数据更有价值且能方便使用。增加原始数据总量、降低存储硬件成本、加快数据传输速度都不是核心目标。所以答案选A。
6.
大数据技术的主要目标是解决数据的______问题,而人工智能是解决数据的______问题( )
  • A.存储/传输
  • B.分析/智能应用
  • C.采集/删除
  • D.加密/解密

参考答案B

解析大数据技术核心是对海量数据进行分析处理,人工智能则是让数据实现智能应用,如智能决策、智能交互等。所以大数据技术解决数据的分析问题,人工智能解决数据的智能应用问题。答案选B。
7.
零售行业中,客户群体细分的主要价值不包括以下哪项?( )
  • A.实现精准营销,提升促销效果
  • B.优化商品库存,减少滞销商品
  • C.为客户提供无差异的服务
  • D.提高客户的满意度与忠诚度

参考答案C

解析客户群体细分目的是区分不同客户特点来针对性服务,而“为客户提供无差异的服务”与细分目的相悖。答案:C
8.
协同过滤推荐中,“用户-项目”矩阵的主要作用是( )
  • A.存储专家的推荐意见
  • B.分析用户之间或项目之间的相似性
  • C.记录内容的特征属性
  • D.统计内容的点击量

参考答案B

解析协同过滤推荐基于用户或项目的相似性来推荐,“用户 - 项目”矩阵可用于分析用户间或项目间相似性。答案选B。
9.
由政府与互联网企业共同运营的大数据交易平台,按运营主体划分属于( )
  • A.公益型平台
  • B.企业型平台
  • C.混合型平台
  • D.联盟型平台

参考答案C

解析政府和互联网企业共同运营,结合了不同性质主体,属于混合型。答案选C。
10.
以下不属于物联网关键技术的是( )
  • A.传感器技术
  • B.边缘计算
  • C.虚拟专用网络(VPN)
  • D.M2M通信

参考答案C

解析物联网关键技术包括传感器技术用于数据采集,边缘计算可在靠近数据源处处理数据,M2M通信是机器间通信的重要手段。而虚拟专用网络(VPN)主要用于在公共网络上建立加密通道,保障网络通信安全,并非物联网核心关键技术。答案选C。
11.
在数据集成过程中,可能遇到的问题包括( )
  • A.数据脱敏失败
  • B.数据采集延迟
  • C.数据模式冲突
  • D.数据清洗过度

参考答案C

解析数据集成是将多个数据源中的数据整合到一起。数据模式冲突是常见问题,不同数据源可能有不同的数据结构和模式,整合时会产生冲突。数据脱敏失败主要是数据安全处理方面问题;数据采集延迟是数据采集阶段问题;数据清洗过度是数据清洗阶段问题。答案选C。
12.
查询分析计算代表产品是什么?( )
  • A.Spark Streaming
  • B.Giraph
  • C.Flume
  • D.Hive

参考答案D

解析Hive是基于Hadoop的数据仓库工具,可用于查询分析计算。Spark Streaming是流式处理框架;Giraph是用于大规模图计算;Flume是日志收集工具。答案选D。
13.
以下属于大数据核心特征之一的是( )
  • A.低容量
  • B.高价值密度
  • C.慢处理速度
  • D.数据类型多样

参考答案D

解析大数据特征为大量、多样、高速、低价值密度等。A选项低容量与大量相悖;B选项应是低价值密度;C选项是高速处理而非慢处理速度;D选项数据类型多样符合大数据特征。答案选D。
14.
NoSQL数据库通常用于处理哪种类型的数据?( )
  • A.高度结构化数据
  • B.关系型数据
  • C.事务密集型数据
  • D.非结构化数据

参考答案D

解析NoSQL数据库旨在处理大规模、非结构化或半结构化数据。A、B选项中结构化和关系型数据是传统关系型数据库处理的。C选项事务密集型也是传统关系数据库擅长的。答案选D。
15.
以下哪种数据采集方法属于离线采集( )
  • A.实时爬取微博热搜数据
  • B.收集昨日的服务器访问日志
  • C.调用API获取实时股票价格
  • D.通过传感器实时监测温度

参考答案B

解析离线采集是指非实时、事后收集数据。A、C、D选项都是实时获取数据,B选项收集昨日服务器访问日志是事后收集,属于离线采集。答案:B
16.
某电商平台在用户不知情的情况下,违规收集其浏览记录、收货地址等信息并用于精准营销,该行为主要涉及大数据安全中的哪类风险( )
  • A.数据收集的风险
  • B.数据存储的风险
  • C.数据使用的风险
  • D.国家安全问题

参考答案A

解析电商在用户不知情下违规收集信息用于精准营销,重点在于违规收集这一环节,涉及数据收集风险。答案选A。
17.
数据湖通常用于支持哪种数据分析?( )
  • A.仅预定义报告
  • B.仅实时交易
  • C.探索性分析和机器学习
  • D.仅结构化查询

参考答案C

解析数据湖能存储各种类型数据,为探索性分析提供丰富多样的数据来源,也为机器学习提供训练数据。而预定义报告、实时交易、仅结构化查询都不能全面体现数据湖的用途。所以答案选C。
18.
协同过滤推荐的核心思想是?( )
  • A.分析物品内容
  • B.使用专家规则
  • C.统计用户行为
  • D.利用用户或物品相似性

参考答案D

解析协同过滤推荐是基于用户对物品的行为数据,找出用户或物品间相似性来做推荐。A选项分析物品内容是基于内容的推荐;B选项使用专家规则不是协同过滤核心;C选项统计用户行为只是基础,核心还是用相似性推荐。所以选D。答案是D。
19.
数据湖允许存储什么类型的数据?( )
  • A.仅结构化数据
  • B.仅文本数据
  • C.仅实时数据
  • D.多种格式数据

参考答案D

解析数据湖的特点就是能够存储多种格式的数据,包括结构化、半结构化和非结构化数据等。A选项仅结构化数据范围太窄;B选项仅文本数据也不全面;C选项仅实时数据也不准确。所以答案选D。答案:D
20.
大数据交易平台根据运营模式可分为哪几种类型?( )
  • A.第三方平台和自营平台
  • B.线上平台和线下平台
  • C.免费平台和付费平台
  • D.国内平台和国际平台

参考答案A

解析大数据交易平台按运营模式分主要是第三方平台和自营平台。第三方平台独立于数据供需双方,自营平台则由数据拥有者自行运营。答案选A。
21.
传统数据安全威胁通常针对的对象是( )
  • A.动态流转的多源异构数据
  • B.实时处理的流式数据
  • C.静态存储或固定传输路径的数据
  • D.未匿名化的关联数据

参考答案C

解析传统数据安全威胁多是针对静态存储或固定传输路径的数据,而动态流转多源异构、实时处理的流式数据以及未匿名化关联数据是新型数据环境下的特点。答案选C。
22.
通过大数据分析,零售商可以实现以下哪项优势?
  • A.统一所有客户服务
  • B.个性化购物体验
  • C.随机商品摆放
  • D.忽略历史数据

参考答案B

解析大数据能分析消费者行为和偏好,让零售商为顾客提供个性化服务和商品推荐,实现个性化购物体验。A统一服务不利用大数据优势;C随机摆放不合理;D应重视历史数据。答案:B
23.
以下哪项属于基于统计学方法的数据分析的常见类别( )
  • A.描述性统计
  • B.深度学习
  • C.神经网络
  • D.强化学习

参考答案A

解析描述性统计是基于统计学方法的数据分析常见类别,而深度学习、神经网络、强化学习主要属于机器学习和人工智能领域方法。答案选A。
24.
《个人信息保护法》中的“告知-同意”原则,主要是为了保障个人的( )
  • A.个人信息的自主决策权
  • B.个人信息的强制销毁权
  • C.个人信息的主动修改权
  • D.个人信息的全面访问权

参考答案A

解析“告知 - 同意”原则让个人在知晓信息处理情况后自主决定是否同意,保障了个人对自身信息的自主决策。答案选A。
25.
以下哪项是大数据在零售供应链管理中的核心价值( )
  • A.提高商品的广告点击率
  • B.优化从供应商到消费者的全流程效率
  • C.增加客户的社交媒体点赞数
  • D.改善门店的灯光照明设计

参考答案B

解析大数据用于零售供应链管理,主要是为了提升供应链各环节效率。A选项广告点击率与供应链管理核心无关;C选项社交媒体点赞数和供应链管理无直接联系;D选项门店灯光照明设计和供应链核心价值不相关。而B选项优化从供应商到消费者的全流程效率,正是大数据在零售供应链管理中的核心价值体现。答案:B
26.
文件系统通常不支持以下哪项功能?( )
  • A.文件和目录的创建与删除。
  • B.用户权限和访问控制。
  • C.数据备份和版本控制。
  • D.支持完整的事务ACID属性。

参考答案D

解析文件系统主要负责管理文件和目录,能进行创建删除操作,也有用户权限和访问控制。但它一般不支持完整的事务ACID属性,那是数据库系统重点保障的。数据备份和版本控制部分文件系统有一定支持。答案选D。
27.
自营大数据交易平台通常由谁运营?( )
  • A.政府机构独家运营
  • B.第三方中介公司
  • C.数据所有者或企业自身
  • D.非营利组织

参考答案C

解析自营大数据交易平台强调“自营”,即数据所有者或企业自身运营。政府机构独家运营一般不是自营模式特点;第三方中介公司是独立于数据所有者和使用者的,并非自营;非营利组织不以盈利为目的,也不符合自营大数据交易平台的运营主体特征。所以答案选C。
28.
智能物流系统中,大数据技术对供应链协同的主要贡献是( )
  • A.实现供应商、物流商、零售商的信息实时共享
  • B.直接降低物流运输的燃油成本
  • C.提高物流从业人员的操作技能
  • D.减少物流节点的数量

参考答案A

解析大数据技术可整合各方数据,让供应商、物流商、零售商实时共享信息,促进供应链协同。B选项大数据不能直接降低燃油成本;C选项与提高人员操作技能无关;D选项大数据不会直接减少物流节点数量。答案:A
29.
机器学习与数据挖掘的主要区别在于?( )
  • A.自动学习 vs 知识发现
  • B.实时计算 vs 离线处理
  • C.统计模型 vs 算法模型
  • D.图遍历 vs 数据查询

参考答案A

解析机器学习侧重于让机器自动学习数据中的模式和规律,而数据挖掘重点是从大量数据中发现潜在知识。A选项准确概括了二者主要区别。答案选A。
30.
以下哪项不属于大数据在零售领域的“客户体验优化”应用?( )
  • A.推送个性化商品推荐
  • B.根据客户偏好调整促销策略
  • C.提供专属客服服务
  • D.统计门店的日均客流量

参考答案D

解析A、B、C都围绕客户体验优化,从商品推荐、促销策略、客服服务等方面提升客户感受;D只是统计客流量,未直接针对客户体验,属于运营数据统计。答案:D

二、多选题

下列每小题的备选答案中,有两个或两个以上符合题意的正确答案。

31.
在典型实例中,大数据思维方式如何帮助企业决策?( )
  • A.通过分析全部用户数据提升营销效果
  • B.利用实时数据关联调整供应链
  • C.依靠管理层直觉判断
  • D.采用近似数据快速测试产品策略
  • E.优先使用纸质报告汇总数据

参考答案ABD

解析大数据思维强调基于数据进行决策。A可通过全量用户数据精准营销;B能借助实时数据关联优化供应链;D用近似数据快速测试策略也是大数据应用方式。C依靠直觉判断与大数据思维相悖;E纸质报告不利于大数据处理分析。答案:ABD
32.
智能物流可以通过大数据实现哪些环境可持续发展目标?( )
  • A.减少碳排放
  • B.增加废物产生
  • C.提高能源效率
  • D.绿色包装推广
  • E.使用高污染燃料

参考答案ACD

解析智能物流利用大数据可优化运输路线、仓储管理等,能减少碳排放、提高能源效率,还可推动绿色包装推广。而增加废物产生和使用高污染燃料与环境可持续发展相悖。答案:ACD
33.
大数据、云计算和物联网之间的联系包括( )
  • A.云计算为大数据处理提供资源
  • B.物联网为大数据提供数据源
  • C.三者完全独立,没有联系
  • D.大数据技术用于分析物联网数据
  • E.物联网不依赖云计算

参考答案ABD

解析云计算能为大数据处理提供计算等资源;物联网的设备会产生大量数据,是大数据的重要数据源;大数据技术可对物联网产生的数据进行分析。而三者并非完全独立,且物联网很多场景依赖云计算实现数据存储与处理。答案:ABD
34.
关于零售领域关联购买行为发现的描述,正确的有( )
  • A.其核心是挖掘商品之间的隐藏购买关联
  • B.通常采用Apriori等关联规则算法实现
  • C.主要用于识别用户的终身价值
  • D.可帮助零售商优化商品陈列位置(如将关联商品放在相邻货架)
  • E.仅能分析线下门店的POS机数据

参考答案ABD

解析关联购买行为发现核心是找商品间隐藏购买关联,常用Apriori等算法,能助力优化商品陈列;它和识别用户终身价值无关,且分析数据不局限于线下门店POS机数据。答案:ABD
35.
大数据征信与传统征信的主要区别体现在( )
  • A.数据来源仅局限于金融机构内部交易数据
  • B.整合社交、电商、位置等非金融领域数据
  • C.以回归分析等传统统计方法为主
  • D.信用评估结果随数据更新动态调整
  • E.信用评估周期以年度为固定单位

参考答案BD

解析传统征信数据多源于金融机构内部,以传统统计方法为主,评估周期固定;大数据征信整合非金融领域数据,评估结果随数据更新动态调整。A是传统征信特点,C是传统方法,E是传统评估周期特点。答案:BD
36.
运用大数据思维的典型商业案例涉及哪些领域?( )
  • A.零售业通过销售数据分析优化库存管理
  • B.金融行业利用交易数据进行实时欺诈检测
  • C.医疗领域使用患者历史数据预测疾病爆发
  • D.小型企业依赖手工记录客户信息
  • E.使用基本报表工具生成月度销售总结

参考答案ABC

解析大数据思维强调利用大量数据进行分析决策。A、B、C选项分别在零售、金融、医疗领域运用数据进行管理、检测和预测,符合大数据思维;D选项手工记录信息未体现大数据运用;E选项用基本报表工具生成总结,未涉及大数据处理。答案:ABC
37.
批处理计算的应用场景包括哪些?( )
  • A.历史数据批量分析
  • B.日志文件处理
  • C.实时欺诈检测
  • D.传感器数据流处理
  • E.ETL作业

参考答案ABE

解析批处理计算适合处理大规模的历史数据,对时间要求不高。A历史数据批量分析、B日志文件处理、E ETL作业都可对大量数据进行批量处理。而C实时欺诈检测和D传感器数据流处理更强调实时性,适合流处理。所以答案选ABE。
38.
数据管理工作包括以下哪些任务?( )
  • A.数据质量控制
  • B.数据备份
  • C.数据销售
  • D.数据安全
  • E.数据可视化

参考答案ABD

解析数据管理涵盖数据质量控制、保障数据安全、进行数据备份等工作。数据销售不属于管理工作,数据可视化是展示数据的方式非管理任务。答案:ABD
39.
客户细分可以帮助零售企业实现什么?( )
  • A.提供定制化服务
  • B.降低所有产品价格
  • C.优化产品推荐
  • D.提升客户忠诚度
  • E.高效利用营销预算

参考答案ACDE

解析客户细分能让企业了解不同客户需求特点,基于此可提供定制化服务、优化产品推荐、提升客户忠诚度、高效利用营销预算;而不是降低所有产品价格。答案:ACDE
40.
数据可视化可以帮助用户实现哪些目标?( )
  • A.识别数据中的隐藏模式和趋势
  • B.简化复杂数据的理解和沟通
  • C.隐藏数据中的关键信息
  • D.支持探索性数据分析(EDA)
  • E.完全替代数据清洗和预处理步骤

参考答案ABD

解析数据可视化能让数据更直观,可识别隐藏模式和趋势、简化数据理解与沟通、支持探索性分析,但不会隐藏关键信息,也不能替代数据清洗和预处理。答案:ABD

三、判断题

请判断每小题的表述是否正确。

41.
社交媒体上的用户评论属于数据采集的非结构化数据源
  • A.正确
  • B.错误

参考答案A

解析社交媒体用户评论没有固定格式,信息自由表达,属于非结构化数据,可作为数据采集的非结构化数据源。
42.
随着二代测序技术的普及,生物大数据的规模从“TB级”向“PB级”指数级增长,这一表述是否正确?
  • A.正确
  • B.错误

参考答案A

解析二代测序技术发展使得生物数据大量产生,规模确实从“TB级”向“PB级”指数级增长。
43.
数据脱敏的主要目标是在不影响数据分析结果的前提下,保护敏感信息(如用户身份证号)
  • A.正确
  • B.错误

参考答案A

解析数据脱敏就是对敏感信息进行处理,使其不泄露,同时又能保证数据可用于分析,不影响分析结果。所以该说法正确。
44.
流行病预测的大数据模型通常忽略社交媒体数据( )
  • A.正确
  • B.错误

参考答案B

解析社交媒体数据包含民众动态、疾病相关讨论等大量信息,对流行病预测有重要参考价值,流行病预测的大数据模型不会忽略它。
45.
国家安全问题在大数据背景下,主要关注数据跨境流动的监管。
  • A.正确
  • B.错误

参考答案A

46.
金融大数据应用通常涉及数据隐私和安全挑战。( )
  • A.正确
  • B.错误

参考答案A

解析金融大数据包含大量敏感个人和企业信息,在应用中易遭遇数据泄露、恶意攻击等问题,所以会涉及数据隐私和安全挑战。
47.
大数据思维要求必须消除所有数据中的噪声和错误,才能进行有效的分析
  • A.正确
  • B.错误

参考答案B

解析大数据具有海量、多样等特点,完全消除噪声和错误不现实也没必要,大数据思维更注重整体数据的相关性和趋势,而非绝对精准。
48.
大数据思维中的‘效率思维’要求在数据处理和分析中优先保证速度和实时性,而非绝对的精确性
  • A.正确
  • B.错误

参考答案A

解析大数据体量巨大、变化快速等特点使得难以做到绝对精确,且很多场景更注重及时获取信息,所以效率思维强调优先保证速度和实时性而非绝对精确性。
49.
DAMA-DMBOK框架中的大数据治理模型将治理层级分为决策层、管控层与执行层
  • A.正确
  • B.错误

参考答案A

解析DAMA - DMBOK框架里的大数据治理模型确实把治理层级划分为决策层、管控层和执行层。
50.
数据孤岛问题只会影响大型组织,小型组织不受其影响。
  • A.正确
  • B.错误

参考答案B

解析数据孤岛问题是指不同系统、部门等之间的数据无法有效共享和流通,无论是大型组织还是小型组织,只要存在数据分散、缺乏整合等情况,都可能出现数据孤岛问题,并非只影响大型组织。
51.
大数据在流行病预测中可减少误报率。
  • A.正确
  • B.错误

参考答案A

解析大数据能收集多维度、大量的数据,通过分析挖掘可更精准地捕捉流行病相关信息和规律,从而减少误报。
52.
大数据可预测运输中的货物损坏风险,如分析路况、温湿度数据提前采取防护措施
  • A.正确
  • B.错误

参考答案A

解析大数据能整合路况、温湿度等多方面数据,通过对这些数据的分析可以识别运输过程中可能导致货物损坏的风险因素,从而提前采取防护措施。
53.
大数据治理的要素不包括数据生命周期管理
  • A.正确
  • B.错误

参考答案B

解析数据生命周期管理是大数据治理的重要要素之一,它涵盖了数据从产生到消亡整个过程的管理。所以题干说法错误。
54.
智能安防系统中的大数据分析能够对历史监控数据进行回溯,辅助警方调查已发生的案件(如被盗事件),这一说法是否正确?
  • A.正确
  • B.错误

参考答案A

解析智能安防系统大数据分析可存储和处理大量历史监控数据,能通过对这些数据回溯、分析来辅助警方调查已发生案件。
55.
区块链的“去中心化”特性会导致其无法与需要集中计算的大数据分析技术协同。
  • A.正确
  • B.错误

参考答案B

解析区块链“去中心化”和大数据分析并非不能协同,区块链可提供数据可信存储,大数据分析处理海量数据,二者能在数据安全等方面互补合作。
56.
大数据产业仅包括数据存储和数据处理服务,不涉及数据分析工具的开发。
  • A.正确
  • B.错误

参考答案B

解析大数据产业涵盖范围广,包括数据存储、处理、分析等多方面,数据分析工具开发也是其重要组成部分。
57.
Hadoop MapReduce是批处理计算的典型代表产品,适用于处理大规模离线数据。
  • A.正确
  • B.错误

参考答案A

解析Hadoop MapReduce是为大规模数据处理设计的批处理计算框架,主要用于离线数据处理。
58.
区块链的“全节点”需保存完整账本,而大数据的分布式存储通常将数据分片存储,两者存储模式不同。
  • A.正确
  • B.错误

参考答案A

解析区块链全节点要保存完整账本,大数据分布式存储是把数据分片存于多个节点,存储模式确实不同。
59.
数据采集的方法仅包括自动采集(如传感器、爬虫),不包括人工采集(如访谈、问卷)
  • A.正确
  • B.错误

参考答案B

解析数据采集方法既包括自动采集(像传感器、爬虫),也包括人工采集(如访谈、问卷)。
60.
大数据在流行病预测中主要用于历史数据分析,无法进行实时预测。
  • A.正确
  • B.错误

参考答案B

解析大数据不仅可用于历史数据分析,也能借助实时数据收集与分析技术进行实时预测。