提交 0e4a172e 编写于 作者: mliaukz's avatar mliaukz

Update README.md

上级 6b354ef7
# 任务说明
任务正在逐步开放中
## 任务说明
> 大数据行业中一项常见的工作就是数据的采集与清洗,这也是大数据主要的数据来源。常见的数据采集途径主要包括Web数据采集、系统日志采集与物联网设备数据采集。其中Web数据采集是成本最低,也是普通创业者相对来说最容易获取数据的一种手段。
> 完成采集后的数据还不足以作为直接的数据源供大数据系统食用,主要是因为这些数据的格式、编码规则、内容五花八门,都不一样,而各种数据分析工具与框架都需要统一格式、统一标准的更「干净」的数据。在正式应用于数据科学的核心算法和可视化之前,这些数据往往还需要经过抽取、迁移、压缩、清洗、打散、分片以及其他多种转换处理过程。
Markdown is supported
0% .
You are about to add 0 people to the discussion. Proceed with caution.
先完成此消息的编辑!
想要评论请 注册