当前位置: 首页 > news >正文

钓鱼网站制作教程视频适合建设网站的国外服务器

钓鱼网站制作教程视频,适合建设网站的国外服务器,网站首页布局自适应,淘客推广怎么样1 通过Athena查询s3中的数据 此实验使用s3作为数据源 ETL: E extract 输入 T transform 转换 L load 输出 大纲 1 通过Athena查询s3中的数据1.1 架构图1.2 创建Glue数据库1.3 创建爬网程序1.4 创建表1.4.1 爬网程序创建表1.4.2 手动创建表 1…

1 通过Athena查询s3中的数据

此实验使用s3作为数据源

ETL:

E    extract         输入
T    transform     转换
L    load             输出

大纲

  • 1 通过Athena查询s3中的数据
    • 1.1 架构图
    • 1.2 创建Glue数据库
    • 1.3 创建爬网程序
    • 1.4 创建表
      • 1.4.1 爬网程序创建表
      • 1.4.2 手动创建表
    • 1.5 Athena查询
    • 1.6 总结

1.1 架构图

在这里插入图片描述

1.2 创建Glue数据库

首先我们需要创建一个数据库。我们将会使用爬网程序来填充我们的数据目录。

步骤图例
1、入口在这里插入图片描述
2、创建数据库 只需输入一个数据库名称即可在这里插入图片描述
3、结果在这里插入图片描述

1.3 创建爬网程序

在任务中,我们经常会使用Glue爬网程序来填充我们的数据目录。
爬虫可以在一次运行中爬取多个数据存储。在爬取完成后,我们会在数据目录中看到由爬虫创建的一个或多个表。
创建表后,我们就可以在接下来的Athena查询或ETL作业中使用表来作为源或目标了。

步骤图例
1、入口在这里插入图片描述
2、输入爬虫名称在这里插入图片描述
3、选择数据源类型(Data Stores:创建,Existing catalog tables:更新) 选择爬取类型(Crawl all folders:爬取全部文件夹,Crawl new folders only:只爬取新文件夹,Crawl changed folders indentified by Amazon S3 Event Notifications:只爬取S3事件通知的有变更的文件夹)在这里插入图片描述
4、选择s3 (可对s3中的需要爬取的数据进行筛选)在这里插入图片描述
5、创建或选择爬网程序IAM角色(需要有对应S3与Glue的权限)在这里插入图片描述
6、对于不确定的实时数据或许要定时更新的数据,可按需选择频率;若只需创建表结构,可选择按需运行在这里插入图片描述
7、确认在这里插入图片描述

此时,数据库与爬网程序已准备完毕。
我们将会运行爬网程序自动分析数据结构并创建表。

1.4 创建表

如果对待爬取数据结构未知,或者结构复杂、字段繁杂,则使用“爬网程序创建表”;对于对待爬取数据结构清晰明了的,可以使用“手动创建表”模式。

1.4.1 爬网程序创建表

步骤图例
1、运行                         在这里插入图片描述
2、运行中在这里插入图片描述
3、运行完毕在这里插入图片描述
4、运行结果在这里插入图片描述
5、表结构在这里插入图片描述

1.4.2 手动创建表

步骤图例
1、入口在这里插入图片描述
2、表名在这里插入图片描述
3、数据源在这里插入图片描述
4、选择文件类型在这里插入图片描述
5、手动创建表需要自定义列;请根据提示创建在这里插入图片描述
6、一直下一步即可

1.5 Athena查询

Athena是一种交互式查询服务(不是数据库)。并且Athena可以使用标准SQL直接查询S3中的数据,前提是需要使用Glue连接S3源。Athena还支持查询如DynamoDB、Redshift、MySQL等数据库。

步骤图例
1、入口在这里插入图片描述
2、设置查询结果存储位置:s3在这里插入图片描述在这里插入图片描述
3、查看表,可查看数据库以及其中的表在这里插入图片描述
4、查询结果:使用sql查询在这里插入图片描述

1.6 总结

在此实验中,我们使用Glue 的爬网程序自动解析存储在s3桶中的原始数据,自动创建了表。通过Glue数据库中的表,我们可以使用Athena对表进行查询(Athena每次检索表对应的s3桶数据,按检索量收费)。接下来我们会对原始数据进行转换、清洗以及分区操作,以及使用API Gateway+Lambda实现一个无服务架构,通过API查询数据。

http://www.yayakq.cn/news/295355/

相关文章:

  • wordpress for sae 4.3seo推广业务员招聘
  • 网站备案填写网站名称建设自己的企业网站需要什么资料
  • 玉溪定制网站建设微餐饮网站建设比较好
  • 包头做网站浙江省信息港入口
  • 网站建设的公司实习做什么百度seo排名如何提升
  • 网站开发专业介绍wordpress升级快速
  • 建一个网站大约花多少钱行业网站建设申请报告
  • 中关村做网站设计的电脑小程序怎么制作
  • 网站开发教程 模板金融课程网站模板下载
  • 常州建设工程电子审图网站做交易网站
  • 商务网站建设管理思路sakai wordpress
  • 网站建设经验交流材料prestashop和wordpress
  • 做盗版小说网站赚钱嘛非洲外贸网站
  • 东莞h5网站开发网站建设实验总结百科
  • 石家庄企业做网站设计公司企业网站详情
  • 哈尔滨大型网站制作开发cms视频系统大全
  • 昆明网站运营网站推广策略都有哪些
  • 创新的网站建设公司音乐网站设计外国
  • 宁志网站两学一做邢台地区网站建设服务周到
  • 废旧网站那个做的最好电脑网络设计干什么的
  • 人工智能网站开发阿里云云虚拟主机
  • 网站开发公司怎么查询苏州网页设计app
  • 为什么网站建设图片显示不出来素材网免费
  • 网站和h5手机百度下载免费
  • 连云港建设工程安全网站wordpress速度没织梦快
  • 固始网站建设广州网络营销学校
  • 请人开发一个网站需要多少钱宁波网红打卡的景点
  • 南京好的网站制作公司南昌网站建设公司服务器
  • 网站上的vR场景贴图怎么做的网站客户问题解答
  • 淘宝网站建设百度百科alexa排名什么意思