2天时间,聊今年最热的 Agent、上下文工程、AI 产品创新等话题。2025 年最后一场~ 了解详情
写点什么

Amazon 发布可持续性数据集,可用于多个领域的数据分析

  • 2019-02-12
  • 本文字数:1155 字

    阅读完需:约 4 分钟

Amazon发布可持续性数据集,可用于多个领域的数据分析

Amazon Web Services Open Data(AWSOD)和 Amazon Sustainability(AS)正在合作,为 AWS Simple Storage Service(S3)提供可持续性的数据集,并通过预处理数据集来实现最佳的数据检索,从而消除无差异的繁重工作。可持续性数据集通常来自卫星、地质研究、气象雷达、地图、农业研究、大气研究、政府和很多其他来源。


Amazon Web Services Open Data(AWSOD)和 Amazon Sustainability(AS)正在合作,为 AWS Simple Storage Service(S3)提供可持续性的数据集,并通过预处理数据集来实现最佳的数据检索,从而消除无差异的繁重工作。可持续性数据集通常来自卫星、地质研究、气象雷达、地图、农业研究、大气研究、政府和很多其他来源。


2018 年 12 月 10 日,AWSOD 和 AS 团队发布了第一组数据集。这些数据集向现有的 AWS Open Data 数据集种添加了一种新数据类别。这些可持续性数据集之前已经被公开,AWS 现在正在改进数据集的访问便利性,例如,将大型存档文件分成可以独立检索的较小的可寻址块。AWS 使用 Simple Storage Service(S3)存储数据,并将存储桶设置为公开可访问。Simple Notification Services(SNS)用于向消费者发起新数据通知,并且在少数情况下使用 CloudFront 通过应用程序编程接口提供数据,以便加快检索速度。


为了进一步促进新数据集的使用,AWS 正在与 Group on Earth Observations(GEO)合作,拨出 150 万美元的 AWS Cloud Credits,以获得有关地球的见解。


AWS 提供了如何使用可持续性开放数据集的文档以及用于搜索数据集的标签。“非洲土壤信息服务(AfSIS)土壤化学”数据集可以用来学习如何将机器学习应用于开放数据。使用开放数据集的社区第三方贡献者发布了一些博文,介绍了如何使用公共数据集:



此外,AWS 的一些客户成功地在云端使用可持续性数据:



负责农业数据分析的 Sebastian Fritsch 参与了 AWS 有关卫星数据集使用的问答,他被问道:“在你看来有什么亮点吗”?他回答说:“只需要修改几行代码就可以将数据产品从相对较小的试点区域扩展到全局,对我们来说,这是一个亮点”。


在可持续性数据集发布之前,AWS Global Open Data 主管 Jed Sundwall 谈到了如何不断改进 AWS 传输 PB 级开放数据的能力。AWS 正在向开放数据集中添加各种索引(包括外部索引、文件命名和内部索引),以增加访问便利性。AWS 的工作人员正在观察社区的情况,并意识到他们可以通过社区构建的数据集处理机制来衡量数据集的成功程度。最后,AWS 提供了一个明确定义的程序,用于支付成本,并让新的贡献者通过AWS提供公共数据集。


查看英文原文:https://www.infoq.com/news/2019/01/amazon-sustainability-datasets


2019-02-12 14:513671
用户头像

发布了 731 篇内容, 共 479.9 次阅读, 收获喜欢 2008 次。

关注

评论

发布
暂无评论
发现更多内容

程序员的晚餐 | 6 月 21 日 自制小火锅

清远

美食

Prometheus 2.19.0 新特性

耳东@Erdong

Prometheus

信息的表示与存储-整数的运算

引花眠

计算机基础

week3 学习总结

任小龙

ARTS-WEEK4

一周思进

ARTS 打卡计划

极客时间 - 架构师培训 -3 期作业

Damon

架构师训练营-第 02 周作业

Eric

架构师训练营 - 第 02 周学习总结

Eric

故障演练利器之ChaosBlade介绍

心平气和

故障演练 故障注入

架构师训练营 - 第三周总结

teslə

单例模式和组合模式

鲁米

Go:使用Delve和Core Dump来调试

陈思敏捷

debug gdb Go 语言

Open-Falcon安装注意事项

wong

Open-Falcon Nightingale Monitor

技术学习进阶(死磕法)

dudu

学习 技术

架构师训练营 - 第三周作业

teslə

代码重构-学习总结

飞雪

ARTS-WEEK3

Allen

架构师训练营 - 学习笔记 - 第三周

心在飞

极客大学架构师训练营

138 张图带你 MySQL 入门

苹果看辽宁体育

MySQL 数据库

架构师训练营-第 03 周作业提交

Eric

极客大学架构师训练营

架构师训练营-第 03 周总结

Eric

极客大学架构师训练营

易纲:上海可以在人民币自由兑换等方面先行先试

CECBC

数字货币 区块链技术 金融科技中心

架构师训练营第三周作业

CATTY

十万同时在线用户,需要多少内存?——Newbe.Claptrap 框架水平扩展实验

newbe36524

三周作业

飞雪

每周学习总结 - 架构师培训 3 期

Damon

搞定 HTTP 协议(三):如何严谨地描述一个 HTTP 报文?

零和幺

https HTTP

ARTS打卡 第4周

引花眠

ARTS 打卡计划

设计模式练习及感想(训练营第三课)

看山是山

设计模式 极客大学架构师训练营

ARTS 第 3 周

乌拉里

week3.课后作业

个人练习生niki👍

单例模式 组合模式

Amazon发布可持续性数据集,可用于多个领域的数据分析_数据库_Aslan Brooke_InfoQ精选文章