阿里云MaxCompute(大数据)公开数据集---带你玩转人工智能

摘要: 目前阿里云大数据产品已经免费向所有用户开放了多种公用数据集。开放的数据类别包括:股票价格数据,房产信息,影视及其票房数据。html

点此查看原文:http://click.aliyun.com/m/40813/分布式

目前阿里云MaxCompute大数据产品已经免费向所有用户开放了多种公用数据集。在此以前,获取,分析,下载自定义的大型分析数据集须要数小时乃至数天才能完成。ide

而如今阿里云的任何用户均可以经过基于大数据计算服务MaxCompute 的数据工场DataWorks快速、便捷的分析这些公用数据集。
开通MaxCompute&数据工场的教程参考:https://help.aliyun.com/docum...大数据

咱们将股票价格、房产、影视等多种类型的数据免费开放给用户,使得你们免去了复杂的数据获取、上传、清洗等过程,能够直接进入数据分析阶段,经过这种数据开放形式,咱们但愿能以更快的速度实现更多的创新。搜索引擎

你们也能够经过数加体验馆(https://data.aliyun.com/exper...)来使用这些数据,近距离的感觉阿里云数加(大数据)产品;阿里云

目前咱们开放的数据类别包括:股票价格数据,房产信息,影视及其票房数据。全部的数据均被存储在MaxCompute 产品中的public_data 项目中。如下,咱们将对这些数据作更为详细的介绍,并简要说明如何经过MaxCompute 及数据工场服务并分析这些数据。spa

获取权限code

首选,须要用户以项目空间的owner 或者管理员的身份,在本身的项目空间下,执行以下操做。执行完成后用户项目空间下的全部成员都可读取各公开数据集合:htm

add user ALIYUN$everyone;

执行该语句后便可执行查询:
图片描述教程

特殊说明
公开数据集合对全部MaxCompute 用户开放,这是经过MaxCompute 特殊的受权机制实现的。在使用过程当中,用户须要足以一下几点:

  1. 全部数据均存储在一个名为public_data 的项目空间中,但全部用户并未被加入到该空间下(非项目空间成员)。所以,用户须要跨项目空间访问数据,在数据工场中编辑SQL 时,必须在代表前指定项目名称,例如:
Select * from public_data.ods_enterprise_share_basic where ds = '20170114';
  1. 因为是跨项目空间访问,全部用户在数据工场的[数据管理]中没法查找到公开数据集的表;
  2. 只有在执行”Add User”语句后,用户才有权限访问公开数据集。该语句能够再数据工场以及MaxCompte 提供的客户端中执行;

下面咱们将详细介绍目前开放的数据集合。

股票价格数据集
整体信息:每日更新A 股股票相关数据。

图片描述

ods_enterprise_share_basic 股票基本信息
图片描述

图片描述
图片描述
数据样例:
图片描述
ods_enterprise_share_quarter_cashflow 季度报表说明
图片描述

数据样例:

图片描述

ods_enterprise_share_quarter_growth 季度业务增加状况
图片描述

数据样例:

图片描述

ods_enterprise_share_quarter_operation 季度财务周转
图片描述

数据样例:

图片描述

ods_enterprise_share_quarter_profit 季度利润

图片描述

数据样例:

图片描述

ods_enterprise_share_quarter_report 季度报表
图片描述
图片描述

数据样例:
图片描述

ods_enterprise_share_trade_h 股票价格
图片描述
图片描述

数据样例:
图片描述

二手房产数据集

整体信息:二手房相关信息(注意:目前暂停更新)。
图片描述

dwd_prouduct_house_basic_info_out信息说明
图片描述
图片描述

数据样例:

图片描述

影视及票房数据集

整体信息:每日更新国内影视剧信息及票房数据信息 。

图片描述

dwd_ product_ movie_ basic_ info
图片描述
图片描述

ods_product_movie_box 票房基本信息

图片描述

数据样例:
图片描述
基于公开数据集的实战

手把手,教你用MaxCompute+OpenSearch搭建分布式搜索引擎

购买&试用MaxCompute,请加入扫码进钉钉群。公开数据集问题,请加入扫码进钉钉群。
图片描述

相关文章
相关标签/搜索