数据cube的schema与sql的对应的关系
用schema workbench 设置cube的维度结构
saiku 使用的cube,会将不同维度的查询转化为sql语句。
schema中,
cube的事实表和dimension表进行自然连接,具体的dimension设置是,dimension设置界面上foreign key(事实表的某一列)与hierarchy设置界面上primaryKey(dimension表的主键)。关联是通过这两个列进行对比,所以一定要指定正确。
而,level设置界面上的Column是实现group by 的
写一个一个小例子:
mdx语句
SELECT
NON EMPTY {[Measures].[Downloads]} ON COLUMNS,
NON EMPTY TopCount({Hierarchize(CrossJoin([dimDate.default].[day].[2014-01-03], [compare_app.default].[appName].Members))},20,[downloads]) ON ROWS
FROM [aso]
注意[dimDate.default]中default为层级名。要设定好,才能正确的引用level。我为hierarchy起名为default,因为就一个。
转换为对应的sql语句为:
SELECT
`dimdate`.`year` AS `c0`,
`dimdate`.`yearname` AS `c1`,
`dimdate`.`month` AS `c2`,
`dimdate`.`monthname` AS `c3`,
`dimdate`.`datevalue` AS `c4`,
`dimappnamenew_1`.`app_name` AS `c5`
FROM
`dimdate` AS `dimdate`,
`factdownloadsnew` AS `factdownloadsnew`,
`dimappnamenew` AS `dimappnamenew_1`
WHERE
`factdownloadsnew`.`date_time` = `dimdate`.`datevalue`
AND `factdownloadsnew`.`app_link_hash` = `dimappnamenew_1`.`app_link_hash`
AND(
`dimdate`.`datevalue` = '2014-01-03'
AND `dimdate`.`month` = '1'
AND `dimdate`.`year` = '2014'
)
GROUP BY
`dimdate`.`year`,
`dimdate`.`yearname`,
`dimdate`.`month`,
`dimdate`.`monthname`,
`dimdate`.`datevalue`,
`dimappnamenew_1`.`app_name`
ORDER BY
ISNULL(`dimdate`.`year`)ASC,
`dimdate`.`year` ASC,
ISNULL(`dimdate`.`month`)ASC,
`dimdate`.`month` ASC,
ISNULL(`dimdate`.`datevalue`)ASC,
`dimdate`.`datevalue` ASC,
ISNULL(
`dimappnamenew_1`.`app_name`
)ASC,
`dimappnamenew_1`.`app_name` ASC
这里我遇到一个问题,这个维度查询关联是按applinkhash进行,
结果如下:
而同样实现前20排名返回语句,用app_id进行关联:
SELECT
NON EMPTY {[Measures].[Downloads]} ON COLUMNS,
NON EMPTY TopCount({Hierarchize(CrossJoin([dimDate.default].[day].[2014-01-03], [dimApp.appName].[appName].Members))},20,[downloads]) ON ROWS
FROM [aso]
结果如下(不同):
两个结果不同。如,360用app_id统计的少了很多。
问题分析:applinkhash是一一对应的,而app_id也是一一对应的。二者比对应该相同。
app_id统计少了,是什么原因?
在原表中进行查询,直接统计360手机卫士的downloads,证明app_id是正确的。app_link_hash对比,会多统计一些。
原因如下:360手机卫士有两个version,5.0和4.3,两条记录applink,applinkhash相同,只有version不同,所以比对上有两个关联上了,导致累加到了一起。
另外,saiku中呈现的名字也是在schema里设置,对应关系:
schema名-------------最开始,saiku里面选择的schema
下一级
cube名----------------------saiku在每个schema下的名
下一级
dimension名(维度名)-----------------saiku呈现cube下为文件夹名
下一级
level名-------------------saiku可以拖拉使用的对象的
数据cube的schema与sql的对应的关系的更多相关文章
- 查询oracle数据库,返回的数据是乱码。 PL/SQL正常。
查询oracle数据库,返回的数据是乱码. PL/SQL正常. 解决方案如下:
- SQLSERVER:大容量导入数据时保留标识值 (SQL Server)
从MSDN上看到实现大容量导入数据时保留标识值得方法包含三种: MSDN链接地址为:https://msdn.microsoft.com/zh-cn/library/ms178129.aspx 感觉M ...
- MySQL数据导出为Excel, json,sql等格式
MySQL数据经常要导出为Excel, json,sql等格式,通过步骤都很多,麻烦,现在通过Treesoft可以方便的导出你要的数据格式. 1.在线执行SQL,在数据列表中有相应按钮,方便的将数据导 ...
- 【mybatis】mybatis执行一个update方法,返回值为1,但是数据库中数据并未更新,粘贴sql语句直接在数据库执行,等待好久报错:Lock wait timeout exceeded; try restarting transaction
今天使用mybatis和jpa的过程中,发现这样一个问题: mybatis执行一个update方法,返回值为1,但是数据库中数据并未更新,粘贴sql语句直接在数据库执行,等待好久报错:Lock wai ...
- 2016/05/13 thinkphp 3.2.2 ① 数据删除及执行原生sql语句 ②表单验证
[数据删除及执行原生sql语句] delete() 返回受影响的记录条数 $goods -> delete(30); 删除主键值等于30的记录信息 $goods -> delete( ...
- Oracle取查询结果数据的第一条记录SQL
Oracle取查询结果数据的第一条记录SQL: ; ;
- 在SQL Server中实现关系模型的阶梯到级别3的t -SQL DML
在SQL Server中实现关系模型的阶梯到级别3的t -SQL DML 格雷戈里·拉森(Gregory Larsen),2017/08/02(第一次出版:2011 /11/09) 原文链接:http ...
- 在SQL Server中实现关系模型
使用SQL Server的Transact-SQL(T-SQL)方言,此楼梯将为您提供如何使用SQL Server表中的数据的基本了解. DML是数据操作语言,是处理数据的语言的一个方面.它包括SEL ...
- 到T-SQL DML 三级的阶梯:在SQL server中实现关系模型
作者: Gregory Larsen, 2017/08/02 (第一次出版: 2011/11/09) 翻译:谢雪妮,许雅莉,赖慧芳,刘琼滨 译文: 系列 该文章是阶梯系列的一部分:T-SQL DML的 ...
随机推荐
- 删除表中重复行SQL
delete from table_name a where rowid < (select max(rowid) from table_name b where a.col1 = b.col1 ...
- 简单搭建iOS开发项目框架
今天我们来谈谈如何搭建框架,框架需要做一些什么. 第一步:找到我们的目标我们的目标是让其他开发人员拿到手后即可写页面,不再需要考虑其他的问题. 第二步:我们需要做哪些东西各位跟着我一步一步来进行. 假 ...
- JDBC的java驱动安装
首先登陆mysql.com官方网站,download-->选中下面的community–>mysql connentor-->然后选中下面与平台无关的zip包,一般是第二个,完成下载 ...
- Python模块探秘 Smtplib发送带有各种附件的邮件
这两天对Python的邮件模块比较感兴趣,于是就查了查资料.同时在实际的编码过程中也遇到了各种各样的问题.下面我就来分享一下我与smtplib的故事. 前提条件 我的上一篇博文里面讲解了,发送邮件必须 ...
- linux中的网络通信指令
1.write write命令通信是一对一的通信,即两个人之间的通信,如上图. 效果图 用法:write <用户名> 2.wall wall指令可将信息发送给每位同意接收公众信息的终端机用 ...
- JDK 7中的文件操作的新特性
文件系统综述 一个文件系统在某种媒介(通常是一个或多个硬盘)上存储和组织文件.如今的大多数文件系统都是以树状结构来存储文件.在树的顶端是一个或多个根节点,在根节点一下,是文件和目录(在Windows系 ...
- UNIX网络编程——客户/服务器程序设计示范(四)
TCP预先派生子进程服务器程序,accept使用线程上锁保护 我们使用线程上锁保护accept,因为这种方法不仅适用于同一进程内各线程之间的上锁,而且适用于不同进程之间的上锁. ...
- [C++学习历程]基础部分 C++中的函数学习
本文地址:http://blog.csdn.net/sushengmiyan/article/details/20305815 作者:sushengmiyan 一.静态变量: 局部变量是线程到达定义的 ...
- Spark程序开发-环境搭建-程序编写-Debug调试-项目提交
1,使用IDEA软件进行开发. 在idea中新建scala project, File-->New-->Project.选择Scala-->Scala 2,在编辑窗口中完成Word ...
- XML解析之sax解析案例(一)读取contact.xml文件,完整输出文档内容
一.新建Demo2类: import java.io.File; import javax.xml.parsers.SAXParser; import javax.xml.parsers.SAXPar ...