Mycat是数据库中间件,就是介于数据库与应用之间,进行数据处理与交互的中间服务。node
Mycat中的一些概念:sql
<schema name="TESTDB" checkSQLschema="false" sqlMaxLimit="100"></schema>
在上面配置中,TESTDB其实就是一个逻辑库的概念。数据库
分布式数据库中,对应用来讲,读写数据的表就是逻辑表。逻辑表,能够是数据切分后,分布在一个或多个分片库中,也能够不作数据切分,不分片,只有一个表构成。并发
2. 分片表分布式
分片表,是指那些原有的很大数据的表,须要切分到多个数据库的表,这样,每一个分片都有一部分数据,所 有分片构成了完整的数据。 大数据
例如在 mycat 配置中的 t_node 就属于分片表,数据按照规则被分到 dn1,dn2 两个分片节点(dataNode) 上。spa
<table name="t_node" primaryKey="vid" autoIncrement="true" dataNode="dn1,dn2" rule="rule1" />
3. 非分片表code
一个数据库中并非全部的表都很大,某些表是能够不用进行切分的,非分片是相对分片表来讲的,就是那 些不须要进行数据切分的表。中间件
以下配置中 t_node,只存在于分片节点(dataNode)dn1 上。blog
<table name="t_node" primaryKey="vid" autoIncrement="true" dataNode="dn1" />
4. 全局表
一个真实的业务系统中,每每存在大量的相似字典表的表,这些表基本上不多变更,字典表具备如下几个特性:
1)变更不频繁
2)数据量整体变化不大
3)数据规模不大,不多有超过数十万条记录。
对于这类的表,在分片的状况下,当业务表由于规模而进行分片之后,业务表与这些附属的字典表之间的关联,就成了比较棘手的问题,因此 Mycat 中经过数据冗余来解决这类表的 join,即全部的分片都有一份数据的拷 贝,全部将字典表或者符合字典表特性的一些表定义为全局表。数据冗余是解决跨分片数据 join 的一种很好的思路,也是数据切分规划的另一条重要规则。
数据切分后,一个大表被分到不一样的分片数据库上面,每一个表分片所在的数据库就是分片节点 (dataNode)。
数据切分后,每一个分片节点(dataNode)不必定都会独占一台机器,同一机器上面能够有多个分片数据库, 这样一个或多个分片节点(dataNode)所在的机器就是节点主机(dataHost),为了规避单节点主机并发数限 制,尽可能将读写压力高的分片节点(dataNode)均衡的放在不一样的节点主机(dataHost)。
前面讲了数据切分,一个大表被分红若干个分片表,就须要必定的规则,这样按照某种业务规则把数据分到 某个分片的规则就是分片规则,数据切分选择合适的分片规则很是重要,将极大的避免后续数据处理的难度。
数据切分后,原有的关系数据库中的主键约束在分布式条件下将没法使用,所以须要引入外部机制保证数据 惟一性标识,这种保证全局性的数据惟一标识的机制就是全局序列号(sequence)。