数据库根据指定字段去重

需求:对一张用户表根据name/email/card_num字段去除重复数据;函数

思路:用group by方法能够查询出'去重'后的数据,将这些数据存储到一张临时表中,而后将临时表的数据存储到指定的表中;测试

误区及解决方案:group by方法只能获取部分字段(去重指定字段),不能一次获取到完整的数据,可是能够经过max函数获取group by结果集中的id,再根据id集合查询出所有的记录。code

测试思路

  • 查询去重后的数据

SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num;email

  • 从去重后的数据中获取id集合

SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T;select

  • 根据去重后的数据中获取id集合,从源数据中得到记录列表

SELECT * from users where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);方法

实际方法

  • 根据去重后的数据中获取id集合,从源数据中得到记录列表,将这些列表数据存入一个临时表中

create TEMP TABLE tmp_data as SELECT * from users where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);数据

  • 将临时表中的数据存入指定的数据表中,完毕

insert into users_copy1 select * from tmp_data;查询

检测

  • 检测结果是否是和第一步查询去重后的数据总数相同

select count(*) from users_copy1;集合

相关文章
相关标签/搜索