数据库依据指定字段去重
需求:对一张会员表依据name/email/card_num字段去掉反复数据;
思绪:用group by办法可以查询出'去重'后的数据,将这些数据存储到一张暂时表中,然后将暂时表的数据存储到指定的表中;
误区及解决方案:group by办法只能猎取局部字段(去重指定字段),不克不及一次猎取到完备的数据,但是可以通过max函数猎取group by效果集中的id,再依据id汇合查询出全部的记载。
测试思绪
- 查询去重后的数据
SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num;
- 从去重后的数据中猎取id汇合
SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T;
- 依据去重后的数据中猎取id汇合,从源数据中获得记载列表
SELECT * from users where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);
现实办法
- 依据去重后的数据中猎取id汇合,从源数据中获得记载列表,将这些列表数据存入一个暂时表中
create TEMP TABLE tmp_data as SELECT * from users where id in (SELECT ID from (SELECT max(id) as id,name,email,card_num FROM users GROUP BY name,email,card_num) as T);
- 将暂时表中的数据存入指定的数据表中,结束
insert into users_copy1 select * from tmp_data;
检测
- 检测效果是不是和首先步查询去重后的数据总数雷同
select count(*) from users_copy1;
测试效果:1.4w条数据中有2300条数据反复,现实运转效果为0.7s,根本知足此刻的需求。
更多MySQL相干技术文章,请拜访MySQL教程栏目进行学习!
以上就是数据库依据指定字段去重的细致内容,更多请关注 百分百源码网 其它相干文章!