数据库怎么去某一字段的重复数据

数据库怎么去某一字段的重复数据,第1张

--按某一字段分组取最大(小)值所在行的数据

/*

数据如下:

name val memo

a2 a2(a的第二个值)

a1 a1--a的第一个

a3 a3:a的第三个

b1 b1--b的第一个值

b3 b3:b的第三个值

b2 b2b2b2b2

b4 b4b4

b5 b5b5b5b5b5

*/

--创建表并插入数据:

create table tb(name varchar(10),val int,memo varchar(20))

insert into tb values('a',2, 'a2(a的第二个值)')

insert into tb values('a',1, 'a1--a的第一个值')

insert into tb values('a',3, 'a3:a的第三个值')

insert into tb values('b',1, 'b1--b的第一个值')

insert into tb values('b',3, 'b3:b的第三个值')

insert into tb values('b',2, 'b2b2b2b2')

insert into tb values('b',4, 'b4b4')

insert into tb values('b',5, 'b5b5b5b5b5')

go

--一、按name分组取val最大的值所在行的数据。

--方法1:

select a.* from tb a where val = (select max(val) from tb where name = a.name) order by a.name

--方法2:

select a.* from tb a where not exists(select 1 from tb where name = a.name and val >a.val)

--方法3:

select a.* from tb a,(select name,max(val) val from tb group by name) b where a.name = b.name and a.val = b.val order by a.name

--方法4:

select a.* from tb a inner join (select name , max(val) val from tb group by name) b on a.name = b.name and a.val = b.val order by a.name

--方法5

select a.* from tb a where 1 >(select count(*) from tb where name = a.name and val >a.val ) order by a.name

/*

name val memo

---------- ----------- --------------------

a 3 a3:a的第三个值

b 5 b5b5b5b5b5

*/

--二、按name分组取val最小的值所在行的数据。

--方法1:

select a.* from tb a where val = (select min(val) from tb where name = a.name) order by a.name

--方法2:

select a.* from tb a where not exists(select 1 from tb where name = a.name and val <a.val)

--方法3:

select a.* from tb a,(select name,min(val) val from tb group by name) b where a.name = b.name and a.val = b.val order by a.name

--方法4:

select a.* from tb a inner join (select name , min(val) val from tb group by name) b on a.name = b.name and a.val = b.val order by a.name

--方法5

select a.* from tb a where 1 >(select count(*) from tb where name = a.name and val <a.val) order by a.name

/*

name val memo

---------- ----------- --------------------

a 1 a1--a的第一个值

b 1 b1--b的第一个值

*/

--三、按name分组取第一次出现的行所在的数据。

select a.* from tb a where val = (select top 1 val from tb where name = a.name) order by a.name

/*

name val memo

---------- ----------- --------------------

a 2 a2(a的第二个值)

b 1 b1--b的第一个值

*/

--四、按name分组随机取一条数据。

select a.* from tb a where val = (select top 1 val from tb where name = a.name order by newid()) order by a.name

/*

name val memo

---------- ----------- --------------------

a 1 a1--a的第一个值

b 5 b5b5b5b5b5

*/

--五、按name分组取最小的两个(N个)val

select a.* from tb a where 2 >(select count(*) from tb where name = a.name and val <a.val ) order by a.name,a.val

select a.* from tb a where val in (select top 2 val from tb where name=a.name order by val) order by a.name,a.val

select a.* from tb a where exists (select count(*) from tb where name = a.name and val <a.val having Count(*) <2) order by a.name

/*

name val memo

---------- ----------- --------------------

a 1 a1--a的第一个值

a 2 a2(a的第二个值)

b 1 b1--b的第一个值

b 2 b2b2b2b2

*/

--六、按name分组取最大的两个(N个)val

select a.* from tb a where 2 >(select count(*) from tb where name = a.name and val >a.val ) order by a.name,a.val

select a.* from tb a where val in (select top 2 val from tb where name=a.name order by val desc) order by a.name,a.val

select a.* from tb a where exists (select count(*) from tb where name = a.name and val >a.val having Count(*) <2) order by a.name

/*

name val memo

---------- ----------- --------------------

a 2 a2(a的第二个值)

a 3 a3:a的第三个值

b 4 b4b4

b 5 b5b5b5b5b5

*/

--七,如果整行数据有重复,所有的列都相同。

/*

数据如下:

name val memo

a2 a2(a的第二个值)

a1 a1--a的第一个值

a1 a1--a的第一个值

a3 a3:a的第三个值

a3 a3:a的第三个值

b1 b1--b的第一个值

b3 b3:b的第三个值

b2 b2b2b2b2

b4 b4b4

b5 b5b5b5b5b5

*/

--在sql server 2000中只能用一个临时表来解决,生成一个自增列,先对val取最大或最小,然后再通过自增列来取数据。

--创建表并插入数据:

create table tb(name varchar(10),val int,memo varchar(20))

insert into tb values('a',2, 'a2(a的第二个值)')

insert into tb values('a',1, 'a1--a的第一个值')

insert into tb values('a',1, 'a1--a的第一个值')

insert into tb values('a',3, 'a3:a的第三个值')

insert into tb values('a',3, 'a3:a的第三个值')

insert into tb values('b',1, 'b1--b的第一个值')

insert into tb values('b',3, 'b3:b的第三个值')

insert into tb values('b',2, 'b2b2b2b2')

insert into tb values('b',4, 'b4b4')

insert into tb values('b',5, 'b5b5b5b5b5')

go

select * , px = identity(int,1,1) into tmp from tb

select m.name,m.val,m.memo from

(

select t.* from tmp t where val = (select min(val) from tmp where name = t.name)

) m where px = (select min(px) from

(

select t.* from tmp t where val = (select min(val) from tmp where name = t.name)

) n where n.name = m.name)

drop table tb,tmp

/*

name val memo

---------- ----------- --------------------

a 1 a1--a的第一个值

b 1 b1--b的第一个值

(2 行受影响)

*/

--在sql server 2005中可以使用row_number函数,不需要使用临时表。

--创建表并插入数据:

create table tb(name varchar(10),val int,memo varchar(20))

insert into tb values('a',2, 'a2(a的第二个值)')

insert into tb values('a',1, 'a1--a的第一个值')

insert into tb values('a',1, 'a1--a的第一个值')

insert into tb values('a',3, 'a3:a的第三个值')

insert into tb values('a',3, 'a3:a的第三个值')

insert into tb values('b',1, 'b1--b的第一个值')

insert into tb values('b',3, 'b3:b的第三个值')

insert into tb values('b',2, 'b2b2b2b2')

insert into tb values('b',4, 'b4b4')

insert into tb values('b',5, 'b5b5b5b5b5')

go

select m.name,m.val,m.memo from

(

select * , px = row_number() over(order by name , val) from tb

) m where px = (select min(px) from

(

select * , px = row_number() over(order by name , val) from tb

) n where n.name = m.name)

drop table tb

/*

name val memo

---------- ----------- --------------------

a 1 a1--a的第一个值

b 1 b1--b的第一个值

(2 行受影响)

*/

1、打开要去掉重复数据的数据库,这里新建一张含有重复数据的user表做示例,如下图所示:

2、输入“select * from user where name in (select name from user group by name having count(name) >1) ”sql语句,点击运行可以看到查询出了数据库中user表的重复数据。

3、通过“delete from user where   name in (select name from user group by name  having count(name) >1) ”sql语句删除姓名重复的数据。

4、也可以通过“select distinct name from user”sql语句来去掉重复数据,这里去掉了张三的重复数据。

5、通过“select distinct class from user”sql语句来去掉班级相同的重复数据,如下图所示:

sql中删除一个表中的重复记录可以采用如下步骤:

1、把a_dist表的记录用distinct去重,结果放到临时表中。

select  distinct * into #temp from a_dist

2、把a_dist表的记录全部删除。

delete  from a_dist

3、把临时表中的数据信息导进到a_dist表中,并删除临时表。

insert  into a_dist select * from #temp

drop table #temp

扩展资料:

SQL (结构化查询语言)是用于执行查询的语法。在数据库上执行的大部分工作都由 SQL 语句完成。SQL 语言包含用于更新、插入和删除记录的语法。

增删改查指令构成了 SQL 的 DML 部分:

SELECT - 从数据库表中获取数据

UPDATE - 更新数据库表中的数据

DELETE - 从数据库表中删除数据

INSERT INTO - 向数据库表中插入数据


欢迎分享,转载请注明来源:内存溢出

原文地址: http://outofmemory.cn/sjk/9619054.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2023-04-30
下一篇 2023-04-30

发表评论

登录后才能评论

评论列表(0条)

保存