SQL语句拆分表中内容,并变成两列
Posted
tags:
篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了SQL语句拆分表中内容,并变成两列相关的知识,希望对你有一定的参考价值。
如何通过sql语句,把一列中的数据读出来,并把字母和数字分开,变成两列,比如:列名“Column1”,里面有若干含A123,B23,BD21这种字母加数字的数据,如何把它们分成两列成为A,B,BD|123,23,21这样子的
if exists (select 1 from sysobjects where name = 'uf_get_value' and xtype = 'FN')
drop function uf_get_value
go
create function uf_get_value(@value VARCHAR(100))
--获取列默认值
returns VARCHAR(100) as
begin
declare @rtn VARCHAR(100), @tmp VARCHAR(100), @status CHAR(1)
SET @rtn = ''
SET @tmp = ''
WHILE len(@value) > 0
BEGIN
IF ascii(substring(@value, 1, 1)) = ascii(',')
BEGIN
SET @value = RIGHT(@value, len(@value) - 1)
CONTINUE
END
IF ascii(substring(@value, 1, 1)) BETWEEN ascii('0') AND ascii('9')
BEGIN
SET @tmp = @tmp + substring(@value, 1, 1)
SET @status = 'N'
END
ELSE
BEGIN
SET @rtn = @rtn + substring(@value, 1, 1)
SET @status = 'S'
END
SET @value = RIGHT(@value, len(@value) - 1)
IF @value <> ''
BEGIN
IF @status = 'S' AND ascii(substring(@value, 1, 1)) BETWEEN ascii('0') AND ascii('9') SET @rtn = @rtn + ','
IF @status = 'N' AND NOT ascii(substring(@value, 1, 1)) BETWEEN ascii('0') AND ascii('9') SET @tmp = @tmp + ','
END
END
IF RIGHT(@rtn, 1) = ',' SET @rtn = LEFT(@rtn, len(@rtn) - 1)
SET @rtn = @rtn + '|' + @tmp
RETURN @rtn
END
go
--测试
--SELECT dbo.uf_get_value('A123,B23,BD21')
GO
ALTER FUNCTION DBO.SPLT
(@COL NVARCHAR(200),
@PRA NVARCHAR(10)
)
RETURNS NVARCHAR(100)
AS
BEGIN
DECLARE @NUM NVARCHAR(100),@STR NVARCHAR(100),@I INT
SET @NUM=''
SET @STR=''
SET @I=1
WHILE(@I<=LEN(ISNULL(@COL,'')))
BEGIN
IF SUBSTRING(@COL,@I,1)IN('0','1','2','3','4','5','6','7','8','9') --说明是数字
SET @NUM=@NUM+SUBSTRING(@COL,@I,1)
ELSE
SET @STR=@STR+SUBSTRING(@COL,@I,1)
SET @I=@I+1
END
IF @PRA='STR'
SET @NUM=@STR
RETURN @NUM
END
GO
SELECT dbo.SPLT('A123,B23,BD21','STR'),dbo.SPLT('A123,B23,BD21','') 参考技术B 用substring()函数 分割字符串 或者 like 正则匹配 参考技术C 用excel做一个表结构,然后把想等到的结果放上来
我可以使用 SQL 将存储为 CSV(逗号分隔值)的表列的内容拆分为新表中的单独行吗?
【中文标题】我可以使用 SQL 将存储为 CSV(逗号分隔值)的表列的内容拆分为新表中的单独行吗?【英文标题】:Can I use SQL to split contents of a table column stored as CSV (comma separated values) into individual rows in a new table? 【发布时间】:2015-03-13 18:26:03 【问题描述】:我看到有几个相关问题的答案,但不完全是我需要的,所以我会问一个新问题。我有这个包含数千行商店库存数据的 CSV 文件,我想将这些数据导入 MS SQL Server 数据库并使用 SQL 来处理它们。导入 CSV 文件后,SQL 表将有三列包含 CSV 数据。问题是我需要将此 CSV 数据放入单独的行中以便对其进行更多分析。我想最终得到两个表:通过导入 CSV 文件创建的原始表,以及通过拆分 CSV 创建的表。下面是这两个表的示意图:
/Table1 (the original CSV file). First row is column names:
StoreID,Date,StoreName,City,State,Category1CSV,Category2CSV,Category3CSV
1051,2/16/2014,Easton,Columbus,OH,"Flour,Yeast,Baking Powder","Milk,Water,Oil","Cinnamon,Sugar"
1425,1/14/2014,Crocker Park,Westlake,OH,"Baking Powder,Yeast,Flour","Oil,Milk,Water","Rosemay,Cinnamon,Sugar"
/Table2 (after splitting the CSV column contents). First row is column names:
StoreID,Date,StoreName,City,State,ItemName,ItemRank,ItemCategory
1051,2/16/2014,Easton,Columbus,OH,Flour,1,1
1051,2/16/2014,Easton,Columbus,OH,Yeast,2,1
1051,2/16/2014,Easton,Columbus,OH,Baking Powder,3,1
1051,2/16/2014,Easton,Columbus,OH,Milk,4,2
1051,2/16/2014,Easton,Columbus,OH,Water,5,2
1051,2/16/2014,Easton,Columbus,OH,Oil,6,2
1051,2/16/2014,Easton,Columbus,OH,Cinnamon,7,3
1051,2/16/2014,Easton,Columbus,OH,Sugar,8,3
1425,1/14/2014,Crocker Park,Westlake,OH,Baking Powder,1,1
1425,1/14/2014,Crocker Park,Westlake,OH,Yeast,2,1
1425,1/14/2014,Crocker Park,Westlake,OH,Flour,3,1
1425,1/14/2014,Crocker Park,Westlake,OH,Oil,4,2
1425,1/14/2014,Crocker Park,Westlake,OH,Milk,5,2
1425,1/14/2014,Crocker Park,Westlake,OH,Water,6,2
1425,1/14/2014,Crocker Park,Westlake,OH,Rosemary,7,3
1425,1/14/2014,Crocker Park,Westlake,OH,Cinnamon,8,3
1425,1/14/2014,Crocker Park,Westlake,OH,Sugar,9,3
SQL 列数据类型有:
Table 1
StoreID - int
Date - date
StoreName - nvarchar(50)
City- nvarchar(50)
State- nvarchar(50)
Category1CSV - nvarchar(MAX)
Category2CSV - nvarchar(MAX)
Category3CSV - nvarchar(MAX)
Table2
StoreID - int
Date - date
StoreName - nvarchar(50)
City- nvarchar(50)
State - nvarchar(50)
ItemName - nvarchar(50)
ItemRank - tinyint
ItemCategory -tinyint
标记为 Category1CSV、Category2CSV 和 Category3CSV 内容的表 1 列映射到表 2 列:ItemName、ItemRank、ItemCategory,其中 ItemName 是项目(例如:Flour),ItemRank 是项目在 CSV 列表中的顺序,并且 ItemCategory 是 1,2 或 3,具体取决于数据来自 Category1CSV、Category2CSV 还是 Category3CSV。
最重要的方面(除了拆分 CSV 列)是保持 CSV 列中项目的顺序。例如,StroreID 1051 的 Category1CSV 内容为“Flour,Yeast,Baking Powder”。这些将映射到 ItemName、ItemRank 和 ItemCategory 列,这样 ItemName = Flour,它的 ItemRank = 1,并且 ItemCategory = 1。这将是表 2 中的第一行。第二行是 ItemName = Yeast,它是 ItemRank = 2,并且 ItemCategory = 1,依此类推,直到您最终得到类似于上面的表 2 的内容。此外,您会注意到 ItemRank 编号从 Category1CSV 列的内容开始,然后是 Category2CSV,最后是 Category3CSV。
在冗长的解释之后,是否有可能有一些 SQL 语句为我从表 1 创建表 2?如果是这样,那会是什么样子?我打算使用 MS SQL Server Express 2012。
或者...正如有人向我建议的那样,最好在 Excel 或 Python 脚本中使用一些 VBA(可能与 Notepad++ 结合使用?)来完成此操作,然后只导入最终数据?我不在乎,我只是不能继续手动编辑 CSV 文件,因为它非常乏味且耗时。
【问题讨论】:
您是否考虑过使用 Excel 的文本到列功能而不是 SQL? SQL 在解析字符串数据方面并不是最好的,编写一个过程来做到这一点非常麻烦...... 我也倾向于在 Excel 中解析出来,然后将结果推送到 SQL。 @Phrancis - 文本到列给了我新的列,我需要新的行。我刚刚研究了一些VBA......它看起来真的很复杂。我需要根据“,”进行拆分,将其复制到新列,为每个 CSV 列执行此操作,然后我需要向下填充其他列,然后根据顺序为排名添加一个数字系列CSV 列表中的项目,最后告诉它是否来自名为 Category1CSV 的列,然后是 ItemCategory 的值 = 1,来自名为 Category2CSV 的列,然后是 ItemCategory = 2 的值。等等 如果我要在 Excel 中解决这个问题,I think this 可能是我的答案的一部分。 好吧,如果您必须使用 SQL,那么您可能需要查看something like this。公平的警告,但它不是很漂亮。 【参考方案1】:我会使用拆分函数来拆分附加值。
我使用的拆分函数使用数字(数字从 1 到 1,000,000 的表格)来促进拆分过程。
一旦 Numbers 表和 Split 函数就位,我将使用 CROSS APPLY 函数将 Split 应用于 CSV 列。拆分 CSV 列的代码如下所示(这只是基于您提供的数据的几个测试行)。
DECLARE @Table TABLE (val1 VARCHAR(50), val2 VARCHAR(50), val3 VARCHAR(50), csv1 VARCHAR(100), csv2 VARCHAR(100), csv3 VARCHAR(100))
INSERT INTO @Table
VALUES ('Easton', 'Columbus', 'OH', 'Flour,Yeast,Baking Powder','Milk,Water,Oil','Cinnamon,Sugar')
, ('Crocker Park', 'Westlake', 'OH', 'Baking Powder,Yeast,Flour','Oil,Milk,Water','Rosemary,Cinnamon,Sugar')
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv1, ',')
) apl
UNION ALL
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv2, ',')
) apl
UNION ALL
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv3, ',')
) apl
ORDER BY val1
根据示例日期,其输出将如下所示。
Crocker Park Westlake OH Baking Powder
Crocker Park Westlake OH Cinnamon
Crocker Park Westlake OH Flour
Crocker Park Westlake OH Milk
Crocker Park Westlake OH Oil
Crocker Park Westlake OH Rosemary
Crocker Park Westlake OH Sugar
Crocker Park Westlake OH Water
Crocker Park Westlake OH Yeast
Easton Columbus OH Baking Powder
Easton Columbus OH Cinnamon
Easton Columbus OH Flour
Easton Columbus OH Milk
Easton Columbus OH Oil
Easton Columbus OH Sugar
Easton Columbus OH Water
Easton Columbus OH Yeast
这是创建数字表的代码
DECLARE @tbl TABLE (n INT)
INSERT INTO @tbl (n)
VALUES (1),(2),(3),(4),(5),(6),(7),(8),(9),(10)
; WITH Num AS(
SELECT one.n
FROM @tbl one
CROSS JOIN @tbl two
CROSS JOIN @tbl three
CROSS JOIN @tbl four
CROSS JOIN @tbl five
CROSS JOIN @tbl six
)
SELECT ROW_NUMBER() OVER(ORDER BY n) AS n
INTO dbo.Numbers
FROM Num
ALTER TABLE dbo.Numbers
ALTER COLUMN n INT NOT NULL
ALTER TABLE dbo.Numbers
ADD PRIMARY KEY (n)
GO
最后,这里是创建拆分函数的代码。
CREATE FUNCTION dbo.Split
(
@List VARCHAR(MAX),
@Delimiter VARCHAR(255)
)
RETURNS TABLE
AS
RETURN
(
SELECT val = SUBSTRING(@List, n, CHARINDEX(@Delimiter, @List + @Delimiter, n) - n)
FROM dbo.Numbers
WHERE n <= CONVERT(INT, LEN(@List))
AND SUBSTRING(@Delimiter + @List, n, LEN(@Delimiter)) = @Delimiter
);
GO
【讨论】:
谢谢,我试试看!以上是关于SQL语句拆分表中内容,并变成两列的主要内容,如果未能解决你的问题,请参考以下文章
从表中的两列中选择相同的数据,并使用一条sql语句显示所有数据
编写一个sql语句,把b列中的数据用逗号分隔开,变成很多?谢谢