如何删除 MySQL 字段中的前导和尾随空格？

Posted 2023-02-22

技术标签:

【中文标题】如何删除 MySQL 字段中的前导和尾随空格？【英文标题】：How to remove leading and trailing whitespace in a MySQL field? 【发布时间】：2011-10-15 01:08:57 【问题描述】：

我有一个包含两个字段（国家和 ISO 代码）的表格：

Table1

   field1 - e.g. 'Afghanistan' (without quotes)
   field2 - e.g. 'AF'(without quotes)

在某些行中，第二个字段的开头和/或结尾有空格，这会影响查询。

Table1

   field1 - e.g. 'Afghanistan' (without quotes) 
   field2 - e.g. ' AF' (without quotes but with that space in front)

有没有办法（在 SQL 中）遍历表并查找/替换 field2 中的空格？

【问题讨论】：

将我的答案添加为评论以使其更明显：为了清楚起见，TRIM 默认情况下仅删除空格（不是所有空格）。这是文档：dev.mysql.com/doc/refman/5.0/en/… 【参考方案1】：

您正在寻找TRIM。

UPDATE FOO set FIELD2 = TRIM(FIELD2);

似乎值得一提的是，TRIM 可以支持多种类型的空格，但一次只能支持一种，并且默认情况下会使用空格。但是，您可以嵌套TRIMs。

 TRIM(BOTH ' ' FROM TRIM(BOTH '\n' FROM column))

如果您真的想在一次调用中摆脱所有空白，最好使用REGEXP_REPLACE 和[[:space:]] 表示法。这是一个例子：

SELECT 
    -- using concat to show that the whitespace is actually removed.
    CONCAT(
         '+', 
         REGEXP_REPLACE(
             '    ha ppy    ', 
             -- This regexp matches 1 or more spaces at the beginning with ^[[:space:]]+
             -- And 1 or more spaces at the end with [[:space:]]+$
             -- By grouping them with `()` and splitting them with the `|`
             -- we match all of the expected values.
             '(^[[:space:]]+|[[:space:]]+$)', 

             -- Replace the above with nothing
             ''
         ), 
         '+') 
    as my_example;
-- outputs +ha ppy+

【讨论】：

注意：这只会删除常规空格，不会删除其他空白字符（制表符、换行符等）是的，你是对的@TM，所以最好使用：UPDATE FOO set FIELD2 = TRIM(Replace(Replace(Replace(FIELD2,'\t',''),'\n', ''),'\r',''));等等当然，@ChrisSim 的解决方案也将替换内容中的换行符和制表符——这可能不是大多数人想要的 TRIM 函数！【参考方案2】：

我根据您的答案和其他链接组成的一般答案对我有用，我在评论中写了它：

 UPDATE FOO set FIELD2 = TRIM(Replace(Replace(Replace(FIELD2,'\t',''),'\n',''),'\r',''));

等等

因为 trim() 不会删除所有空格，所以最好替换所有你想要的空格而不是修剪它。

希望我能帮助你分享我的答案:)

【讨论】：

这会删除所有制表符/换行符。 TRIM 应该只删除字符串两端的空格。这是一个思考和删除换行符的好主意，谢谢，就像一个魅力，我已经投票了，因为这个想法@Chris Sim【参考方案3】：

为了清楚起见，TRIM 默认情况下只删除空格（不是所有空格）。这是文档：http://dev.mysql.com/doc/refman/5.0/en/string-functions.html#function_trim

【讨论】：

这应该作为评论添加。【参考方案4】：

请在使用此解决方案之前了解用例：

在执行选择查询时修剪不起作用

这行得通

select replace(name , ' ','') from test;

虽然没有

select trim(name) from test;

【讨论】：

TRIM() 在SELECT 声明中对我来说很好，我真的很好奇为什么这个答案会得到这么多的赞成票。你用的是mysql吗？什么版本？修剪删除前导和尾随空格dev.mysql.com/doc/refman/5.7/en/string-functions.html 是的，这个答案是错误的。这是如何获得 50 多票的？这不仅是错误的，而且是危险的。它可能会严重混淆某人的数据。我投了反对票。测试用例：SELECT CONCAT('"', TRIM(" hello world "), '"') AS `trimmed value` FROM DUAL 给出想要的输出"hello world"。虽然替换变体危险地删除了作为单词分隔符的空格：SELECT CONCAT('"', REPLACE(" hello world ", ' ', '')) AS `replaced value` FROM DUAL 给出了不需要的输出 "helloworld"【参考方案5】：

目前的答案似乎都不会真正从字符串的开头和结尾删除 100% 的空格。

正如其他帖子中提到的，默认的 TRIM 仅删除空格 - 不是制表符、换页符等。TRIMs 的组合指定其他空白字符可能会提供有限的改进，例如TRIM(BOTH '\r' FROM TRIM(BOTH '\n' FROM TRIM(BOTH '\f' FROM TRIM(BOTH '\t' FROM TRIM(txt)))))。但是这种方法的问题是只能为特定的TRIM 指定一个字符，并且这些字符只会从开头和结尾删除。因此，如果要修剪的字符串类似于 \t \t \t \t（即交替的空格和制表符），则需要更多的 TRIMs - 在一般情况下，这可能会无限期地持续下去。

对于一个轻量级的解决方案，应该可以编写一个简单的用户定义函数 (UDF) 通过循环遍历字符串开头和结尾的字符来完成这项工作。但我不会那样做......因为我已经写了一个更重量级的regular expression replacer，它也可以完成这项工作 - 并且可能由于其他原因有用，如this blog post中所述。

演示

Rextester online demo。特别是，最后一行显示其他方法失败但正则表达式方法成功。

功能：

-- ------------------------------------------------------------------------------------
-- USAGE
-- ------------------------------------------------------------------------------------
-- SELECT reg_replace(<subject>,
--                    <pattern>,
--                    <replacement>,
--                    <greedy>,
--                    <minMatchLen>,
--                    <maxMatchLen>);
-- where:
-- <subject> is the string to look in for doing the replacements
-- <pattern> is the regular expression to match against
-- <replacement> is the replacement string
-- <greedy> is TRUE for greedy matching or FALSE for non-greedy matching
-- <minMatchLen> specifies the minimum match length
-- <maxMatchLen> specifies the maximum match length
-- (minMatchLen and maxMatchLen are used to improve efficiency but are
--  optional and can be set to 0 or NULL if not known/required)
-- Example:
-- SELECT reg_replace(txt, '^[Tt][^ ]* ', 'a', TRUE, 2, 0) FROM tbl;
DROP FUNCTION IF EXISTS reg_replace;
CREATE FUNCTION reg_replace(subject VARCHAR(21845), pattern VARCHAR(21845),
  replacement VARCHAR(21845), greedy BOOLEAN, minMatchLen INT, maxMatchLen INT)
RETURNS VARCHAR(21845) DETERMINISTIC BEGIN 
  DECLARE result, subStr, usePattern VARCHAR(21845); 
  DECLARE startPos, prevStartPos, startInc, len, lenInc INT;
  IF subject REGEXP pattern THEN
    SET result = '';
    -- Sanitize input parameter values
    SET minMatchLen = IF(minMatchLen < 1, 1, minMatchLen);
    SET maxMatchLen = IF(maxMatchLen < 1 OR maxMatchLen > CHAR_LENGTH(subject),
                         CHAR_LENGTH(subject), maxMatchLen);
    -- Set the pattern to use to match an entire string rather than part of a string
    SET usePattern = IF (LEFT(pattern, 1) = '^', pattern, CONCAT('^', pattern));
    SET usePattern = IF (RIGHT(pattern, 1) = '$', usePattern, CONCAT(usePattern, '$'));
    -- Set start position to 1 if pattern starts with ^ or doesn't end with $.
    IF LEFT(pattern, 1) = '^' OR RIGHT(pattern, 1) <> '$' THEN
      SET startPos = 1, startInc = 1;
    -- Otherwise (i.e. pattern ends with $ but doesn't start with ^): Set start position
    -- to the min or max match length from the end (depending on "greedy" flag).
    ELSEIF greedy THEN
      SET startPos = CHAR_LENGTH(subject) - maxMatchLen + 1, startInc = 1;
    ELSE
      SET startPos = CHAR_LENGTH(subject) - minMatchLen + 1, startInc = -1;
    END IF;
    WHILE startPos >= 1 AND startPos <= CHAR_LENGTH(subject)
      AND startPos + minMatchLen - 1 <= CHAR_LENGTH(subject)
      AND !(LEFT(pattern, 1) = '^' AND startPos <> 1)
      AND !(RIGHT(pattern, 1) = '$'
            AND startPos + maxMatchLen - 1 < CHAR_LENGTH(subject)) DO
      -- Set start length to maximum if matching greedily or pattern ends with $.
      -- Otherwise set starting length to the minimum match length.
      IF greedy OR RIGHT(pattern, 1) = '$' THEN
        SET len = LEAST(CHAR_LENGTH(subject) - startPos + 1, maxMatchLen), lenInc = -1;
      ELSE
        SET len = minMatchLen, lenInc = 1;
      END IF;
      SET prevStartPos = startPos;
      lenLoop: WHILE len >= 1 AND len <= maxMatchLen
                 AND startPos + len - 1 <= CHAR_LENGTH(subject)
                 AND !(RIGHT(pattern, 1) = '$' 
                       AND startPos + len - 1 <> CHAR_LENGTH(subject)) DO
        SET subStr = SUBSTRING(subject, startPos, len);
        IF subStr REGEXP usePattern THEN
          SET result = IF(startInc = 1,
                          CONCAT(result, replacement), CONCAT(replacement, result));
          SET startPos = startPos + startInc * len;
          LEAVE lenLoop;
        END IF;
        SET len = len + lenInc;
      END WHILE;
      IF (startPos = prevStartPos) THEN
        SET result = IF(startInc = 1, CONCAT(result, SUBSTRING(subject, startPos, 1)),
                        CONCAT(SUBSTRING(subject, startPos, 1), result));
        SET startPos = startPos + startInc;
      END IF;
    END WHILE;
    IF startInc = 1 AND startPos <= CHAR_LENGTH(subject) THEN
      SET result = CONCAT(result, RIGHT(subject, CHAR_LENGTH(subject) + 1 - startPos));
    ELSEIF startInc = -1 AND startPos >= 1 THEN
      SET result = CONCAT(LEFT(subject, startPos), result);
    END IF;
  ELSE
    SET result = subject;
  END IF;
  RETURN result;
END;

DROP FUNCTION IF EXISTS format_result;
CREATE FUNCTION format_result(result VARCHAR(21845))
RETURNS VARCHAR(21845) DETERMINISTIC BEGIN
  RETURN CONCAT(CONCAT('|', REPLACE(REPLACE(REPLACE(REPLACE(result, '\t', '\\t'), CHAR(12), '\\f'), '\r', '\\r'), '\n', '\\n')), '|');
END;

DROP TABLE IF EXISTS tbl;
CREATE TABLE tbl
AS
SELECT 'Afghanistan' AS txt
UNION ALL
SELECT ' AF' AS txt
UNION ALL
SELECT ' Cayman Islands  ' AS txt
UNION ALL
SELECT CONCAT(CONCAT(CONCAT('\t \t ', CHAR(12)), ' \r\n\t British Virgin Islands \t \t  ', CHAR(12)), ' \r\n') AS txt;     

SELECT format_result(txt) AS txt,
       format_result(TRIM(txt)) AS trim,
       format_result(TRIM(BOTH '\r' FROM TRIM(BOTH '\n' FROM TRIM(BOTH '\f' FROM TRIM(BOTH '\t' FROM TRIM(txt))))))
         AS `trim spaces, tabs, formfeeds and line endings`,
       format_result(reg_replace(reg_replace(txt, '^[[:space:]]+', '', TRUE, 1, 0), '[[:space:]]+$', '', TRUE, 1, 0))
         AS `reg_replace`
FROM tbl;

用法：

SELECT reg_replace(
         reg_replace(txt,
                     '^[[:space:]]+',
                     '',
                     TRUE,
                     1,
                     0),
         '[[:space:]]+$',
         '',
         TRUE,
         1,
         0) AS `trimmed txt`
FROM tbl;

【讨论】：

这令人印象深刻！在 MySQL 8+ 上，可以使用新的 REGEXP_REPLACE()【参考方案6】：

此语句将删除和更新数据库的字段内容

删除字段值左侧的空格

更新表 SET field1 = LTRIM(field1);

例如。更新成员 SET firstName = LTRIM(firstName);

删除字段值右侧的空格

更新表 SETfield1 = RTRIM(field1);

例如。更新成员 SET firstName = RTRIM(firstName);

【讨论】：

【参考方案7】：

我需要修剪包含名字和姓氏的主键列中的值，因此我不想修剪所有空格，因为这会删除我需要保留的名字和姓氏之间的空格。对我有用的是......

UPDATE `TABLE` SET `FIELD`= TRIM(FIELD);

或

UPDATE 'TABLE' SET 'FIELD' = RTRIM(FIELD);

或

UPDATE 'TABLE' SET 'FIELD' = LTRIM(FIELD);

请注意，FIELD 的第一个实例用单引号括起来，而第二个则根本没有用引号括起来。我必须这样做，否则它给了我一个语法错误，说当我在引号中时它是一个重复的主键。

【讨论】：

【参考方案8】：

如果需要在select查询中使用trim，也可以使用正则表达式

SELECT * FROM table_name WHERE field RLIKE ' * query-string *'

返回字段为 ' 查询字符串 ' 的行

【讨论】：

【参考方案9】：

您可以使用 ltrim 或 rtrim 清除左右或字符串的空格。

【讨论】：

【参考方案10】：

可以使用下面的sql， UPDATE TABLE SET Column= replace(Column , ' ','')

【讨论】：

【参考方案11】：

我知道它已经被接受了，但是对于像我这样寻找“删除所有空格”的人（不仅仅是在字符串的开头和结尾）：

select SUBSTRING_INDEX('1234 243', ' ', 1);
// returns '1234'

编辑 2019/6/20： 是的，那不好。该函数返回自“第一次出现字符空间时”以来的字符串部分。所以，我想这样说会删除前导和尾随空格并返回第一个单词：

select SUBSTRING_INDEX(TRIM(' 1234 243'), ' ', 1);

【讨论】：

这与OP无关。哇，您没有删除 所有空格 - 您正在删除 从第一个空格开始的所有内容。

以上是关于如何删除 MySQL 字段中的前导和尾随空格？的主要内容，如果未能解决你的问题，请参考以下文章

如何删除前导和尾随空格？

前导和尾随空格剪切 + 中间空格替换

如何在Java中仅删除字符串的尾随空格并保留前导空格？

如何取回使用 .trim 删除的所有原始前导和尾随空格？ [复制]

XSLT 删除所有属性的前导和尾随空格

删除 JSON 键中的前导和尾随空格