mysql 正则表达式替换,把指定位置随机数替换成固定数字

Posted

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了mysql 正则表达式替换,把指定位置随机数替换成固定数字相关的知识,希望对你有一定的参考价值。

例如 表A 字段B
内容为
*****省略*****width="1235" height="239" *****省略*****
*****省略*****width="2284" height="1235" *****省略*****
如何用正则语句把所有的width="xxx"替换成width="100%"

谢谢。
示例数据补全一些
*****省略*****width="1235" height="239" *****省略*****width="2888" height="1588" *****省略*****

就是说一行数据中,不一定出现几个width 和 height,是图片地址集合,有可能很多图片,谢谢各位了。

MySQL 一直以来都支持正则匹配,不过对于正则替换则一直到MySQL 8.0 才支持。对于这类场景,以前要么在MySQL端处理,要么把数据拿出来在应用端处理。

比如我想把表y1的列str1的出现第3个action的子 串替换成dble,怎么实现?


1. 自己写SQL层的存储函数。代码如下写死了3个,没有优化,仅仅作为演示,MySQL 里非常不建议写这样的函数。

    mysql

    DELIMITER $$

    USE `ytt`$$

    DROP FUNCTION IF EXISTS `func_instr_simple_ytt`$$

    CREATE DEFINER=`root`@`localhost` FUNCTION `func_instr_simple_ytt`(

    f_str VARCHAR(1000), -- Parameter 1

    f_substr VARCHAR(100),  -- Parameter 2

    f_replace_str varchar(100),

    f_times int -- times counter.only support  3.

    ) RETURNS varchar(1000)

    BEGIN

    declare v_result varchar(1000) default 'ytt'; -- result.

    declare v_substr_len int default 0; -- search string length.

    set f_times = 3; -- only support  3.

    set v_substr_len = length(f_substr);

    select instr(f_str,f_substr) into @p1; -- First real position .

    select instr(substr(f_str,@p1+v_substr_len),f_substr) into @p2; Secondary virtual position.

    select instr(substr(f_str,@p2+ @p1 +2*v_substr_len - 1),f_substr) into @p3; -- Third virtual position.

    if @p1 > 0  && @p2 > 0 && @p3 > 0 then -- Fine.

    select

    concat(substr(f_str,1,@p1 + @p2 + @p3 + (f_times - 1) * v_substr_len  - f_times)

    ,f_replace_str,

    substr(f_str,@p1 + @p2 + @p3 + f_times * v_substr_len-2)) into v_result;

    else

    set v_result = f_str; -- Never changed.

    end if;

    -- Purge all session variables.

    set @p1 = null;

    set @p2 = null;

    set @p3 = null;

    return v_result;

    end;

    $$

    DELIMITER ;

    -- 调用函数来更新:

    mysql> update y1 set str1 = func_instr_simple_ytt(str1,'action','dble',3);

    Query OK, 20 rows affected (0.12 sec)

    Rows matched: 20  Changed: 20  Warnings: 0

    2. 导出来用sed之类的工具替换掉在导入,步骤如下:(推荐使用)

    1)导出表y1的记录。

    mysqlmysql> select * from y1 into outfile '/var/lib/mysql-files/y1.csv';Query OK, 20 rows affected (0.00 sec)


    2)用sed替换导出来的数据。

    shellroot@ytt-Aspire-V5-471G:/var/lib/mysql-files#  sed -i 's/action/dble/3' y1.csv


    3)再次导入处理好的数据,完成。

    mysql

    mysql> truncate y1;

    Query OK, 0 rows affected (0.99 sec)

    mysql> load data infile '/var/lib/mysql-files/y1.csv' into table y1;

    Query OK, 20 rows affected (0.14 sec)

    Records: 20  Deleted: 0  Skipped: 0  Warnings: 0

    以上两种还是推荐导出来处理好了再重新导入,性能来的高些,而且还不用自己费劲写函数代码。

    那MySQL 8.0 对于以上的场景实现就非常简单了,一个函数就搞定了。

    mysqlmysql> update y1 set str1 = regexp_replace(str1,'action','dble',1,3) ;Query OK, 20 rows affected (0.13 sec)Rows matched: 20  Changed: 20  Warnings: 0


    还有一个regexp_instr 也非常有用,特别是这种特指出现第几次的场景。比如定义 SESSION 变量@a。

    mysqlmysql> set @a = 'aa bb cc ee fi lucy  1 1 1 b s 2 3 4 5 2 3 5 561 19 10 10 20 30 10 40';Query OK, 0 rows affected (0.04 sec)


    拿到至少两次的数字出现的第二次子串的位置。

    mysqlmysql> select regexp_instr(@a,'[:digit:]2,',1,2);+--------------------------------------+| regexp_instr(@a,'[:digit:]2,',1,2) |+--------------------------------------+|                                   50 |+--------------------------------------+1 row in set (0.00 sec)


    那我们在看看对多字节字符支持如何。

    mysql

    mysql> set @a = '中国 美国 俄罗斯 日本 中国 北京 上海 深圳 广州 北京 上海 武汉 东莞 北京 青岛 北京';

    Query OK, 0 rows affected (0.00 sec)

    mysql> select regexp_instr(@a,'北京',1,1);

    +-------------------------------+

    | regexp_instr(@a,'北京',1,1)   |

    +-------------------------------+

    |                            17 |

    +-------------------------------+

    1 row in set (0.00 sec)

    mysql> select regexp_instr(@a,'北京',1,2);

    +-------------------------------+

    | regexp_instr(@a,'北京',1,2)   |

    +-------------------------------+

    |                            29 |

    +-------------------------------+

    1 row in set (0.00 sec)

    mysql> select regexp_instr(@a,'北京',1,3);

    +-------------------------------+

    | regexp_instr(@a,'北京',1,3)   |

    +-------------------------------+

    |                            41 |

    +-------------------------------+

    1 row in set (0.00 sec)

    那总结下,这里我提到了 MySQL 8.0 的两个最有用的正则匹配函数 regexp_replace 和 regexp_instr。针对以前类似的场景算是有一个完美的解决方案。

参考技术A 这个问题研究好久了。题主如果有答案请务必补充一下。我是想把xxx123.jpg,xxx456.jpg......变成xxx.jpg
题主我昨天测试了一下。你可以用width="\w\w\w"和width="\w\w\w\w"来匹配原来的数据。然后替换成为width="100%"就可以了。\w指的是任意字符包括下划线,但只能匹配到一个字符。所以要根据字符的数量来添加减少。
参考技术B 如果是字母,还是没有办法做因变量进行分析你必须先全部将其替换,把abcd依次替换成数字1234来代替,之后再把变量类型 由字符型改成数值型就可以了; 如果你直接是字母改的话 改完以后所有的值都会成缺失不见了 之后就可以采用logistic回归进行分析了 参考技术C mysql 正则表达式替换,把指定位置随机数替换成固定数字
”将里面的数字替换成大写的数字?“数字只有小写,比如,0,1,2没听说过有大写的。只听说过,有这些:I,II,III一,二,三壹,贰,叁。
参考技术D mysql 正则表达式替换,把指定位置随机数替换成固定数字
”将里面的数字替换成大写的数字?“数字只有小写,比如,0,1,2没听说过有大写的。只听说过,有这些:I,II,III一,二,三壹,贰,叁。

js正则匹配替代指定字符(根据img标签的src中的命名规则,用正则表达式替换成下面格式的文字)

刚恢复方法<img src="arclist/em_4.gif">法规法规和福建<img src="arclist/em_23.gif">共和国环境观看<img src="arclist/em_1.gif">活该活该客户
刚恢复方法<img src="arclist/em_8.gif">法规法规和福建<img src="arclist/em_3.gif">共和国环境观看<img src="arclist/em_1.gif">活该活该客户
刚恢复方法<img src="arclist/em_12.gif">法规法规和福建<img src="arclist/em_13.gif">共和国环境观看<img src="arclist/em_1.gif">活该活该客户
刚恢复方法<img src="arclist/em_14.gif">法规法规和福建<img src="arclist/em_3.gif">共和国环境观看<img src="arclist/em_1.gif">活该活该客户

转换成:

刚恢复方法【em_4】法规法规和福建【em_23】共和国环境观看【em_1】活该活该客户
刚恢复方法【em_8】法规法规和福建【em_3】共和国环境观看【em_1】活该活该客户
刚恢复方法【em_12】法规法规和福建【em_13】共和国环境观看【em_1】活该活该客户
刚恢复方法【em_14】法规法规和福建【em_3】共和国环境观看【em_1】活该活该客户

参考技术A var str='你的字符串';
var reg=/<img[\s\S]+\/?>/g;
str=str.replace(reg,'');
str即是你的需要结果

以上是关于mysql 正则表达式替换,把指定位置随机数替换成固定数字的主要内容,如果未能解决你的问题,请参考以下文章

mySQL字段内容替换成指定随机的几个内容?

正则表达式 替换

UE中如何使用正则替换行中部分字符串

C#正则表达式指定替换

正则表达式位置匹配攻略【转】

如何指定将被正则表达式替换的位置