在UltraEdit的查和替换中使⽤正则表达式(转)
很多朋友都⽤过或者正在⽤UltraEdit,这个编辑器陪伴我也好⼏年了,从很多地⽅影响着我写代码的快捷键习惯,Ultraedit提供了⾮常丰富的编辑功能,其中⾮常重要的查和替换功能⼀定⼤家都⽤过,Ultraedit提供的查替换功能⾮常⽅便和强⼤,可以在单独⽂件⾥⾯查替换,也可以在多个⽂件、多个⽬录⾥⾯进⾏查替换。⽽我们在使⽤这些查替换功能的时候,⼀
LiveJournal Tags: , 般都是针对某个字符串进⾏,前两天我要对⼀个⽬录下(包含⼦⽬录)所有的html⽂件中某⼀段代码进⾏查替换,⼀下⼦不知道怎么操作了,由于长期写程序⽤到正则表达式,于是猜想具备如此强⼤功能的Ultraedit⼀定也有这样类似的匹配功能,于是点击Help⼀看,果然不出所料,Ultraedit⽀持基本的正则表达式匹配查和替换功能,这能满⾜我们⼏乎全部的需要了。
下⾯是对UltraEdit的Help中针对查替换使⽤正则表达式部分的整理,最后还有我前两天⽤到的⼀个多⾏代码查替换的例⼦。
Ultraedit在使⽤正则表达式进⾏查替换时有两个可使⽤的语法集合。⼀个是 UltraEdit 的更早的版本被使⽤的原来的 UltraEdit 句法。另⼀个是”Unix”类型的正则表达式,这个集合在ultraedit的默认配置中是没有启⽤的,需要在配置中到search项,启⽤Unix类型的正则表达式。
语法集合⼀:
符号功能
% 匹配⾏的开始 - 显⽰搜索字符串必须在⾏的开始,但是在所选择的结果字符串中不包括任何⾏终⽌字符。
$ 匹配⾏尾 - 显⽰搜索字符串必须在⾏尾,但是在所选择的结果字符串中不包括任何⾏终⽌字符。
? 除了换⾏符以外匹配任何单个的字符
* 除了换⾏符匹配任何数量的字符和数字
+ 前⼀字符匹配⼀个或多个,但⾄少要出现⼀个
++ 前⼀字符匹配零个或多个,但⾄少要出现⼀个
^b 匹配⼀个分页
^p 匹配⼀个换⾏符(CR/LF)(段)(DOS⽂件)
^r 匹配⼀个换⾏符(CR 仅仅)(段)(MAC ⽂件)
regex匹配^n 匹配⼀个换⾏符 ( LF 仅仅 )( 段 )( UNIX ⽂件 )
^t 匹配⼀个标签字符TAB
[] 匹配任何单个的字符,或在⽅括号中的范围
^{A^}^{ B^} 匹配表达式A或 B
^ 重载其后的正规表达式字符
^(^) 括或标注为⽤于替换命令的表达式。
⼀个正则表达式最多可以有9个标注表达式, 按正规表达式的需要⽽定。
相应的替换表达式是 ^x , 替换范围x是1-9。例如:
If ^(h*o^) ^(f*s^) matches “hello folks”,
^2 ^1 would replace it with “folks hello”.
(hello folks 将被替换成 folks hello。)
注: ^ 是实际字符 ^不是Ctl + 键值。
例如:
m?n 匹配 “man”,”men”,”min” 但不匹配 “moon”.
t*t 匹配 “test”,”tonight” 和 “tea time” (the “tea t” portion) 但不匹配 “tea
time” (newline between “tea ” and “time”).
Te+st 匹配 “test”,”teest”,” teeeest “等等。但是不匹配 “tst”。
[aeiou] 匹配每个⼩写元⾳。
[,.?] 匹配⼀⽂字的 “,”,”.”或 “?”。
[0-9, a-z] 匹配任何数位,或⼩写字母。
[~0-9] 除了数字以外匹配任何字符 (~ 意味着”不”)
你按如下⽅式可以查⼀个表达式A或 B :
“^{John^}^{Tom^}”
这将在John或Tom的出现。应该在 2 个表达式之间没有任何东西。
你可以在同⼀搜索中按如下⽅式组合A or B and C or D:
“^{John^}^{Tom^}^{Smith^}^{Jones^}”
这将在John or Tom 后⾯ Smith or Jones。
语法⼆:”Unix”句法类型的正则表达式
符号功能
\ 标记下⼀个字符作为⼀个特殊的字符。
"n" 匹配字符"n"。"n" ⼀个换⾏符或换⾏符字符。
^ 匹配/定位⾏的开始。
$ 匹配/定位⾏的尾。
* 匹配前⾯的字符零次或多次。例
+ 匹配前⾯的字符⼀次或多次。例
. 匹配除了⼀个换⾏符字符匹配任何单个的字符。
(expression)标注⽤于替换命令的表达式。⼀个正则表达式根据需要,最多可以有9个标注表达式。相应的代替表达式是 x , x的范围是 1-9 。
例如:
If (h.*o) (f.*s) matches "hello folks",
2 1 would replace it with "folks hello".
(hello folks 将被替换成 folks hello。)
[xyz] ⼀个字符集。匹配在⽅括号之间的任何字符。
[^xyz] ⼀个否定的字符集。不匹配在⽅括号之间的任何字符。
\d 匹配⼀个数字字符。等价于[0-9]。
\D 匹配⼀个⾮数字字符。等价于[^0-9]。
\f 匹配⼀个换页字符。
\n 匹配⼀个换⾏字符。
\r 匹配⼀个回车符字符。
\s 匹配任何空⽩的空格, 标签, 换页, 包括空格等等,但不匹配换⾏符。
\S 匹配任何⾮空⽩的字符,但不匹配换⾏符。
\t 匹配⼀个标签TAB字符。
\v 匹配⼀个垂直的标签字符。
\w 匹配任何词语字符包括下划线。
\W 匹配任何⾮词语字符字符。
注: ^ 是实际字符 ^不是Ctl + 键值。
例如:
m.n 匹配 “man”,”men”,”min” 但不匹配 “moon”.
t+t 匹配 “test”,”tonight” 和 “tea time” (the “tea t” portion) 但不匹配 “tea
time” (newline between “tea ” and “time”).
Te*st 匹配 “test”,”teest”,” teeeest “等等。但是不匹配 “tst”。
[aeiou] 匹配每个⼩写元⾳。
[,.?] 匹配⼀⽂字的 “,”,”.”或 “?”。
[0-9,a-z] 匹配任何数位,或⼩写字母。
[^0-9] 除了数字以外匹配任何字符 (~ 意味着”不”)
你按如下⽅式可以查⼀个表达式A或 B :
“(John)|(Tom)”
这将在John或Tom的出现。应该在 2 个表达式之间没有任何东西。
你可以在同⼀搜索中按如下⽅式组合A or B and C or D:
“(John|Tom) (Smith|Jones)”
这将在John or Tom 后⾯ Smith or Jones。
另外:
p 匹配 CR/LF ( 作为 rn 的⼀样 ) 作为DOS⾏结束符匹配
如果查/替换功能中正则表达式没有选⽤,则替换字段中下列字符也是有效的:
符号功能
^^ 匹配⼀个 “^” 字符
^s 替换为被选择 ( 加亮 ) 活跃的⽂件窗⼝的⽂章。
^c 替换为剪贴板的内容
^b 匹配⼀个页裂缝
^p 匹配⼀个换⾏符 ( CR/LF )( 段 )( DOS ⽂件)
^r 匹配⼀个换⾏符 ( CR 仅仅 )( 段 )( MAC ⽂件)
^n 匹配⼀个换⾏符 ( LF 仅仅 )( 段 )( UNIX ⽂件)
^t 匹配⼀个标签TAB字符
下⾯是我要实现的⼀段代码查询替换的举例
我想把⼀个.lrc⽂件中的汉字去掉:
[ti:046]
[ar:Book I]
[al:english900]
[la:zh]
[by:]
[00:00.00][4] Identifying objects.辨别物品
[00:00.00]
[00:00.01]What are these? 这些是什么?
[00:01.93]Those are books. 那些是书。
[00:03.87]Where are the books? 那些书在哪⼉?
[00:06.13]There they are. 在那⼉。
[00:08.68]These are my pencils. 这些是我的铅笔。
[00:12.00]Where are your pens? 你的那些钢笔在哪⼉?
[00:14.85]They're over there. 在那⾥。
[00:17.48]Are these your pens? 这些是你的钢笔吗?
[00:20.04]Yes,they are. 是我的。
[00:22.63]Those are mine. 那些是我的。
[00:25.39]These are your books,aren't they? 这些书是你的,对不对?
[00:28.35]No,they aren't. 不,不是。
[00:31.07]They're not mine. 不是我的。
[00:33.39]These are mine,and those are yours. 这些是我的,⽽那些是你的。
[00:35.57]Those aren't your pens,are they? 那些钢笔不是你的,对吧?
[00:36.38]
点"搜索"->"替换",选中"正则表达式"
查:^([/./?]^) ?++$
替换为:^1
点“全部替换”,完成。
⼤家可以在今后的编码中尝试⼀下Ultraedit的正则表达式查替换功能,⾮常简单快捷
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论