7

我正在尝试匹配文本sp { ...{...}... },例如允许大括号嵌套的地方。这是我到目前为止所拥有的:

my $regex = qr/
(                   #save $1
    sp\s+           #start Soar production
    (               #save $2
        \{          #opening brace
        [^{}]*      #anything but braces
        \}          #closing brace  
        | (?1)      #or nested braces
    )+              #0 or more
)
/x;

我只是无法让它与以下文本匹配:sp { { word } }. 谁能看到我的正则表达式有什么问题?

4

2 回答 2

6

有很多问题。递归位应该是:

(
   (?: \{ (?-1) \}
   |   [^{}]+
   )*
)

全部一起:

my $regex = qr/
   sp\s+
   \{
      (
         (?: \{ (?-1) \}
         |   [^{}]++
         )*
      )
   \}
/x;

print "$1\n" if 'sp { { word } }' =~ /($regex)/;
于 2012-10-04T03:49:27.847 回答
6

这是 underused 的情况,这是Text::Balanced一个非常方便的核心模块。它确实依赖于pos首先找到/设置的分隔序列的开头,所以我通常像这样调用它:

#!/usr/bin/env perl

use strict;
use warnings;

use Text::Balanced 'extract_bracketed';

sub get_bracketed {
  my $str = shift;

  # seek to beginning of bracket
  return undef unless $str =~ /(sp\s+)(?={)/gc;

  # store the prefix
  my $prefix = $1;

  # get everything from the start brace to the matching end brace
  my ($bracketed) = extract_bracketed( $str, '{}');

  # no closing brace found
  return undef unless $bracketed;

  # return the whole match
  return $prefix . $bracketed;
}

my $str = 'sp { { word } }';

print get_bracketed $str;

带有gc修饰符的正则表达式告诉字符串记住匹配的终点在哪里,并extract_bracketed使用该信息知道从哪里开始。

于 2012-10-04T04:28:04.180 回答