力扣591. 标签验证器
目录
力扣591. 标签验证器
给定一个表示代码片段的字符串,你需要实现一个验证器来解析这段代码,并返回它是否合法。合法的代码片段需要遵守以下的所有规则:
-
代码必须被合法的闭合标签包围。否则,代码是无效的。
-
闭合标签(不一定合法)要严格符合格式:
TAG_CONTENT。其中,是起始标签,是结束标签。起始和结束标签中的 TAG_NAME 应当相同。当且仅当 TAG_NAME 和 TAG_CONTENT 都是合法的,闭合标签才是合法的。 -
合法的
TAG_NAME仅含有大写字母,长度在范围 [1,9] 之间。否则,该TAG_NAME是不合法的。 -
合法的
TAG_CONTENT可以包含其他合法的闭合标签,cdata (请参考规则7)和任意字符(注意参考规则1)除了不匹配的与之匹配,是不合法的。并且当你找到一个的前的字符,都应当被解析为 TAG_NAME(不一定合法)。 -
cdata 有如下格式:
。`CDATA_CONTENT` 的范围被定义成之间的字符。 -
CDATA_CONTENT可以包含任意字符。cdata 的功能是阻止验证器解析CDATA_CONTENT,所以即使其中有一些字符可以被解析为标签(无论合法还是不合法),也应该将它们视为常规字符。
示例 1:
输入:code = "<DIV>This is the first line <![CDATA[<div>]]></DIV>"
输出:true
解释:
代码被闭合的标签包围:<DIV> 和 </DIV>。
TAG_NAME 是合法的,TAG_CONTENT 只包含一些字母和 cdata。
尽管 CDATA_CONTENT 有一个非法 TAG_NAME 的未匹配开始标签,它可以被认为是普通文本,不被解析为一个标签。
所以 TAG_CONTENT 是合法的,并且代码是合法的。因此返回 true。示例 2:
输入:code = "<DIV>>> ![cdata[]] <![CDATA[<div>]>]]>]]>>]</DIV>"
输出:true
解释:
我们首先将代码分割为:start_tag|tag_content|end_tag。
start_tag -> "<DIV>"
end_tag -> "</DIV>"
tag_content 也可以被分割为:text1|cdata|text2。
text1 -> ">> ![cdata[]] "
cdata -> "<![CDATA[<div>]>]]>",其中 CDATA_CONTENT 是 "<div>]>"
text2 -> "]]>>]"
start_tag 不是 "<DIV>>>" 的原因是规则 6。
cdata 不是 "<![CDATA[<div>]>]]>]]>" 的原因是规则 7。示例 3:
输入:code = "<A> <B> </A> </B>"
输出:false
解释:不平衡。如果 "<A>" 是闭合的,那么 "<B>" 一定没有匹配,反之亦然。提示:
1 ','/','!','[',']','.'和' '。