我正在用python编写代码,并且我有一个包含特殊字符的unicode,比如双引号和非英语字符。
我想自动转义特殊字符,但当我使用re.escape时,它也会转义所有非英语字符。我不确定这是不是应该发生。
无论如何,这是有问题的,因为当我的python代码编写包含此unicode的javascript时,javascript会打印一个包含所有这些多余斜杠的HTML元素。
我做错了什么?
这是生成的JS代码:
var myString='\ע\נ\ב\ר'它应该是
var myString='ענבר'更新:我使用了json.dumps(...),但它在前后添加了额外的引号。有人知道怎么去掉它吗?
发布于 2011-04-30 02:59:30
最终使用的是:
json.dumps(myString, ensure_ascii=False)
到目前为止,它运行得很好。添加的参数将其保留为unicode。
(但它会在包含unicode字母字符的部分前后添加额外的引号,所以我使用了myString = myString[1:-1]。这有点丑陋,也许有更好的解决方案...)
发布于 2011-04-30 02:34:47
这完全取决于您要编码的实际特殊字符。re.escape用于避免正则表达式中的特殊字符-它实际上并不关心其他事情。
也许urllib.quote更适合您的需求(那就在JS中使用类似decodeURI()的东西)。或者有可能
发布于 2011-04-30 02:51:18
您可以从str或unicode派生您自己的string类,并覆盖它的__str__()方法,该方法在打印对象时被调用。在您的自定义方法中,您可以对转义字符做任何您想做的事情。一种方法是调用基类方法,然后对其输出进行后处理。
https://stackoverflow.com/questions/5835891
复制相似问题