如何从选定的文件行编译字符串,对该字符串运行一些操作,然后将该字符串拆分回原始行到该文件中?
我只需要文件的某些行。我不能对文件的其他部分执行操作。我已经创建了一个类,它将这些行从文件中分离出来,并在这些行上运行操作,但我认为在包含文件中可用于这些操作的部分的单个字符串上运行这些操作会更快.
或者,如果我可以在整个字典上运行这些操作,这也会有帮助。操作是字符串替换和RegEx替换。
我正在使用python 3.3
编辑:我将在这里更详细地解释这一点,因为我最初的文章太模糊了(谢谢保罗指出这一点)。
例如,如果我想修复一个SubRipper (.srt- file ),这是一个常见的字幕文件,我会将类似的内容作为输入(这来自实际的srt-文件):
在这里,您可以找到正确的示例,在这里提交文件内容会扰乱换行符:http://pastebin.com/ZdWUpNZ2
然后,我将只修复那些有实际字幕行的行,而不是那些排序编号行或隐藏/显示字幕文件行的行。所以我编译的字符串可能是:
“他们在那个山脊上,他们把我们钉死了。”
然后我就会在这个字符串上运行操作。然后,我必须将这些行保存回文件。如何在这些副标题行被修复后返回到我的原始文件中?我可以使用行分隔符来拆分已编译的和固定的字符串,并将它们放回原始文件中,但是我如何确定哪一行会去哪里呢?
发布于 2012-10-28 16:47:32
您可以使用pysrt编辑SubRip文件:
from pysrt import SubRipFile
subs = SubRipFile.open('some/file.srt')
for sub in subs:
# do something with sub.text
pass
# save changes to a new file
subs.save('other/path.srt', encoding='utf-8')https://stackoverflow.com/questions/13109968
复制相似问题