re.split(r"</torrent>", content) может работать неидеально, если в дампе есть вложенные теги или переносы строк внутри блока-в больших XML бывают сюрпризы. Для надёжности лучше использовать XML‑парсер (например, xml.etree.ElementTree или lxml) вместо регулярных выражений.
В строке hash="([A-Fa-f0-9]{40})" шаблон верный для BTIH‑хеша, но если в XML хеш хранится без кавычек или в другом атрибуте, поиск не сработает.
Для больших файлов (сотни мегабайт и больше) чтение всего файла в память через f.read() может быть не самым эффективным-лучше потоковая обработка.
__________________
О нас думают плохо лишь те, кто хуже нас. А те, кто лучше нас, им просто не до нас.
--Омар Хайям
Обновления по запросу — на Я.Ди. «Мэйл-облако» для тех, кто помогает нашему интернет-проекту, и для тех, кто хотел бы это делать, но пока не знает, как.
Помогая форуму ВТО, вы прежде всего помогаете себе! А не делаете что-то абстрактное для «других», совершенно незнакомых и безразличных вам людей.
|