Khadafi995

PCap

Sep 25th, 2015
169
0
Never
Not a member of Pastebin yet? Sign Up, it unlocks many cool features!
Python 3.10 KB | None | 0 0
  1. #!/usr/bin/env python3
  2. # -*- coding: utf-8 -*-
  3. # vim:ts=4:sw=4:softtabstop=4:smarttab:expandtab
  4.  
  5. # target script
  6.  
  7. import sys
  8. import re
  9.  
  10. def roman_siecle(bk):
  11.     data =""
  12.     for (id, href) in bk.text_iter():
  13.        
  14.         data = bk.readfile(id)
  15.        
  16.         reg = re.compile(r'(?P<b1>(<span class="(([a-zA-Z0-9_-]+) |)CharOverride-10)(| ([a-zA-Z0-9_-]+))">)(?P<roman>([xiv]+))(?P<b2>(</span>))')
  17.        
  18.         search = reg.search(data)
  19.         print(search)
  20.         if search != None:
  21.             balise1  = search.group('b1')
  22.             balise2 = search.group('b2')
  23.             roman = search.group('roman')
  24.                
  25.             sub_str = balise1+"<span style=\"font-size:83%\">"+roman.upper()+"</span>"+balise2
  26.            
  27.             test2 = data.replace(balise1+roman+balise2, sub_str)
  28.             data.replace(balise1+roman+balise2, sub_str)
  29.             data2=re.sub(reg, sub_str, data)
  30.            
  31.             #effacer le fichier ancien
  32.             bk.deletefile(id)
  33.             basename = id+".xhtml"
  34.             mt = "application/xhtml+xml"
  35.             uid1 = id
  36.            
  37.             #ajouter un nouveau fichier
  38.             bk.addfile(uid1, basename, data2, mt)
  39.            
  40. def PCapH2(bk):
  41.     data =""
  42.     for (id, href) in bk.text_iter():
  43.         data = bk.readfile(id)
  44.         reg = re.compile(r'<h2 class="T3" xml:lang="fr-CH"><span class="CharOverride-2">(?P<content>(.+))</span></h2>')
  45.         search = reg.search(data)
  46.         print(search)
  47.         if search != None:
  48.             Content = search.group('content')
  49.             minReg = re.compile(r'(?P<minuscule>[a-zàâäéèêëûüôöîïÿ]+)')
  50.             minSearch = minReg.search(Content)
  51.             Content2=""
  52.             while minSearch:
  53.                 if minSearch != None:
  54.                     minuscul = minSearch.group('minuscule')
  55.                     a_remp = "<span style=\"font-size:83%\">"+minuscul.upper()+"</span>"
  56.                 Content = re.sub(minReg, a_remp, Content)
  57.                     #print(Content)
  58.                
  59.                 bk.deletefile(id)
  60.                 basename = id+".xhtml"
  61.                 mt = "application/xhtml+xml"
  62.                 uid1 = id
  63.  
  64.                 #ajouter un nouveau fichier
  65.                 bk.addfile(uid1, basename, Content2, mt)
  66.                
  67.                 sub_str = "<h2 class=\"T3\" xml:lang=\"fr-CH\"><span class=\"CharOverride-2\">"+Content+"</span></h2>"
  68.                 print(sub_str)                                                                
  69.             #test2 = data.replace(Content, sub_str)
  70.             #data.replace(balise1+roman+balise2, sub_str)
  71.                 data2 = re.sub(reg, sub_str, data)
  72.                  
  73.             #effacer le fichier ancien
  74.                 bk.deletefile(id)
  75.                 basename = id+".xhtml"
  76.                 mt = "application/xhtml+xml"
  77.                 uid1 = id
  78.  
  79.             #ajouter un nouveau fichier
  80.                 bk.addfile(uid1, basename, data2, mt)
  81.  
  82. def run(bk):
  83.     #roman_siecle(bk)
  84.     PCapH2(bk)
  85.    
  86.  
  87. def main():
  88.     print("I reached main when I should not have\n")
  89.     return -1
  90.    
  91. if __name__ == "__main__":
  92.     sys.exit(main())
Advertisement
Add Comment
Please, Sign In to add comment