import re

def refine_vietnamese(content):
    if '→' in content:
        parts = content.split('→')
        content = parts[-1].strip()
    return content

def process_full_file():
    with open('Tam Bao.txt', 'r', encoding='utf-8') as f:
        full_content = f.read()
    
    pages = re.split(r'(TRANG \d+)', full_content)
    final_output = []
    
    for i in range(1, len(pages), 2):
        page_marker = pages[i]
        page_text = pages[i+1].strip()
        lines = page_text.split('\n')
        processed_lines = [page_marker]
        
        for line in lines:
            line = line.strip()
            if not line: continue
            if line.startswith('→'):
                processed_lines.append(f"→ {refine_vietnamese(line[1:].strip())}")
            else:
                processed_lines.append(line)
        final_output.append('\n'.join(processed_lines))
    
    with open('Tam Bao - Zen.txt', 'w', encoding='utf-8') as f:
        f.write('\n\n'.join(final_output))

if __name__ == "__main__":
    process_full_file()
