# 📝 Thêm dòng trống giữa các đoạn trong file Myanmar OCR

## Nguyên tắc chung (RÚT GỌN)

**1. Gặp dấu `။` ở cuối dòng** → chèn 1 dòng trống phía sau.

**2. Gặp section heading dạng `(ဋ)`, `(ဌ)`, `(ဍ)`, `(ဎ)`** → chèn 1 dòng trống phía sau.

**3. Trước một danh sách liệt kê (dạng `က။`\* / `(၁)`)** → chèn 1 dòng trống trước list đó.

**4. Dòng kết thúc bằng `။]` (gấp đôi: `။` + đóng ngoặc `[...]`) — nếu sau đó là đoạn/kết cấu khác (câu hỏi mới, heading…) → chèn 1 dòng trống.**

Không cần phán đoán "cùng chủ đề" hay "khác chủ đề". Cứ đúng 4 trường hợp trên là chèn.

## Các trường hợp KHÔNG chèn dòng trống

| Trường hợp | Ví dụ |
|---|---|
| Trước `---` (phân cách trang) | `သည်။\n---` |
| Trước heading `##` / `###` | `ပါ။\n## Trang 2` |
| Trong danh sách liệt kê (số `၁-၁၀` / chữ `က-ဆ`) | `ပြပါ။\n(၂) လူမရှိလျှင်...` hoặc `ပြပါ။\nခ။ ဘယ်လို...` |

## Giải thích

- `။` = dấu chấm câu Myanmar, tương đương dấu chấm (.) trong tiếng Việt
- Đa số các dòng kết thúc bằng `။` là kết thúc một đoạn văn → cần cách dòng với đoạn sau
- Section heading `(ဋ)`, `(ဌ)`, `(ဍ)`, `(ဎ)` là các đề mục trong thân bài → cần cách dòng với nội dung bên dưới
- Trước danh sách liệt kê: chèn dòng trống để tách heading/đoạn dẫn với list
- Không chèn khi gặp các mục trong danh sách liệt kê, trước `---`, hoặc trước `##`/`###`

## Cách dò nhanh

```bash
grep -n '။' "file.md"
grep -n '(ဋ)' "file.md"   # các section heading khác
grep -n '(ဌ)' "file.md"   # check thêm ဍ, ဎ,...
```

Mỗi dòng có `။` → kiểm tra dòng kế tiếp:
- Nếu là `---` hoặc `##` hoặc `###` → bỏ qua
- Nếu đang trong list (၁-၁၀, က-ဆ) → bỏ qua
- Còn lại → chèn dòng trống

Mỗi dòng section heading `(ဋ)...(ဎ)` → chèn dòng trống phía sau.

## Lưu ý

- Chỉ thêm dòng trống, **không sửa nội dung Myanmar**
- Khi có checklist hiệu đính ở cuối file, không cần format phần đó
