တိပိဋက ပါဠိ-မြန်မာ အဘိဓာန်Tipiṭaka Pāḷi-Myanmā Abhidhāna

About

The dictionary

The Tipiṭaka Pāḷi-Myanmā Abhidhāna (တိပိဋက ပါဠိ-မြန်မာ အဘိဓာန်) is a Pāḷi–Burmese dictionary in 25 volumes, bound as 29 books, with about 215,000 headwords. Each article gives the headword, its grammatical category, an analysis of the word into its parts, a Burmese definition, and quotations from the canon and its commentaries with their references.

It was compiled over some seventy years, from the 1950s until its completion on 20 November 2023, by five teams of scholar-monks, among which the alphabet was divided; the Masoeyein (မစိုးရိမ်) monastery in Mandalay wrote volumes 5–6 and 15–16 (vol. 17, pp. 6–7). The first volume was published in 1964 by the Union of Burma Buddha Sāsana Council, the later ones by the Department for the Promotion and Propagation of the Sāsana, Ministry of Religious Affairs, Union of Myanmar. We claim nothing in its text.

What this site is

A reading of the printed pages by machine (OCR), cut into articles and set beside the page image. For every page, the dictionary's index already tells us which headwords are printed there, spelled correctly, so each article is anchored on the right headword. Everything after the headword was read by machine, and nothing is proofread.

Every article carries a status:

ocrMachine-read Burmese, untouched. The headword comes from the index; everything around it can contain OCR errors.
draftedA machine-assisted rendering that no one has checked. Not a reading.
reviewedChecked by a reader of Burmese and Pāḷi.
correctedChanged after review.

The grammatical labels printed after each headword are explained on the Labels page.

At present every article is ocr. The Pāḷi is also shown in roman letters (IAST), and each romanised headword is marked by whether it occurs in the Sixth Council Tipiṭaka (OSBCT). Always compare against the page image before quoting an article. Methods and measurements for each volume are in the repository, under ocr/.

Volumes marked “coming” are not yet digitised; they will be added as they are done.

Credits

The page scans and the headword index come from the Tipiṭaka Abidan app, developed by Pn Daza, whose Burmese OCR model (myap) was also used to read the pages. According to the app's own note:

The monks' names are given as the app prints them. Romanised forms will be added once a reader of Burmese has checked them.

The digitisation is a project of the Instituto de Estudios Budistas Hispano (IEBH).

Licences

Reporting an error

Each article has a link, Report an error. It opens a new issue in the project's GitHub repository, already filled in with the volume, the page and the headword; add what is wrong and, if you can, what the printed page says. You need a free GitHub account. OCR errors in the definitions are expected everywhere; the reports that help most are a headword placed on the wrong article, a wrong label, or a page image that does not match its articles.

Acerca de

El diccionario

El Tipiṭaka Pāḷi-Myanmā Abhidhāna (တိပိဋက ပါဠိ-မြန်မာ အဘိဓာန်) es un diccionario pāḷi–birmano en 25 volúmenes, encuadernados en 29 libros, con unas 215 000 entradas. Cada artículo da la entrada, su categoría gramatical, un análisis de la palabra en sus partes, una definición en birmano y citas del canon y de sus comentarios con sus referencias.

Lo compilaron a lo largo de unos setenta años, desde los años cincuenta hasta su conclusión el 20 de noviembre de 2023, cinco equipos de monjes eruditos, que se repartieron el alfabeto; el monasterio de Masoeyein (မစိုးရိမ်), en Mandalay, redactó los volúmenes 5–6 y 15–16 (vol. 17, pp. 6–7). El primer volumen lo publicó en 1964 el Consejo del Buddha Sāsana de la Unión de Birmania, y los siguientes el Departamento para la Promoción y Propagación del Sāsana, Ministerio de Asuntos Religiosos de la Unión de Myanmar. No reclamamos nada de su texto.

Qué es este sitio

Una lectura de las páginas impresas hecha por máquina (OCR), dividida en artículos y puesta junto a la imagen de la página. Para cada página, el índice del diccionario ya indica qué entradas están impresas en ella, bien escritas, de modo que cada artículo queda anclado en la entrada correcta. Todo lo que sigue a la entrada fue leído por máquina y nada está revisado.

Cada artículo lleva un estado:

ocrBirmano leído por máquina, sin tocar. La entrada procede del índice; todo lo que la rodea puede contener errores de OCR.
borradorUna versión asistida por máquina que nadie ha revisado. No es una lectura.
revisadoComprobado por un lector de birmano y de pāḷi.
corregidoModificado después de la revisión.

Las categorías gramaticales impresas después de cada entrada se explican en la página Categorías.

Por ahora todos los artículos están en estado ocr. El pāḷi se muestra también en caracteres latinos (IAST), y cada entrada romanizada indica si aparece en el Tipiṭaka del Sexto Concilio (OSBCT). Compare siempre con la imagen de la página antes de citar un artículo. Los métodos y las mediciones de cada volumen están en el repositorio, en ocr/.

Los volúmenes marcados como “próximamente” aún no están digitalizados; se añadirán a medida que se terminen.

Créditos

Los escaneos de las páginas y el índice de entradas proceden de la aplicación Tipiṭaka Abidan, desarrollada por Pn Daza, cuyo modelo de OCR birmano (myap) se usó también para leer las páginas. Según la nota de la propia aplicación:

Los nombres de los monjes se dan como los imprime la aplicación. Se añadirán sus formas romanizadas cuando un lector de birmano las haya comprobado.

La digitalización es un proyecto del Instituto de Estudios Budistas Hispano (IEBH).

Licencias

Cómo informar de un error

Cada artículo tiene un enlace, Informar de un error. Abre una nueva incidencia en el repositorio de GitHub del proyecto, ya rellenada con el volumen, la página y la entrada; añada qué está mal y, si puede, qué dice la página impresa. Hace falta una cuenta gratuita de GitHub. Los errores de OCR en las definiciones son esperables en todas partes; los informes que más ayudan son una entrada puesta en el artículo equivocado, una categoría errónea o una imagen de página que no corresponde a sus artículos.