Public portfolio repository for showcasing private-source applications to recruiters.
This repository provides public-facing project descriptions, demo videos, screenshots, tech stack summaries, and contact information for BUDA applications.
The application source code is maintained in private repositories due to proprietary and copyright considerations.
TradutorBUDA is a Java-based Tibetan translation and text-processing application focused on Buddhist terminology workflows. It combines dictionary lookup, tokenization, transliteration, ranking/model services, and optional OCR-related utilities.
Tech stack
- Java 17
- Maven
- SQLite
- Optional integrations: ONNX Runtime, tokenizers, R/Rserve, OCR utilities
Highlights
- Core Java app for Tibetan term lookup and processing
- Word-breaking and Tibetan text utilities
- Data/model workflows for ranking and multilingual experimentation
- OCR support assets under
namsel_OCR/
Demo
This is a simplified version of GlossarioBUDA that contains only the core glossary management functionality without the experimental Namsel OCR integration.
Features
- Glossary management: add, edit, delete, and search Buddhist terms
- Multi-language support: Tibetan, Sanskrit, Pali, English, and Portuguese
- Tibetan input using SWT
- XML import for glossary terms
- Export to WhatsApp-friendly format
- Compact always-on-top quick reference window
- SQLite database for persistent storage
Demo