Metadata-Version: 2.4
Name: iantirta-text
Version: 0.1.0
Summary: Text processing and sequence utilities for Python
Author-email: "Iantirta.com" <ian@iantirta.com>
Maintainer-email: "Iantirta.com" <ian@iantirta.com>
License-Expression: Apache-2.0
Project-URL: Homepage, https://iantirta.com
Project-URL: Documentation, https://readthedocs.org
Project-URL: Repository, https://github.com/iantirta-com/iantirta-text.git
Project-URL: Bug Tracker, https://github.com/iantirta-com/iantirta-text/spam/issues
Project-URL: Changelog, https://github.com/iantirta-com/iantirta-text/spam/blob/master/CHANGELOG.md
Keywords: text,text-processing,romanization,transliteration,sequence,unicode
Classifier: Development Status :: 3 - Alpha
Classifier: Programming Language :: Python :: 3
Classifier: Programming Language :: Python :: 3 :: Only
Classifier: Programming Language :: Python :: 3.10
Classifier: Programming Language :: Python :: 3.11
Classifier: Programming Language :: Python :: 3.12
Classifier: Programming Language :: Python :: 3.13
Classifier: Programming Language :: Python :: 3.14
Classifier: Intended Audience :: Developers
Classifier: Intended Audience :: Science/Research
Classifier: Topic :: Software Development :: Libraries :: Python Modules
Classifier: Topic :: Text Processing
Classifier: Topic :: Utilities
Requires-Python: >=3.10
Description-Content-Type: text/markdown
License-File: LICENSE
Provides-Extra: zh
Requires-Dist: pypinyin; extra == "zh"
Provides-Extra: ja
Requires-Dist: pykakasi; extra == "ja"
Provides-Extra: ascii
Requires-Dist: anyascii; extra == "ascii"
Provides-Extra: romanize
Requires-Dist: iantirta-text[ja,zh]; extra == "romanize"
Provides-Extra: all
Requires-Dist: iantirta-text[romanize]; extra == "all"
Provides-Extra: docs
Requires-Dist: mkdocs-material; extra == "docs"
Provides-Extra: test
Requires-Dist: pytest; extra == "test"
Provides-Extra: dev
Requires-Dist: iantirta-text[all,test]; extra == "dev"
Dynamic: license-file

# iantirta-text

[![PyPI](https://img.shields.io/pypi/v/iantirta-text.svg)](https://pypi.org/project/iantirta-text/)
[![Python](https://img.shields.io/pypi/pyversions/iantirta-text.svg)](https://pypi.org/project/iantirta-text/)
[![Tests](https://github.com/iantirta-com/iantirta-text/actions/workflows/test.yml/badge.svg)](https://github.com/iantirta-com/iantirta-text/actions/workflows/test.yml)
[![License](https://img.shields.io/github/license/iantirta-com/iantirta-text.svg)](https://github.com/iantirta-com/iantirta-text/blob/main/LICENSE)

[![Documentation](https://img.shields.io/badge/docs-online-blue.svg)](https://iantirta-com.github.io/iantirta-text/)
[![GitHub](https://img.shields.io/badge/GitHub-iantirta--com-181717?logo=github)](https://github.com/iantirta-com/iantirta-text)

Text processing and sequence utilities for Python.

`iantirta-text` provides small, composable utilities for working with
Unicode text, normalization, romanization, and filtering.


## Installation

```bash
pip install iantirta-text
```

Optional language support:

```bash
pip install "iantirta-text[zh]"
pip install "iantirta-text[ja]"
pip install "iantirta-text[romanize]"
```

## Quick Start

```python
from iantirta.text import normalize, romanize, filter_text

text = normalize("  Hello, 世界!  ")

print(text)
```

Romanization:

```python
from iantirta.text import romanize

print(romanize("你好"))
# ni hao

print(romanize("日本語です"))
# nihongo desu

print(romanize("hello 你好 日本語です"))
# hello ni hao nihongo desu
```

Filtering:

```python
from iantirta.text import filter_text

print(filter_text(
    "hello world",
    ["world"],
))

# hello
```

## Documentation

See the [full documentation](https://iantirta-com.github.io/iantirta-text/).

## Project

- [Repository](https://github.com/iantirta-com/iantirta-text)
- [PyPI](https://pypi.org/project/iantirta-text/)
- [Documentation](https://iantirta-com.github.io/iantirta-text/)
- License: Apache-2.0

