🇯🇵
日本語特化OCR — 漫画、縦書き、ふりがな、古文書まで
manga-ocr、Sarashina2.2-OCR、PaddleOCR、KuroNet — 日本語OCRのすべての選択肢
日本語OCRが難しい理由
英語と違い:縦書き(縦書き)、ふりがな、ひらがな+カタカナ+漢字の3種混在、漫画フォント、古文書(くずし字)。
ツール比較
| ツール | 用途 | 縦書き | サイズ |
|---|---|---|---|
| manga-ocr | 漫画 | 対応 | 400MB |
| Sarashina2.2-OCR | 文書(最高精度) | 対応 | 3B |
| PaddleOCR | 汎用CJK | 対応 | 10-150MB |
| KuroNet | 古文書(くずし字) | 対応 | WebAPI |
manga-ocr — 漫画最強
from manga_ocr import MangaOcr
mocr = MangaOcr()
text = mocr("speech_bubble.png") # → "お前はもう死んでいる"
縦書き/横書き対応、ふりがな処理、多様な漫画フォント対応。
Sarashina2.2-OCR — 日本語文書最高精度
VJRODaベンチマーク(縦書き日本語)最高スコア。表→HTML、数式→LaTeX自動変換。
KuroNet — 古文書OCR
明治以前のくずし字を現代文字に変換する唯一のプロダクションツール。「miwo」モバイルアプリでも使用可能。
キーコンセプト
1
manga-ocr(★☆☆☆☆)— pip install+2行。漫画テキスト最強
2
Sarashina2.2-OCR(★★★☆☆)— 3Bモデル。日本語文書最高精度。GPU必要
3
PaddleOCR(★★☆☆☆)— use_textline_orientation=Trueで縦書き自動検出
4
KuroNet(★★☆☆☆)— くずし字(古文書)→現代日本語。唯一のツール
ユースケース
漫画翻訳 — manga-ocrでテキスト抽出→翻訳→吹き出しに再配置
日本語ビジネス文書デジタル化 — Sarashina2.2でスキャン文書をMarkdownに
歴史研究 — KuroNetで江戸/明治時代の文書解読