ByteScope

Image to Text

この端末に留まる中国語OCR。レシート、スマホ写真、会員登録なし。

ファイルはブラウザから送信されません — 処理はすべてローカルで行われます。

画像

写真をドロップ

クリックして選ぶか、スクリーンショットを貼り付けても大丈夫。

テキスト

最初の1回で PaddleOCR PP-OCRv5(約 15–20 MB、Apache-2.0)をダウンロードします。以降はこのブラウザに残ります。

印刷された中国語とレシートが本命です。手書きや装飾文字はよく外れます。設定不足ではなく、モデルの限界です。

加速: このブラウザの能力を確認しています…

このタブから出るもの

画像は出ません。認識はこのタブの中だけです。アップロード先はありません。

ボタンを押したときだけ PaddleOCR 側からモデルを取ります。写真はその通信に乗りません。

このツールについて

英語OCRは紅海。スマホで撮った中国語が隙間

PaddleOCR.js が PP-OCRv5 を ONNX Runtime でこのタブで動かします。検出と認識は公式の Apache-2.0 パイプラインで、初回約 15–20 MB、あとはキャッシュ。繁体字と感熱レシートがこのページの理由です。Tesseract の中国語精度で人が離れる、という事実を隠しません。

ドロップ、貼り付け、またはサンプル

Redact Screenshot と同じ貼り付け経路——クリップボードのスクリーンショットで足ります。サンプルボタンは偽のレシートを描くので、本物を信じる前に往復を見られます。出力はコピーもダウンロードもできるプレーンテキストと、弱い枠が平均に隠れないようスコア付きの行リストです。

手書きと装飾文字は間違います

モデルの限界であって、足りないチェックボックスではありません。印刷されたメニュー、請求書、繁體のページをスマホで撮ったものは分布の中。署名、ネオン、書道の巻物は外です。ボタンの横に書いてあり、FAQの奥には埋めていません。

あとで PDF

1201 の PDF 線は、スキャンページ用の OCR フォールバックがまだ要ります。/pdf-to-text が乗ったら、二個目を増やさずこのエンジンを呼びます。読んだ文字を隠したくなったら、隣は Redact Screenshot です。

よくある質問

画像はアップロードされますか。

されません。認識はこのタブで走ります。モデルはボタンを押したとき取りに行き、写真はその通信に入りません。

実際に読める言語は何ですか。

PP-OCRv5 の ch プリセットは中国語向けで、レシートに混ざる英語も読めます。50言語パックではありません。日本語だけ、ラテン文字だけのページは、専用モデルより悪くなります。

なぜ Tesseract ではないのですか。

ブラウザの Tesseract は英語なら十分です。スマホで撮った繁体字では、20 MB のモデルを載せる理由が PP-OCRv5 です。差別化は、そのまま書いてあります。

手書きは読めますか。

ほぼ読めません。悪い手書き結果は想定どおりで、バグ報告の対象ではありません。印刷文字が対応範囲です。

PDF の OCR フォールバックになりますか。

その予定です。/pdf-to-text は 1201 の線にあり、スキャンページが OCR を要したら、二個目を増やさずこれを呼ぶべきです。