ByteScope

Image to Text

中文辨識留在這台機器上——收據、手機翻拍,不用帳號。

檔案不會離開你的瀏覽器 — 全部在本機處理。

圖片

把照片拖到這裡

或點一下選檔,截圖貼上也可以。

文字

第一次會下載 PaddleOCR PP-OCRv5(約 15–20 MB,Apache-2.0)。之後就留在這個瀏覽器裡。

印刷中文跟收據才是這頁要打的仗。手寫、藝術字常常會錯——那是模型的極限,不是你少調了什麼。

加速: 正在看這個瀏覽器做得到什麼…

什麼會離開這個分頁

圖片不會。辨識都在這個分頁裡。沒有上傳的位置。

你按下按鈕時才會從 PaddleOCR 那邊抓模型,照片不會跟著出去。

關於這個工具

英文 OCR 是紅海。手機翻拍中文才是缺口

PaddleOCR.js 在這個分頁裡用 ONNX Runtime 跑 PP-OCRv5。偵測跟辨識是官方 Apache-2.0 管線,第一次大約 15–20 MB,之後進快取。繁體中文跟熱感收據是這頁存在的理由:Tesseract 的中文準確率就是讓人關掉分頁的東西,我們不裝沒看到。

拖進來、貼上,或先試範例

跟塗黑截圖同一條貼上路徑——剪貼簿裡的截圖就夠了。範例按鈕會當場畫一張假收據,讓你先看一輪再拿真的出來。輸出是可以複製、下載的純文字,外加帶分數的行列表,弱的框不會被平均分數藏起來。

手寫跟藝術字會錯

那是模型的極限,不是少勾一個選項。印刷的價目、發票、整頁繁體的手機翻拍在分布裡。簽名、霓虹燈、書法卷軸不在。這句寫在按鈕旁邊,不是塞在 FAQ 最底下。

以後接 PDF

1201 的 PDF 線,掃描頁還缺一顆 OCR 後備。/pdf-to-text 上線時會呼叫這顆引擎,而不是再養一顆。讀完字以後要塗掉,隔壁是塗黑截圖。

常見問題

圖片會被上傳嗎?

不會。辨識在這個分頁裡跑。模型檔是你按下按鈕才抓,照片不會出現在那個請求裡。

它實際上能讀哪些語言?

PP-OCRv5 的 ch 預設是給中文用的,收據上夾雜的英文也讀得動。這不是五十種語言包。整頁只有日文或只有拉丁字母,結果會比專用模型差。

為什麼不用 Tesseract?

瀏覽器裡的 Tesseract 讀英文沒問題。手機翻拍的繁體中文,才是值得載 20 MB 模型的理由,那個理由就叫 PP-OCRv5。差異化就這樣講。

手寫讀得出來嗎?

幾乎讀不好。手寫結果很爛,請當成預期,不是該回報的 bug。印刷字才是支援範圍。

之後會變成 PDF 的 OCR 後備嗎?

這就是計畫。/pdf-to-text 在 1201 那條線;掃描頁需要 OCR 時,應該呼叫這顆,而不是再長一顆。