圖片
把照片拖到這裡
或點一下選檔,截圖貼上也可以。
文字
第一次會下載 PaddleOCR PP-OCRv5(約 15–20 MB,Apache-2.0)。之後就留在這個瀏覽器裡。
印刷中文跟收據才是這頁要打的仗。手寫、藝術字常常會錯——那是模型的極限,不是你少調了什麼。
加速: 正在看這個瀏覽器做得到什麼…
什麼會離開這個分頁
圖片不會。辨識都在這個分頁裡。沒有上傳的位置。
你按下按鈕時才會從 PaddleOCR 那邊抓模型,照片不會跟著出去。
中文辨識留在這台機器上——收據、手機翻拍,不用帳號。
檔案不會離開你的瀏覽器 — 全部在本機處理。
把照片拖到這裡
或點一下選檔,截圖貼上也可以。
第一次會下載 PaddleOCR PP-OCRv5(約 15–20 MB,Apache-2.0)。之後就留在這個瀏覽器裡。
印刷中文跟收據才是這頁要打的仗。手寫、藝術字常常會錯——那是模型的極限,不是你少調了什麼。
加速: 正在看這個瀏覽器做得到什麼…
圖片不會。辨識都在這個分頁裡。沒有上傳的位置。
你按下按鈕時才會從 PaddleOCR 那邊抓模型,照片不會跟著出去。
PaddleOCR.js 在這個分頁裡用 ONNX Runtime 跑 PP-OCRv5。偵測跟辨識是官方 Apache-2.0 管線,第一次大約 15–20 MB,之後進快取。繁體中文跟熱感收據是這頁存在的理由:Tesseract 的中文準確率就是讓人關掉分頁的東西,我們不裝沒看到。
跟塗黑截圖同一條貼上路徑——剪貼簿裡的截圖就夠了。範例按鈕會當場畫一張假收據,讓你先看一輪再拿真的出來。輸出是可以複製、下載的純文字,外加帶分數的行列表,弱的框不會被平均分數藏起來。
那是模型的極限,不是少勾一個選項。印刷的價目、發票、整頁繁體的手機翻拍在分布裡。簽名、霓虹燈、書法卷軸不在。這句寫在按鈕旁邊,不是塞在 FAQ 最底下。
1201 的 PDF 線,掃描頁還缺一顆 OCR 後備。/pdf-to-text 上線時會呼叫這顆引擎,而不是再養一顆。讀完字以後要塗掉,隔壁是塗黑截圖。
不會。辨識在這個分頁裡跑。模型檔是你按下按鈕才抓,照片不會出現在那個請求裡。
PP-OCRv5 的 ch 預設是給中文用的,收據上夾雜的英文也讀得動。這不是五十種語言包。整頁只有日文或只有拉丁字母,結果會比專用模型差。
瀏覽器裡的 Tesseract 讀英文沒問題。手機翻拍的繁體中文,才是值得載 20 MB 模型的理由,那個理由就叫 PP-OCRv5。差異化就這樣講。
幾乎讀不好。手寫結果很爛,請當成預期,不是該回報的 bug。印刷字才是支援範圍。
這就是計畫。/pdf-to-text 在 1201 那條線;掃描頁需要 OCR 時,應該呼叫這顆,而不是再長一顆。
分享前先把截圖上的字塗掉。
照片太雜的話,先把主體切出來。
褪色的照片可以先修清楚再讀。