場次列表
載入中…
邊錄邊出逐字稿、隨時翻譯 — 免費、不用讓 bot 進會議室,音訊永遠留在你的電腦
檔案不會離開你的瀏覽器 — 全部在本機處理。
載入中…
這是一個純瀏覽器的錄音筆記本:一邊錄音、一邊產生帶時間戳記的即時逐字稿,還能同步翻譯成另一種語言對照顯示。不管是開會、上課還是隨手的口頭筆記都適用,你可以只錄麥克風、只錄瀏覽器分頁的聲音,或把兩路混成同一條音軌,語音辨識支援 21 種語言。
市面上的 AI 會議助理,多半得派一隻 bot 進你的視訊會議,或要你把錄音檔上傳到別人的伺服器。這個工具不一樣:從錄音、語音辨識、逐字稿編輯到資料儲存,全部都在你自己的裝置上完成,敏感的討論內容不會經過任何第三方伺服器,逐字稿檢視、全文搜尋和多種匯出格式卻一樣不少。
錄音當下可以隨手幫重點段落加書籤,停下來之後再回頭修正辨識錯誤的字句。音訊可以存成 M4A 或 WebM,字幕則能匯出 SRT、VTT 或 TXT。每一場錄音都保存在瀏覽器的本機資料庫裡,之後可以跨場次搜尋逐字稿,也能整份備份還原。
逐字稿要在寫出來的當下讀得到才有意義,所以字幕和翻譯可以整份彈進浮動視窗。用的是 documentPictureInPicture——跟浮動影片同一套「永遠置頂」的機制,只是裡面裝的不是影片,是一整份文件。作業系統會把這個視窗一直保持在最上面,連你正在轉逐字稿的那個視訊會議、或任何全螢幕的程式都壓不過它。錄音也一起搬過去:經過時間、暫停、加書籤、停止,跟原文/翻譯/雙軌的切換、文字級數、即時翻譯開關並排在視窗裡。於是你可以在這個分頁錄音,在通話畫面上方跟著讀,對方講出日期的那一刻直接打標記——不必回頭去找按鈕。把視窗關掉,字幕就收回頁面,錄音完全不受影響。
說話者標記的做法刻意做得很單純。同時錄麥克風和分頁聲音時,工具會比較每一句話期間哪一邊比較大聲,然後標成「你」或「對方」,就這樣。它不是聲紋辨識,也不是 speaker diarization:通話另一端的所有人都會被歸成同一個「對方」,視訊會議裡有三個人跟你講話,標記也全是一樣的;只開一條來源的話,就完全不會標。會議筆記也一樣在本機完成,摘要、重點、待辦與決議都是由 Chrome 內建的模型(Summarizer 和 Prompt API)在你自己的裝置上生成,逐字稿不會離開瀏覽器。
需要,沒有例外。開始錄任何對話或會議之前,你必須先明確告知所有在場的人和通話對象,並取得他們的同意。未經告知的錄音在許多地區屬於違法行為,可能構成非法竊聽,讓你面臨刑事責任與求償。務必先取得每一位參與者的同意再按下錄音。
不會。這個工具不會派任何 bot 或第三方帳號進你的會議室,而是用瀏覽器內建的網頁 API 直接擷取分頁音訊或麥克風聲音,你的視訊通話裡不會多出任何陌生成員。
不會。從錄音、語音轉文字、儲存到檔案匯出,全部都在你的瀏覽器裡本機完成,錄音和逐字稿從頭到尾都不會離開你的電腦。
錄音資料和逐字稿每隔幾秒就會寫進瀏覽器的本機資料庫。就算瀏覽器當機或不小心被關掉,重新打開時場次清單會標出那筆被中斷的錄音,當機前存下的音訊和文字都能一鍵找回來。
可以。錄音中按「浮動字幕」,最新幾行連翻譯會一起搬進浮動視窗,浮在所有視窗上面,全螢幕的通話也蓋不掉它。經過時間、暫停、加書籤、停止都在那個視窗裡,要結束錄音不用回頭找這個分頁;焦點在浮動視窗上時,B 鍵照樣可以在當下打標記。浮動視窗要 Chrome 或 Edge 116 以上才有;其他瀏覽器逐字稿就留在頁面裡,而且會在支援對照表裡直接寫明,不會偷偷把按鈕藏起來。
不是。它只是拿麥克風和分頁聲音這兩條音軌,逐句比較哪一邊比較大聲,大的那邊就當成說話的人。所以它只分得出「你」和「其他所有人」:對方有幾個人都會一起被標成「對方」,只錄一條來源的話沒有東西可以比,就不會標。用喇叭外放時對方的聲音也會進到你的麥克風,有些句子會被翻成「你說的」,所以戴耳機結果最乾淨。
不會。摘要、重點、待辦與決議都是由 Chrome 內建的模型在你的裝置上生成,逐字稿不會離開瀏覽器,也不會送到任何伺服器。遇到模型不直接支援的語言,會先在本機翻成英文再做摘要。模型下載好之後,就算離線筆記也照樣能用。
這表示目前這個瀏覽器沒有可以跑摘要的內建 AI 模型,按鈕下方會寫出少了哪一項。摘要和重點需要桌面版 Chrome 138 以上並且有 Summarizer;待辦與決議還要再加上 Chrome 148 以上的 Prompt API。如果只是模型還沒下載,按第一次就會開始抓,並顯示進度。錄音和逐字稿本身不受影響,任何支援的瀏覽器都能用。