macOS 首發 · Windows 隨後推出

PipScribe

讓每個詞,都回到它被說出的時刻。

本機 AI 轉錄與字幕工作台。把長音訊和影片變成可搜尋、可校對、可匯出的時間軸文本。

查看價格與試用
Interview_July.mov 已完成

Interview_July

47:18 · Qwen3-ASR · 已識別 2 位說話人
轉錄文本AI 摘要AI 對話
41
00:12:06 → 00:12:10林嵐

The timing is what makes the transcript useful later.

42
00:12:10 → 00:12:15周寧

Everywordstaysconnectedtothemomentitwasspoken.

43
00:12:15 → 00:12:19林嵐

That makes review much faster than scrubbing through the whole recording.

12:12 / 47:18
本機轉錄說話人識別詞級時間戳翻譯與字幕AI 摘要與對話

聲音成為工作資料

不是得到一段文字。
是繼續完成工作。

從採訪錄音到影片素材,PipScribe 保留聲音、文字和時間之間的聯繫,讓後續編輯有據可循。

訪談與播客

分清說話人,按片段回聽原聲。

影片與字幕

調整時間軸,控制字幕長度並匯出。

課程與研究

搜尋長內容,整理摘要與關鍵觀點。

會議與資料

批量轉錄、翻譯,再與內容繼續對話。

輸入不設門檻

檔案、影片網址,
都可以直接開始。

導入本機音影片,或粘貼常見影片網址。PipScribe 會準備媒體,並把轉錄任務放入本機佇列。

把音訊或影片拖到這裡

支援 FFmpeg 可讀取的常見音影片格式

MP3WAVM4AMP4MOVMKVWEBM更多

獲取媒體後在本機轉錄

精確時間軸

聽見哪一句,
就看到哪一個詞。

Qwen3-ASR 的詞級時間戳讓播放、校對和字幕編輯保持在同一條時間線上。

Reviewtheexactwordwithoutlosingyourplace.

00:16:41.240
可能有長停頓 00:16:42 → 00:16:47 gap 4.9s
00:16:42.000

轉錄之後

分清誰在說,
整理成可用字幕。

說話人、翻譯和字幕版本都沿用同一份時間軸。完成轉錄後,在一個工作台裡繼續整理,不必反覆搬運內容。

VOICE MAP 已識別 2 位
林嵐

我們先確認逐詞時間軸,再處理字幕邊界。

周寧

這樣每次修改都能回到原始語音核對。

標籤可以按專案重命名和管理

本機模型與自研推理引擎

模型各有所長,
硬體都能發揮。

按任務選擇 Parakeet、Qwen3 或 Whisper,再由 PipScribe 自研引擎調用適合設備的本機計算後端。

速度優先

最長內容,也能快速完成。 在 M3 MacBook 上,119 秒測試語音最快 3.3 秒完成轉錄。
約 36× 實時速度 M3 MacBook 實測 適合長內容
LOCAL INFERENCE CORE PipScribe Engine

負責模型加載、音訊處理和推理調度;沒有兼容 GPU 時也可以使用 CPU。

APPLE SILICON目前
Metal

使用 Mac GPU 加速。

NVIDIAWindows
CUDA

NVIDIA 專用計算後端。

AMD · INTEL跨硬體
Vulkan

在支援的 GPU 上加速。

macOS 版本目前使用 Metal。CUDA 與 Vulkan 支援將隨 Windows 版本提供,實際可用性取決於 GPU 和驅動環境。

理解、整理,再繼續追問

讓轉錄內容,
繼續為你工作。

生成摘要、提煉關鍵觀點、識別問題或直接與目前轉錄對話。內置提示詞可以修改,也可以按自己的工作方式新建。

Interview_July · 目前轉錄Ollama · 本機

把這次訪談整理成一份可執行摘要。

AI 回答

時間軸讓每個結論都能回到原聲。

訪談建議先用詞級時間軸完成定位,再處理長停頓和字幕邊界。這樣摘要、校對和後續編輯都保留同一份聲音依據。

00:12:06 · 林嵐:“先確認逐詞時間軸,再處理字幕邊界。”
雲端或本機,由你決定使用自己的帳號或 API Key,也可以連接本機模型。
OpenAIAnthropicGeminiQwenOpenRouterDeepSeekZ.aiOllama 本機LM Studio 本機

清晰的隱私邊界

原始媒體留在你的電腦上。

本機優先;只有你主動選擇的在線操作才會連接對應服務。

媒體不上傳音訊與影片直接在本機處理
本機完成Qwen3、Parakeet、Whisper、Ollama、LM Studio
按需聯網翻譯與雲端 AI 僅在你選擇時啟用

簡單定價

一次購買,
讓聲音成為可用的文字。

先用完整功能處理自己的真實檔案,再決定是否購買。

永久授權US$59
  • 7 天全功能試用
  • 三類本機轉錄模型
  • 批量處理與詞級時間軸
  • 字幕、翻譯、摘要與 AI 對話

在線 AI 服務需要使用你自己的帳號或 API Key,相關費用由對應服務商收取。本機 Ollama 與 LM Studio 不需要雲端 API。

常見問題

支援哪些音訊和影片格式?

支援 FFmpeg 可讀取的常見音影片格式,包括 MP3、WAV、M4A、MP4、MOV、MKV 和 WebM 等。實際可用編解碼器以對應平臺版本為準。

可以直接轉錄影片網址嗎?

可以粘貼常見影片網址加入任務。網站支援情況可能隨目標網站規則變化,本機檔案導入不受這類變化影響。

沒有網路也可以轉錄嗎?

模型完成下載後,本機檔案轉錄不需要把媒體上傳到雲端。

AI 摘要和翻譯也可以完全本機嗎?

可以使用本機安裝的 Ollama 或 LM Studio;也可以按需選擇在線服務。

Windows 版本什麼時候推出?

Windows 版本正在同步準備,官網上線後會提供獨立下載入口。