macOS 首发 · Windows 随后推出

PipScribe

让每个词,都回到它被说出的时刻。

本地 AI 转录与字幕工作台。把长音频和视频变成可搜索、可校对、可导出的时间轴文本。

查看价格与试用
Interview_July.mov 已完成

Interview_July

47:18 · Qwen3-ASR · 已识别 2 位说话人
转录文本AI 摘要AI 对话
41
00:12:06 → 00:12:10林岚

The timing is what makes the transcript useful later.

42
00:12:10 → 00:12:15周宁

Everywordstaysconnectedtothemomentitwasspoken.

43
00:12:15 → 00:12:19林岚

That makes review much faster than scrubbing through the whole recording.

12:12 / 47:18
本地转录说话人识别词级时间戳翻译与字幕AI 摘要与对话

声音成为工作资料

不是得到一段文字。
是继续完成工作。

从采访录音到视频素材,PipScribe 保留声音、文字和时间之间的联系,让后续编辑有据可循。

访谈与播客

分清说话人,按片段回听原声。

视频与字幕

调整时间轴,控制字幕长度并导出。

课程与研究

搜索长内容,整理摘要与关键观点。

会议与资料

批量转录、翻译,再与内容继续对话。

输入不设门槛

文件、视频网址,
都可以直接开始。

导入本地音视频,或粘贴常见视频网址。PipScribe 会准备媒体,并把转录任务放入本地队列。

把音频或视频拖到这里

支持 FFmpeg 可读取的常见音视频格式

MP3WAVM4AMP4MOVMKVWEBM更多

获取媒体后在本机转录

精确时间轴

听见哪一句,
就看到哪一个词。

Qwen3-ASR 的词级时间戳让播放、校对和字幕编辑保持在同一条时间线上。

Reviewtheexactwordwithoutlosingyourplace.

00:16:41.240
可能有长停顿 00:16:42 → 00:16:47 gap 4.9s
00:16:42.000

转录之后

分清谁在说,
整理成可用字幕。

说话人、翻译和字幕版本都沿用同一份时间轴。完成转录后,在一个工作台里继续整理,不必反复搬运内容。

VOICE MAP 已识别 2 位
林岚

我们先确认逐词时间轴,再处理字幕边界。

周宁

这样每次修改都能回到原始语音核对。

标签可以按项目重命名和管理

本地模型与自研推理引擎

模型各有所长,
硬件都能发挥。

按任务选择 Parakeet、Qwen3 或 Whisper,再由 PipScribe 自研引擎调用适合设备的本地计算后端。

速度优先

最长内容,也能快速完成。 在 M3 MacBook 上,119 秒测试语音最快 3.3 秒完成转录。
约 36× 实时速度 M3 MacBook 实测 适合长内容
LOCAL INFERENCE CORE PipScribe Engine

负责模型加载、音频处理和推理调度;没有兼容 GPU 时也可以使用 CPU。

APPLE SILICON当前
Metal

使用 Mac GPU 加速。

NVIDIAWindows
CUDA

NVIDIA 专用计算后端。

AMD · INTEL跨硬件
Vulkan

在支持的 GPU 上加速。

macOS 版本当前使用 Metal。CUDA 与 Vulkan 支持将随 Windows 版本提供,实际可用性取决于 GPU 和驱动环境。

理解、整理,再继续追问

让转录内容,
继续为你工作。

生成摘要、提炼关键观点、识别问题或直接与当前转录对话。内置提示词可以修改,也可以按自己的工作方式新建。

Interview_July · 当前转录Ollama · 本地

把这次访谈整理成一份可执行摘要。

AI 回答

时间轴让每个结论都能回到原声。

访谈建议先用词级时间轴完成定位,再处理长停顿和字幕边界。这样摘要、校对和后续编辑都保留同一份声音依据。

00:12:06 · 林岚:“先确认逐词时间轴,再处理字幕边界。”
云端或本地,由你决定使用自己的账号或 API Key,也可以连接本地模型。
OpenAIAnthropicGeminiQwenOpenRouterDeepSeekZ.aiOllama 本地LM Studio 本地

清晰的隐私边界

原始媒体留在你的电脑上。

本地优先;只有你主动选择的在线操作才会连接对应服务。

媒体不上传音频与视频直接在本机处理
本地完成Qwen3、Parakeet、Whisper、Ollama、LM Studio
按需联网翻译与云端 AI 仅在你选择时启用

简单定价

一次购买,
让声音成为可用的文字。

先用完整功能处理自己的真实文件,再决定是否购买。

永久授权US$59
  • 7 天全功能试用
  • 三类本地转录模型
  • 批量处理与词级时间轴
  • 字幕、翻译、摘要与 AI 对话

在线 AI 服务需要使用你自己的账号或 API Key,相关费用由对应服务商收取。本地 Ollama 与 LM Studio 不需要云端 API。

常见问题

支持哪些音频和视频格式?

支持 FFmpeg 可读取的常见音视频格式,包括 MP3、WAV、M4A、MP4、MOV、MKV 和 WebM 等。实际可用编解码器以对应平台版本为准。

可以直接转录视频网址吗?

可以粘贴常见视频网址加入任务。网站支持情况可能随目标网站规则变化,本地文件导入不受这类变化影响。

没有网络也可以转录吗?

模型完成下载后,本地文件转录不需要把媒体上传到云端。

AI 摘要和翻译也可以完全本地吗?

可以使用本机安装的 Ollama 或 LM Studio;也可以按需选择在线服务。

Windows 版本什么时候推出?

Windows 版本正在同步准备,官网上线后会提供独立下载入口。