The timing is what makes the transcript useful later.
macOS 首发 · Windows 随后推出
PipScribe
让每个词,都回到它被说出的时刻。
本地 AI 转录与字幕工作台。把长音频和视频变成可搜索、可校对、可导出的时间轴文本。
Everywordstaysconnectedtothemomentitwasspoken.
That makes review much faster than scrubbing through the whole recording.
声音成为工作资料
不是得到一段文字。
是继续完成工作。
从采访录音到视频素材,PipScribe 保留声音、文字和时间之间的联系,让后续编辑有据可循。
分清说话人,按片段回听原声。
调整时间轴,控制字幕长度并导出。
搜索长内容,整理摘要与关键观点。
批量转录、翻译,再与内容继续对话。
输入不设门槛
文件、视频网址,
都可以直接开始。
导入本地音视频,或粘贴常见视频网址。PipScribe 会准备媒体,并把转录任务放入本地队列。
支持 FFmpeg 可读取的常见音视频格式
获取媒体后在本机转录
精确时间轴
听见哪一句,
就看到哪一个词。
Qwen3-ASR 的词级时间戳让播放、校对和字幕编辑保持在同一条时间线上。
Reviewtheexactwordwithoutlosingyourplace.
转录之后
分清谁在说,
整理成可用字幕。
说话人、翻译和字幕版本都沿用同一份时间轴。完成转录后,在一个工作台里继续整理,不必反复搬运内容。
我们先确认逐词时间轴,再处理字幕边界。
这样每次修改都能回到原始语音核对。
Every edit stays connected to the original moment.
每一次修改,都与原始语音中的准确时刻相连。
The transcript becomes a subtitle without losing its timing.
本地模型与自研推理引擎
模型各有所长,
硬件都能发挥。
按任务选择 Parakeet、Qwen3 或 Whisper,再由 PipScribe 自研引擎调用适合设备的本地计算后端。
速度优先
最长内容,也能快速完成。 在 M3 MacBook 上,119 秒测试语音最快 3.3 秒完成转录。负责模型加载、音频处理和推理调度;没有兼容 GPU 时也可以使用 CPU。
使用 Mac GPU 加速。
NVIDIA 专用计算后端。
在支持的 GPU 上加速。
macOS 版本当前使用 Metal。CUDA 与 Vulkan 支持将随 Windows 版本提供,实际可用性取决于 GPU 和驱动环境。
理解、整理,再继续追问
让转录内容,
继续为你工作。
生成摘要、提炼关键观点、识别问题或直接与当前转录对话。内置提示词可以修改,也可以按自己的工作方式新建。
把这次访谈整理成一份可执行摘要。
时间轴让每个结论都能回到原声。
访谈建议先用词级时间轴完成定位,再处理长停顿和字幕边界。这样摘要、校对和后续编辑都保留同一份声音依据。
00:12:06 · 林岚:“先确认逐词时间轴,再处理字幕边界。”
清晰的隐私边界
原始媒体留在你的电脑上。
本地优先;只有你主动选择的在线操作才会连接对应服务。
简单定价
一次购买,
让声音成为可用的文字。
先用完整功能处理自己的真实文件,再决定是否购买。
- 7 天全功能试用
- 三类本地转录模型
- 批量处理与词级时间轴
- 字幕、翻译、摘要与 AI 对话
在线 AI 服务需要使用你自己的账号或 API Key,相关费用由对应服务商收取。本地 Ollama 与 LM Studio 不需要云端 API。
常见问题
支持哪些音频和视频格式?
支持 FFmpeg 可读取的常见音视频格式,包括 MP3、WAV、M4A、MP4、MOV、MKV 和 WebM 等。实际可用编解码器以对应平台版本为准。
可以直接转录视频网址吗?
可以粘贴常见视频网址加入任务。网站支持情况可能随目标网站规则变化,本地文件导入不受这类变化影响。
没有网络也可以转录吗?
模型完成下载后,本地文件转录不需要把媒体上传到云端。
AI 摘要和翻译也可以完全本地吗?
可以使用本机安装的 Ollama 或 LM Studio;也可以按需选择在线服务。
Windows 版本什么时候推出?
Windows 版本正在同步准备,官网上线后会提供独立下载入口。