macOS版を先行提供 · Windows版も近日対応

PipScribe

すべての言葉を、話された瞬間へ。

長い音声や動画を、検索・編集・書き出しができるタイムライン付きテキストに変える、ローカルAI文字起こし・字幕ワークスペースです。

価格とトライアルを見る
Interview_July.mov Completed

Interview_July

47:18 · Qwen3-ASR · 2 speakers detected
TranscriptAI SummaryAI Chat
41
00:12:06 → 00:12:10Maya Reed

The timing is what makes the transcript useful later.

42
00:12:10 → 00:12:15Daniel Hart

Everywordstaysconnectedtothemomentitwasspoken.

43
00:12:15 → 00:12:19Maya Reed

That makes review much faster than scrubbing through the whole recording.

12:12 / 47:18
ローカル文字起こし話者識別単語単位タイムスタンプ翻訳と字幕AI要約とチャット

音声を使える資料へ

文字にするだけでなく、その先の作業へ。

インタビューから映像素材まで、音声・テキスト・時間のつながりを保ち、後の編集でも必ず元の箇所へ戻れます。

インタビューとポッドキャスト

話者を分け、区間ごとに元音声を再生します。

動画と字幕

タイミングと字幕長を調整して書き出します。

講義とリサーチ

長い録音を検索し、要約や重要点を抽出します。

会議とアーカイブ

文字起こしと翻訳を一括処理し、そのまま内容を活用できます。

さまざまな素材から開始

ファイルでも、動画URLでも。

ローカルの音声・動画を読み込むか、対応する動画URLを貼り付けます。PipScribeが素材を準備し、ローカルキューに追加します。

音声または動画をここにドロップ

FFmpegで読み込める一般的な形式に対応

MP3WAVM4AMP4MOVMKVWEBMその他

素材取得後はローカルで文字起こし

高精度タイミング

文章を聴き、その単語を正確に見る。

Qwen3-ASRの単語単位タイムスタンプにより、再生・確認・字幕編集を同じタイムラインで行えます。

Reviewtheexactwordwithoutlosingyourplace.

00:16:41.240
長い無音の可能性 00:16:42 → 00:16:47 gap 4.9s
00:16:42.000

文字起こし後

誰が話したかを知り、字幕を仕上げる。

話者ラベル、翻訳、字幕バージョンは同じタイムラインを共有します。ツール間を移動せず、一か所で作業を続けられます。

VOICE MAP 2人の話者を検出
Maya Reed

まず単語単位のタイムラインを確認し、次に字幕の境界を整えます。

Daniel Hart

これで、すべての編集を元音声と照合できます。

プロジェクトごとに話者名を変更・管理

ローカルモデルと独自推論エンジン

モデルを選び、ハードウェアを活かす。

用途に合わせてParakeet、Qwen3、Whisperを選ぶと、PipScribe独自エンジンが端末に適したローカル計算バックエンドを使用します。

速度重視

長い録音もすばやく処理。 M3 MacBookでは、119秒のテスト音声を最短3.3秒で文字起こししました。
約36倍のリアルタイム速度 M3 MacBookで計測 長時間音声に最適
LOCAL INFERENCE CORE PipScribe Engine

モデル読み込み、音声処理、推論スケジューリングを担い、対応GPUがない場合はCPUへ切り替えます。

APPLE SILICON現在
Metal

MacのGPUで高速化。

NVIDIAWindows
CUDA

NVIDIA専用バックエンド。

AMD · INTEL柔軟に対応
Vulkan

対応GPUで高速化。

現在のmacOS版はMetalを使用します。CUDAとVulkanはWindows版で提供予定で、利用可否はGPUとドライバー環境によって異なります。

理解し、整理し、さらに質問

文字起こしを、そのまま次の作業へ。

要約、重要点の抽出、未解決事項の確認、文字起こしとのチャットができます。組み込みプロンプトの編集や独自プロンプトの作成にも対応します。

Interview_July · 現在の文字起こしOllama · ローカル

このインタビューを実行可能な要約にまとめてください。

AIの回答

すべての結論から元音声へ戻れます。

単語単位のタイムラインで正確な位置を確認し、長い無音と字幕境界を見直します。要約、修正、その後の編集も同じ音声参照を保ちます。

00:12:06 · Maya Reed:「まず単語単位のタイムラインを確認し、次に字幕の境界を整えます。」
クラウドかローカルかは、あなたが選べます。自分のアカウントやAPIキー、またはPC上で動くモデルを利用できます。
OpenAIAnthropicGeminiQwenOpenRouterDeepSeekZ.aiOllama LocalLM Studio Local

明確なプライバシー境界

元のメディアはPC内に留まります。

標準はローカル処理。オンラインサービスは選択したときだけ接続します。

メディアをアップロードしません音声と動画はPC上で処理
ローカル作業はローカルのままQwen3、Parakeet、Whisper、Ollama、LM Studio
オンライン利用は選択時のみ翻訳とクラウドAIは有効にした場合のみ実行

シンプルな価格

一度購入すれば、ファイル数は無制限。

購入前に、自分のファイルですべての機能を試せます。

買い切りライセンスUS$59
  • 7日間の全機能トライアル
  • 3種類のローカル文字起こしモデル
  • 一括処理と単語単位タイムスタンプ
  • 字幕、翻訳、要約、AIチャット

オンラインAIサービスではご自身のアカウントまたはAPIキーを使用し、提供者の料金が発生する場合があります。ローカルのOllamaとLM StudioにはクラウドAPIは不要です。

よくある質問

対応する音声・動画形式は?

PipScribeは、MP3、WAV、M4A、MP4、MOV、MKV、WebMなど、FFmpegで読み込める一般的な形式に対応します。利用可能なコーデックはプラットフォームによって異なる場合があります。

動画URLから直接文字起こしできますか?

対応する動画URLをキューへ追加できます。配信元サイトの規約変更により利用できなくなる場合がありますが、ローカルファイルの読み込みには影響しません。

インターネット接続なしで文字起こしできますか?

モデルのダウンロード後は、メディアをクラウドへアップロードせずにローカルファイルを文字起こしできます。

AI要約と翻訳を完全にローカルで実行できますか?

はい。PCにインストールしたOllamaまたはLM Studioを使用するか、必要に応じてオンラインサービスを選べます。

Windows版はいつ利用できますか?

Windows版は開発中で、公開時に専用のダウンロードを提供します。