Logo
ログイン
Logo

最も開発者にフォーカスした音声AIプラットフォーム

ISO 27001
ISO 27001
SOC 2
SOC 2
SSL/TLS
SSL/TLS
APPI
APPI
プロダクト
  • リアルタイム音声認識
  • 録音ファイル書き起こし
  • 音声合成
  • 発音評価
  • DolphinTeams デュアルスクリーン端末
  • Tralingo AI翻訳機
  • NihongoScore
リソース
  • ドキュメント
  • ブログ
  • AI アプリ
  • オンライン体験
会社
  • 会社情報
  • お問い合わせ
  • クライアント
法務
  • プライバシーポリシー
  • 利用規約
  • サービスレベル合意(SLA)
  • 特定商取引法に基づく表記
  • DolphinTeams ユーザーマニュアル
© 2026 DolphinVoice All Rights Reserved.
製品ScribeBench
ScribeBench

ScribeBench

Audio & Video to Text | Subtitles | Translation

0 投票ウェブサイトを訪問
ScribeBench Screenshot
ScribeBench Preview
ウェブサイトを訪問

ScribeBenchの紹介

ScribeBenchは、音声および動画コンテンツを高精度な編集可能なテキストに変換し、タイムスタンプ付き字幕を生成し、99以上の言語へ翻訳するためのウェブベースのプラットフォームです。コンテンツ制作者、教育者、研究者、アクセシビリティ専門家、ローカライゼーション担当者など、多言語対応の文字起こし・字幕作成機能を必要とする専門職および個人ユーザーを対象としています。高度な技術を活用しながらも、企業向け高額プランや専門的知識を必要としない設計が特徴です。

本プラットフォームは、オープンソースおよび商用の最先端AIモデルを統合し、高品質な結果を提供するとともに、操作の簡便性を維持しています。アーキテクチャはデータプライバシー、予測可能な料金体系、および単一インターフェース内での包括的な編集ワークフローを重視しています。

主なポイント

  • 99以上の言語に対応した文字起こし、字幕生成、および翻訳機能
  • 高精度音声認識のため、OpenAI Whisper Large V3モデルを採用
  • 文脈を考慮した多言語翻訳に、OpenAI GPTモデルを活用
  • 文字起こし、字幕作成、翻訳の3つのモードを統合したタイムライン編集機能を備えた一元化エディタ
  • 話者識別、ラベリング、および手動編集ツールによる出力の精緻化
  • SRT、VTT、PDF、TXT、CSV、DOCXなど複数の形式へのエクスポート対応
  • 定額サブスクリプションではなく、使用量に応じたクレジット課金方式を採用
  • ユーザーデータは1年間保持され、メディアファイルは3か月間保存可能(再アップロード可)

ScribeBenchの仕組み

ユーザーはMP3、MP4、WAV、MOV、AVIなど一般的な形式の音声・動画ファイル(最大5GB)をアップロードします。プラットフォームはWhisper Large V3を用いて、話者分離を含むタイムスタンプ付き文字起こしを実行します。この基盤となる文字起こしから、ユーザーは「文字起こし編集」「字幕作成(放送・ストリーミング向けCPS/CPL最適化対応)」「翻訳(99以上の言語対応)」の3つのモードを切り替えて利用できます。また、バイリンガル編集機能により、原文と翻訳文を並列表示して比較・編集可能です。

すべての編集はブラウザ上でタイムラインベースのインタフェースで実行され、メディア再生とテキストセグメントが正確に同期します。ユーザーはタイムスタンプの調整、セグメントの分割・結合、話者ラベルの付与、動画上への字幕プレビューなどが可能です。完了後、業界標準フォーマット(SRT、VTTなど)で出力をエクスポートしたり、直接共有したりできます。

主な利点と用途

ScribeBenchは多様な用途に対応します:アクセシビリティ向上のための高精度字幕作成、多言語対応の教育資料や研究インタビューの制作、ポッドキャスターおよび映像制作者のポストプロダクションワークフローの効率化、グローバル配信向けリアルタイムコンテンツローカライゼーション、WCAGおよびADAなどのアクセシビリティ規格への準拠支援などです。クレジット制の料金体系により、利用量に応じたコスト管理が可能であり、永続的なデータ保存を行わない設計とエンタープライズレベルのセキュリティ対策により、規制対応環境における機密性要件にも応えます。

プラン価格クレジット数1分あたりの料金主な機能
Lite9.90ドル5000.020ドルWhisper V3+GPTモデル、話者識別、3モード統合エディタ、タイムライン編集、1年間のデータ保持
Standard29.90ドル20000.015ドルLiteの全機能に加え、クレジット数増加および同水準のデータ保持期間
Pro59.90ドル60000.010ドルStandardの全機能に加え、最大クレジット数と最も低コストな1分あたり料金

タグ

#audio-to-text#video-to-text#subtitle generator#translation service#AI transcription#GPT translation#Whisper model#pay-as-you-go#multilingual support#content creation

おすすめ

Guideflow

Guideflow

The AI demo automation platform for SaaS

1259
CyberCut AI

CyberCut AI

AI video studio for viral social clips

706
Incredible

Incredible

Deep Work AI Agents - powered by Agent MAX

653
Typeless

Typeless

AI voice dictation that's actually intelligent

625

AI Apps でアプリを無料で紹介

革新者のコミュニティに参加して、あなたの AI ツールを毎日何千人ものユーザーに届けましょう。

掲載を申し込む
DolphinVoice Console

BlogPage.PromoContent.title

BlogPage.PromoContent.description

BlogPage.PromoContent.cta