Logo
ログイン
Logo

最も開発者にフォーカスした音声AIプラットフォーム

ISO 27001
ISO 27001
SOC 2
SOC 2
SSL/TLS
SSL/TLS
APPI
APPI
プロダクト
  • リアルタイム音声認識
  • 録音ファイル書き起こし
  • 音声合成
  • 発音評価
  • DolphinTeams デュアルスクリーン端末
  • Tralingo AI翻訳機
  • NihongoScore
リソース
  • ドキュメント
  • ブログ
  • AI アプリ
  • オンライン体験
会社
  • 会社情報
  • お問い合わせ
  • クライアント
法務
  • プライバシーポリシー
  • 利用規約
  • サービスレベル合意(SLA)
  • 特定商取引法に基づく表記
  • DolphinTeams ユーザーマニュアル
© 2026 DolphinVoice All Rights Reserved.
製品Harku
Harku

Harku

98.5% accurate transcription — 15x cheaper than Rev

2 投票ウェブサイトを訪問
Harku Screenshot
Harku Preview
ウェブサイトを訪問

Harkuの紹介

Harkuは、AIを活用した音声認識および動画からテキストへの変換サービスであり、音声および動画コンテンツを高精度で編集可能なテキストに変換します。OpenAIのWhisper V3モデルを採用しており、明瞭な英語音声に対して98.5%の認識精度を実現しています。対応入力ソースには、アップロードファイル(音声・動画)、YouTube URL、Vimeoなどの主要動画プラットフォームが含まれます。

Harkuは、クリエイター、ポッドキャスター、研究者、教育者、および信頼性とスケーラビリティのある文字起こしが必要なプロフェッショナル向けに設計されています。サブスクリプションの縛りや隠れたコストを排除し、ソフトウェアのインストール不要、ブラウザ上で完結する使いやすさを重視しています。

主なポイント

  • 明瞭な英語音声で98.5%の文字起こし精度を達成。スペイン語、フランス語、ドイツ語、中国語など主要言語では95%以上、100以上の言語で90–98%の精度を維持
  • 分単位料金は$0.10。Rev($1.50/分)の15分の1の価格であり、Otter.ai($0.20/分)やDescript($0.30/分)と比較しても競争力がある
  • YouTube URLの直接貼り付け、複数ファイルの一括アップロード、MP4、MOV、AVI、MKV、MP3、WAV、FLAC、OPUSなど25種類以上の入力形式をサポート
  • スピーカー識別(話者分離)、自動句読点挿入、タイムスタンプ同期、AI生成チャプター機能を提供
  • TXT、SRT、VTT、Markdown、JSON、DOCX、PDF形式でのエクスポートに対応
  • 無料プランでは月30分の利用が可能で、クレジットカード情報は不要。すべてのプランでファイル転送時の暗号化および24時間後の自動データ削除を実施
  • GDPRおよびSOC 2 Type 2準拠。米国および欧州のセキュアなデータセンターでホスティング

Harkuの仕組み

Harkuは「アップロード」「処理」「エクスポート」の3ステップで動作します。ユーザーはまず、音声または動画ファイル(無料プランでは最大500MB)をアップロードするか、YouTube、VimeoなどのURLを貼り付けます。制限付き動画の場合は、ローカルダウンロード後にファイルをアップロードすることを推奨します。提出後、システムは音声を抽出・最適化し、言語検出およびスピーカー識別機能を備えたWhisper V3によるAI処理を実行します。

処理はGPUアクセラレーションされたサーバーで実行されるため、高速な結果が出力されます。1時間の録音は通常2分以内で完了します。処理中はリアルタイムの進捗バーで状況を確認できます。完了後、ユーザーは同期再生可能なWebエディタにアクセスし、テキストをレビュー・修正・微調整して、希望の形式でエクスポートできます。

主な利点と用途

Harkuは多様な分野で実用的な応用が可能です。教育者は講義やYouTubeチュートリアルを文字起こしし、学習ノートやアクセシビリティ対応資料として活用できます。研究者はインタビューおよびグループディスカッションの録音を、話者ラベル付きの構造化された検索可能なテキストに変換できます。ポッドキャスターは動画エピソードからSEO最適化済みのブログ原稿や字幕ファイル(SRT/VTT)を生成できます。ビジネスチームは会議録を文書化し、アクションアイテムを抽出できます。コンテンツクリエイターは長尺動画をMarkdownやDOCX形式で書き起こし、公開用に再利用できます。

本サービスは、人手による文字起こし(同等量で$600以上)への依存を排除し、YouTubeなどのプラットフォーム内自動キャプション(精度が低い)の制約も回避します。コードスイッチングや地域アクセントへの適応を含む多言語対応により、国際共同作業や外国語学習教材の制作にも適しています。エンドツーエンド暗号化、ゼロデータ保持ポリシー、およびオプションのオンプレミス展開といったセキュリティ機能は、規制対応環境でも利用可能です。

プラン料金月間利用可能分主な機能
無料$030AIチャプター、全エクスポート形式、500MBファイル上限、クレジットカード不要
Basic$10/月500無料プランの全機能+スピーカー識別、高精度モード
Pro$29/月2000Basicの全機能+優先キュー、2GBファイル上限、カスタム語彙
機能HarkuRevOtter.aiDescript
分単位料金$0.10$1.50$0.20$0.30
対応言語数100以上383123
スピーカー識別Basic/Proで利用可能ありありあり
一括アップロードありありありあり
インストール不要ありありありあり
APIアクセス入力データ未記載ありありあり
リアルタイム文字起こし入力データ未記載ありありあり
オフラインファイル対応ありありありあり

タグ

#AI Transcription#Speech to Text#Video to Text#Whisper V3#Cost Effective#High Accuracy#Multilingual Support#Free Tier#Podcast Tools#Content Creation

おすすめ

Guideflow

Guideflow

The AI demo automation platform for SaaS

1259
CyberCut AI

CyberCut AI

AI video studio for viral social clips

706
Incredible

Incredible

Deep Work AI Agents - powered by Agent MAX

653
Typeless

Typeless

AI voice dictation that's actually intelligent

625

AI Apps でアプリを無料で紹介

革新者のコミュニティに参加して、あなたの AI ツールを毎日何千人ものユーザーに届けましょう。

掲載を申し込む
DolphinVoice Console

BlogPage.PromoContent.title

BlogPage.PromoContent.description

BlogPage.PromoContent.cta