Logo
ログイン
Logo

最も開発者にフォーカスした音声AIプラットフォーム

ISO 27001
ISO 27001
SOC 2
SOC 2
SSL/TLS
SSL/TLS
APPI
APPI
プロダクト
  • リアルタイム音声認識
  • 録音ファイル書き起こし
  • 音声合成
  • 発音評価
  • DolphinTeams デュアルスクリーン端末
  • Tralingo AI翻訳機
  • NihongoScore
リソース
  • ドキュメント
  • ブログ
  • AI アプリ
  • オンライン体験
会社
  • 会社情報
  • お問い合わせ
  • クライアント
法務
  • プライバシーポリシー
  • 利用規約
  • サービスレベル合意(SLA)
  • 特定商取引法に基づく表記
  • DolphinTeams ユーザーマニュアル
© 2026 DolphinVoice All Rights Reserved.
製品Echosy
Echosy

Echosy

Real-time Transcript, translate and summary in private

0 投票ウェブサイトを訪問
Echosy Screenshot
Echosy Preview
ウェブサイトを訪問

Echosyの紹介

Echosyは、macOS向けのリアルタイム、オンデバイス音声文字起こし・音声入力・要約アプリケーションです。インターネット接続を一切必要とせず、すべての音声処理をMac上で完全にローカルで実行するため、データのプライバシーと所有権が保証されます。研究者、ジャーナリスト、法務関係者、教育者、開発者など、機密性の高いコンテンツを扱う専門職向けに設計されています。Echosyは、ZoomやSpotifyなどのアプリケーションから出力されるシステム音声とマイク音声を同時に記録し、文字起こし、要約、音声入力を行います。

本アプリケーションは99以上の言語に対応した多言語文字起こしをサポートし、Qwen3-ASRおよびMLX最適化Whisperなどの複数のローカル自動音声認識(ASR)モデルを統合しています。ユーザーはライブセッションの文字起こし、システム全体での音声入力、句読点や翻訳によるテキスト補正、設定可能なLLMバックエンドを用いたAI要約生成、録音履歴の管理など、すべてクラウド経由ではなく端末上で行えます。

主なポイント

  • 100%オフライン動作:音声処理、文字起こし、要約はすべてMac上でローカルで実行され、音声や文字起こし結果は端末から一切送信されません
  • 二重音声キャプチャ:ScreenCaptureKitを用いて、Zoom、Teams、YouTube、Spotifyなどのアプリケーションからのシステム音声とマイク音声を同時記録可能
  • 複数のオンデバイスASRモデル:Qwen3-ASR(0.6Bおよび1.7B)、MLX Whisper(TinyからLarge V3 Turboまで)、標準Whisperなど。各モデルはサイズ、速度、精度、メモリ要件において異なる特性を持ちます
  • システム全体での音声入力:カスタマイズ可能なホットキーで、任意のmacOSアプリケーション内でカーソル位置に直接テキストを貼り付ける音声入力機能を提供
  • リアルタイム文字起こし補正:自動句読点挿入、多言語翻訳、カスタムプロンプト適用、OpenAI互換APIまたはローカルLLM(例:Ollama)を用いたストリーミングAI要約に対応
  • ファイル文字起こし:WAV、MP3、MP4、MOV、M4Aファイルをドラッグ&ドロップでインポートし、一括処理と進行状況追跡が可能
  • セッション履歴管理:検索可能な文字起こし全文、再生可能な音声、関連要約を含む録音履歴を閲覧・管理可能
  • 専門用語強調(ボキャブラリ・バイアシング):技術用語、固有名詞、分野特化語彙などを登録してASRの認識精度を向上させるPro機能

Echosyの仕組み

Echosyは、macOSネイティブアプリケーションとして動作し、AppleのScreenCaptureKitフレームワークを活用して、ZoomやTeams、YouTube、Spotifyなどのアプリケーションから出力されるシステム音声とマイク音声を同時にキャプチャします。キャプチャされた音声ストリームは、Metalアクセラレーション対応の推論エンジンにより、Qwen3-ASRやMLX WhisperなどのローカルASRモデルへ直接送信され、タイムスタンプ付きの文字起こしがリアルタイムで生成されます。ユーザーはハードウェア制約(メモリ容量、チップアーキテクチャ)や言語ニーズに応じて、複数のASRモデルから選択できます。

文字起こし結果はインタラクティブに補正可能です:句読点と文法が自動修正され、セグメント単位で翻訳が適用され、カスタムプロンプトによって出力スタイルが調整されます。要約および分析には、OpenAI、Gemini、Claude、Groq、OpenRouter、または完全ローカルのOllamaなどのユーザ設定LLMエンドポイントに接続し、低遅延で文字起こしテキストのチャンクをストリーミング処理します。生成されたすべての出力(文字起こし、要約、チャット応答)は、手動でエクスポートしない限り、端末内にのみ保存されます。

ファイル文字起こしも同様のローカルワークフローで実行されます:インポートされた音声または動画ファイルはデコードされ、選択されたASRモデルにより処理されます。セッション履歴はメタデータ、元音声参照、全文文字起こし、関連要約をローカルデータベースに保持し、検索、再生、MD/TXT/SRT/VTT/DOCX/PDF形式へのエクスポート(Pro版)を可能にします。

主な利点と用途

Echosyは、厳格なデータプライバシー要件、低遅延応答性、多様な音声ソースへの柔軟な対応が求められるユースケースに適しています。法務関係者は、クライアントとの相談や証言記録を第三者サービスを介さずに文字起こしできます。研究者および教育者は、インタビューや講義の録音を参加者の機密情報を守りながら文字起こしできます。開発者は、コード解説や内部デモ中に技術用語の認識精度を向上させるためにボキャブラリ・バイアシングを活用できます。

教育者は、同期タイムスタンプ付きの講義ノートや多言語翻訳を生成できます。ジャーナリストは、プレスカンファレンスやポッドキャストインタビューをリアルタイムで文字起こし・要約し、カスタムプロンプトで出力を精製できます。リモートワーカーは、システム全体での音声入力により、メールやドキュメント、メッセージの作成をハンズフリーで行え、マルチタスク時にも有効です。一括ファイル文字起こしは、既存の会議録や講義アーカイブを検索可能なテキストに変換するようなアーカイブ作業を支援します。

オフライン優先設計は、ネットワーク接続が不安定な地域、完全にネットワークから隔離された環境(エアギャップ環境)、または厳しいデータ所在要件を課す組織でも有用です。ハードウェアの柔軟性は、8GB RAMのIntel Macから大規模量子化モデルを実行するApple Silicon Macまで幅広く対応しており、機能を損なわず異種デバイス群への展開が可能です。

機能無料版Pro版
最大録音時間セッションあたり15分セッションあたり4時間
利用可能なASRモデルQwen3-ASR 0.6Bのみ全モデル(Qwen3-ASR 0.6B/1.7B、MLX Whisper各種、標準Whisper)
AI要約生成1日3回無制限
文字起こし内容に対するAIチャット1日3回無制限
リアルタイム翻訳非対応対応
自動句読点挿入・補正対応対応
カスタムプロンプト非対応対応
エクスポート形式MD、TXTMD、TXT、SRT、VTT、DOCX、PDF
ファイル文字起こし対応対応
セッション履歴無制限無制限
許諾デバイス数該当なし最大3台
ライセンス範囲個人・非商用利用に限定個人・非商用利用に限定

ビジネス、チーム、または商用利用には、カスタム展開、優先サポート、専任オンボーディングを含むEnterpriseライセンスが必要です。

タグ

#on-device#offline#macOS#ASR#real-time#transcription#dictation#privacy#AI#summary

おすすめ

Guideflow

Guideflow

The AI demo automation platform for SaaS

1259
CyberCut AI

CyberCut AI

AI video studio for viral social clips

706
Incredible

Incredible

Deep Work AI Agents - powered by Agent MAX

653
Typeless

Typeless

AI voice dictation that's actually intelligent

625

AI Apps でアプリを無料で紹介

革新者のコミュニティに参加して、あなたの AI ツールを毎日何千人ものユーザーに届けましょう。

掲載を申し込む
DolphinVoice Console

BlogPage.PromoContent.title

BlogPage.PromoContent.description

BlogPage.PromoContent.cta