Logo
ログイン
Logo

最も開発者にフォーカスした音声AIプラットフォーム

ISO 27001
ISO 27001
SOC 2
SOC 2
SSL/TLS
SSL/TLS
APPI
APPI
プロダクト
  • リアルタイム音声認識
  • 録音ファイル書き起こし
  • 音声合成
  • 発音評価
  • DolphinTeams デュアルスクリーン端末
  • Tralingo AI翻訳機
  • NihongoScore
リソース
  • ドキュメント
  • ブログ
  • AI アプリ
  • オンライン体験
会社
  • 会社情報
  • お問い合わせ
  • クライアント
法務
  • プライバシーポリシー
  • 利用規約
  • サービスレベル合意(SLA)
  • 特定商取引法に基づく表記
  • DolphinTeams ユーザーマニュアル
© 2026 DolphinVoice All Rights Reserved.
製品Voca
Voca

Voca

Speak to code. AI-powered dictation for developers.

3 投票ウェブサイトを訪問
Voca Screenshot
Voca Preview
ウェブサイトを訪問

Vocaの紹介

Vocaは、開発者および技術専門家を対象としたデスクトップ音声認識アプリケーションです。一般的な音声変換ツールが抱える課題——特に「React」や「navbar」などの技術用語を正確に解釈できない点——に対処するために設計されています。開発者のワークフローに最適化されており、リアルタイムのAIによる修正機能を直接入力環境に統合することで、コーディング、ドキュメンテーション、コミュニケーション中のコンテキスト切り替えを最小限に抑え、集中力を維持します。

アプリケーションはローカルまたはユーザーが提供したAPIキー経由で音声を処理し、プライバシーとデータ管理を確保します。WindowsおよびmacOSに対応しており、MITライセンスのもとオープンソースで公開されています。Vocaはクラウド専用サービスではなく、可能な限りローカルでの動作を可能にするとともに、ユーザー自身が音声処理パイプラインを完全に制御できるよう設計されています。

主なポイント

  • Gemini 2.0 Flashを用いたリアルタイムAI補正により、発音ミスや技術用語(例:「reakt」→「React」、「nahbar」→「navbar」)を自動修正
  • Deepgram Nova-3およびGroq Whisperの2種類の音声認識エンジンをサポート。35以上の言語を自動検出可能
  • 100以上の言語への文脈を考慮した翻訳機能。トーンモード(開発者モード、パーソナルモード)を選択でき、技術用語は英語のまま保持
  • 数値アドオン:話された数(例:「twenty-five」)を数字(例:「25」)に自動変換
  • プランニングアドオン:口頭で指示された手順を整形式のリスト(例:ステップバイステップのタスク)に変換
  • 完全オープンソース(MITライセンス)。音声はユーザーが管理するAPIキー経由でのみ処理され、第三者によるデータ収集・保存は一切行われない
  • グローバルキーショートカットで録音開始、AI補正、カーソル位置への自動貼り付けを一連の操作で実行可能。アプリケーションの切り替え不要

Vocaの仕組み

Vocaは軽量なデスクトップエージェントとして動作します。設定されたグローバルショートカットで起動すると、音声の入力を開始し、選択された音声認識エンジン(Deepgram Nova-3またはGroq Whisper)へ音声データを送信します。得られた文字起こし結果は、Gemini 2.0 Flashを活用したAIレイヤーを経て、文法・構文およびソフトウェア開発に関連する専門用語の補正が行われます。補正後のテキストは、ユーザーの現在のカーソル位置に自動的に貼り付けられます。

必要に応じて、貼り付け前に翻訳を有効化できます。フォーマル、カジュアル、開発者モードから選択でき、開発者モードでは技術用語が英語のまま維持され、周囲の文章のみが翻訳されます。その他のアドオン機能として、数値変換およびリスト生成が利用可能です。すべての処理はユーザーのプライバシーを尊重しており、音声データはVocaのサーバーには保存・送信されず、ユーザーが管理するAPIキー経由でのみ処理されます。

主な利点と用途

Vocaは、コードコメントの記述、技術ドキュメントの作成、技術メールやSlackメッセージの作成、イシュー登録やプルリクエスト説明文の作成など、開発者が日常的に行う反復的なテキスト入力作業を効率化します。技術用語に対する正確な認識能力により、手動での編集時間を削減し、書かれた内容の一貫性を向上させます。翻訳機能は多言語チームを支援し、ローカライズされたドキュメントやユーザ向けコンテンツのリアルタイム作成を可能にします。IDE、エディタ、ブラウザ、コラボレーションツールなど既存のツールチェーン内で完結するため、コピー&ペーストやタブ切り替えを必要とせず、自然に統合されます。また、オープンソースでありローカル優先のアーキテクチャであるため、データ所在や透明性が求められる規制対応やセキュリティ要件の厳しい環境でも利用可能です。

プラン月額料金含まれるクレジット最大録音サイズ機能
Pro$3$310 MB全音声認識エンジン、翻訳、トーンモード、数値・プランニングアドオン
Max$10$1025 MBProと同じ機能に加え、より大きなファイルサイズ対応

両プランとも全機能が利用可能であり、機能制限はありません。

タグ

#AI Voice Recognition#Developer Productivity#Open Source#Voice to Text#Code Assistant#Real-Time Correction#Translation Tool#Keyboard Shortcuts#Privacy-Focused#Affordable Software

おすすめ

Guideflow

Guideflow

The AI demo automation platform for SaaS

1259
CyberCut AI

CyberCut AI

AI video studio for viral social clips

706
Incredible

Incredible

Deep Work AI Agents - powered by Agent MAX

653
Typeless

Typeless

AI voice dictation that's actually intelligent

625

AI Apps でアプリを無料で紹介

革新者のコミュニティに参加して、あなたの AI ツールを毎日何千人ものユーザーに届けましょう。

掲載を申し込む
DolphinVoice Console

BlogPage.PromoContent.title

BlogPage.PromoContent.description

BlogPage.PromoContent.cta