DolphinVoice からの最新ニュースとアップデート。
ピン留めDolphinVoiceは日本市場に特化し、音声認識と発音評価を中核に、日本企業・教育機関・多言語対応の現場へAPI、SaaS、スマートデバイスを提供します。

Whisperはなぜ無音区間で文全体を捏造するのでしょうか。APの調査報道とコーネル大学の研究をもとに、LLMデコーダーのハルシネーションの原因、四つの商用場面での代償、後処理では解決できない理由と、実践できる無音区間のテスト項目を解説します。

DolphinSOEのphoneme、word、sentence、chapter、誤り検出形式はどう選ぶべきか。評価粒度、時間上限、取得できるスコア、用途を比較して解説します。

OpenAI Whisper API と DolphinVoice API を、アーキテクチャ、リアルタイム・オフラインAPI料金、全込み TCO、ホットワード、話者区別、テキスト後処理、商用規模での検証まで比較します。

音声を送信してから多次元の発音スコアが返るまで、何が起こっているのか?DolphinSOE発音評価APIの処理フロー(収録・アライメント・スコアリング)を実際のレスポンス例とともに解説します。

同じ「リアルタイム音声認識API」でも、発話中に文字が出る方式と、文末まで待つ方式があります。返却タイミング・接続方式・中間結果から純粋ストリーミングと擬似ストリーミングを比較します。