音声入力/出力
当社の音声出入力機能は、シームレスな音声インタラクションを可能にし、ユーザーがテクノロジーとコミュニケーションする方法を変革します。正確な音声認識や、生き生きとしたTTSなど、、当社のソリューションは自然で直感的な音声エクスペリエンスを生み出します。
機能の統合により、車内での音声インタラクションの可能性を最大限に引き出し、シームレスな対話から直感的なリモートコントロールまで、ユーザーとクルマの間の自然なコミュニケーションを実現。
音声自動認識(ASR)
ASRは、音声をテキストに変換し、クラウド、オンデバイス、およびハイブリッド展開を提供し、業界を越えた汎用的な音声認識を可能にします。リアルタイムの精度に最適化され、42の言語をサポートし、単純なコマンドからAI 駆動のアシスタントまで、複雑なユースケースに適応します。
ユーザーのメリット
容易な音声インタラクション:多様なアクセントとダイナミックな語彙をシームレスに認識し、正確なコマンドを実現します。
信頼性の高いハンズフリー制御:ノイズの多い環境で動作し、システムが応答中の間に音声入力を可能にします。
情報への拡張したアクセス:リアルタイムのデータ検索、ナビゲーションの強化、エンターテインメント、デイリーアシスタンスのために、お気に入りのクラウドサービスと接続します。
OEMのメリット
スケーラブルな展開:小型の語彙セットアップから複雑な自動車アシスタント向けの統合まで、幅広いユースケースをサポートします。
業界のコンプライアンス:ユーザーデータを保護しながらGDPRの遵守を保証し、安全な音声インタラクションを提供します。
モビリティへの最適化:自動車・モバイル向けに設計し、車載用途にとどまらず高性能な音声認識を実現します。
車外インタラクション(EVI)
外部マイク配置のノウハウと音声AIの豊富な経験を融合させ、車の遠隔音声コントロールを可能にしました。これは、車両の設定された半径の周りに広がり、ユーザーの音声のみを識別するように設定され、起動前に特定のウェイクアップワードを聞き分けます。
ユーザーのメリット
利便性の向上:毎日の体験をより良いものにします。例えば手に食料雑貨がいっぱいの時や、雨が降る途中で家の中からサンルーフを閉める間に、ボイスコマンドでトランクを開放することができます。
車両の安全性の確保:ドライバーが自分のドアをロックしたり、自分の声だけでウィンドウを閉じたりできるようにし、車内の自分の所持品が安全であることを確認します。
支払い方法の簡素化:車内コマースシステムを利用して、ガソリンややコーヒーの支払いを認証し、車外の買い物でドライバーの決済を可能にします。
OEMのメリット
柔軟な導入: EVDで使用されるものを含め、さまざまな外部マイクのセットアップや設置構造と互換性があります。
競争力のある差別化:車外での新しい、ハンズフリーで便利なインタラクションを実現し、ドライバー体験を向上させます。
コスト効率:既存の音声インターフェースを拡張し、シンプルなソフトウェアアドオンまたはスタンドアロンモジュールとして機能するため、外部のモーションセンサーを追加する必要がありません。
音声起動
(ジャストトーク、ウェイクアップワード/オープンチャンネル)
当社の音声アクティベーション技術は、予めに定義されたカスタマイズ可能なウェイクアップワード、AIによるJust Talk、およびOpenChannelを通じて音声アシスタントとのシームレスなインタラクションを可能にします。これらのソリューションは、簡単にコントロールできるように設計され、さまざまな環境で正確な音声検出を保証しながら、マニュアルなアクティベーションを不要にします。
ユーザーのメリット
ハンズフリーの利便性:ボタンを押す代わりに音声でアシスタントを有効にすることができ、使いやすさが向上
よりスムーズなインタラクション:意図しない発話をフィルタリングしながら関連する発話を識別し、より効果的な音声アシスタントエンゲージメントを実現
OEMのメリット
カスタマイズ可能な設定:OEMは、自社のブランドに合わせた音声エクスペリエンスのカスタムアクティベーションワードを設定できます。
柔軟な統合:適応可能な展開で、組込みAIおよび大規模言語モデル(LLM)ベースのシステムをサポートします。
プライバシーを優先したアプローチ:Android SoundTrigger HAL のサポートを含むコンプライアンスを保証し、フリクションのない音声エクスペリエンスを提供しながら、データ保護ルールを提供します。
TTS
TTSは、書かれたテキストを自然で表現的で感情的な音声出力に変換し、シームレスなブランド統合のために、複数の言語とカスタマイズをサポートする機能です。クラウドプラットフォームと組込みプラットフォームにまたがる実装オプションにより、リアルタイムなアシスタント、スマートデバイス、およびアクセシビリティツールの音声インタラクションを65以上の言語で実現します。
ユーザーのメリット
拡張されたアクセシビリティ:明確で表現力豊かな音声出力で、デジタルコンテンツをより包括的に実現
安全なハンズフリーインタラクション:車内音声アシスタントの配備を可能にし、気を散らす運転を減らすなど、ユーザーが他の事柄に焦点を当てている状況を最適化
OEMのメリット
カスタマイズ可能な音声:多様な声、感情、読み方をサポートし、パーソナライズされたブランド豊かな体験を実現
柔軟な統合:プラットフォーム間でスムーズに実装するために、Cerence Speech Service およびSDK と完全な互換性を持つ、ハイブリッドなTTS ソリューションをサポート
コンプライアンスに対応:GDPRおよび欧州アクセシビリティ法のグローバルスケーラビリティ要件を満たした設計