#音声AI
このタグが付いた記事
Index
count=4- AI / ML
Alibaba、Qwen-Audio-3.1 を公開 音声 API を最大 95% 値下げ
ASR / TTS / Realtime に加え、話者分離と環境音認識の ASR-Next、音声と効果音を一括生成する TTS-Next を追加。ASR は最大 95%、Realtime は約 85%、TTS は約 70% 値下げ。
- AI / ML
xAI Grok Bot、音声モードをデスクトップ・モバイルに展開
SpaceXAI が Grok Bot の音声モードをデスクトップとモバイルに順次展開開始。指示・確認をハンズフリーで行える運用を狙い、既存の Grok Voice Think Fast 2.0 と同じ音声基盤を利用します。
- AI / ML
OpenAI「GPT-Live」7月8日ローンチ ⇒ 全二重・聞きながら話す音声モデル、ChatGPT に即時展開
OpenAI は 7月8日、「聞きながら話す」フルデュプレックス構造の新音声モデル GPT-Live-1 / GPT-Live-1 mini を公開しました。同日から ChatGPT ユーザー向けに世界展開を開始し、既存の Advanced Voice Mode は mini へ切替。裏側では GPT-5.5 を呼び出して検索や推論も委譲します。GPT-5.6 Sol 一般公開の前日リリースとなります。
- AI / ML
ElevenLabs と NTT ドコモビジネス、音声 AI でコンタクトセンター協業 docomo business ANCAR と統合
音声 AI の ElevenLabs (日本法人イレブンラボ) と NTT ドコモビジネスは 6月29日、自然な音声 AI を用いたコンタクトセンター応対の実現に向けた協業を開始。NTT ドコモ・ベンチャーズによる出資を背景に、ドコモ・ファイナンスで実証実験中です。