tag

#音声AI

このタグが付いた記事

Index

count=4
  1. AI / ML

    Alibaba、Qwen-Audio-3.1 を公開 音声 API を最大 95% 値下げ

    ASR / TTS / Realtime に加え、話者分離と環境音認識の ASR-Next、音声と効果音を一括生成する TTS-Next を追加。ASR は最大 95%、Realtime は約 85%、TTS は約 70% 値下げ。

    the-decoder.com ↗
  2. AI / ML

    xAI Grok Bot、音声モードをデスクトップ・モバイルに展開

    SpaceXAI が Grok Bot の音声モードをデスクトップとモバイルに順次展開開始。指示・確認をハンズフリーで行える運用を狙い、既存の Grok Voice Think Fast 2.0 と同じ音声基盤を利用します。

    teslanorth.com ↗
  3. AI / ML

    OpenAI「GPT-Live」7月8日ローンチ ⇒ 全二重・聞きながら話す音声モデル、ChatGPT に即時展開

    OpenAI は 7月8日、「聞きながら話す」フルデュプレックス構造の新音声モデル GPT-Live-1 / GPT-Live-1 mini を公開しました。同日から ChatGPT ユーザー向けに世界展開を開始し、既存の Advanced Voice Mode は mini へ切替。裏側では GPT-5.5 を呼び出して検索や推論も委譲します。GPT-5.6 Sol 一般公開の前日リリースとなります。

    openai.com ↗
  4. AI / ML

    ElevenLabs と NTT ドコモビジネス、音声 AI でコンタクトセンター協業 docomo business ANCAR と統合

    音声 AI の ElevenLabs (日本法人イレブンラボ) と NTT ドコモビジネスは 6月29日、自然な音声 AI を用いたコンタクトセンター応対の実現に向けた協業を開始。NTT ドコモ・ベンチャーズによる出資を背景に、ドコモ・ファイナンスで実証実験中です。

    kyodo.co.jp ↗