TOOLDAQ AI
← AI News|AIニュース
TOPICS時事

Google、音声認識特化の Gemini 3.5 Transcribe を公開

Google、音声認識特化の Gemini 3.5 Transcribe を公開

Googleが音声認識に特化したモデル「Gemini 3.5 Transcribe」を公開しました。公式ブログは8月26日付です。音声をそのまま整形済みのテキストに変換するもので、単語誤り率は非ストリーミングで平均2.6%、ストリーミングで平均4.0%としています。最終的な文字起こしが確定するまでの時間は、従来モデルから70%改善したと説明しています。85を超える言語を自動で判別して書き起こし、収録済み音声では3人までの話者をタイムスタンプ付きで区別します。提供先はGoogle AI Studio、Google Antigravity、AndroidのGboard、macOS版Geminiアプリで、Chromeは近日対応とされています。料金の記載はありません。議事録や取材の書き起こしを外部のサービスに任せている場合、精度と待ち時間の両方が乗り換えの判断材料になります。

Related Tickers

関連銘柄

Market Alert

市況・急上昇・格付け変更を毎週まとめてメールでお届けします。

  • 週次: 市況サマリ・急上昇/急落・格付け変更
  • 審査割れ速報: 3社AIの判定が分裂したとき
  • 価格改定アラート: 値上げ・値下げの検知

本記事は公開情報に基づく当サイトの編集記録であり、掲載時点の内容です。指数・格付けは株式市場になぞらえた独自指標で、実在の株式・株価とは一切関係なく、投資への助言ではありません。各社の現行の価格・仕様は公式サイトをご確認ください。