The Verge AIメディア報道·2026年8月27日 02:00·約2分
Google、Gemini Audio に新モデル導入し自動文字起こし機能を強化
本文の状態
日本語全文あり
詳細モードで約2分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Verge AI
30秒でわかる
Google は音声制御 AI の精度向上を目的とした「Gemini 3.5 Transcribe」を発表し、自動的なフィラーワード除去や多言語対応、カスタム辞書機能を搭載した。
記事の3ポイント
新モデルの発表と機能
Google は「Gemini 3.5 Live」「3.5 Live Experimental」「3.5 Transcribe」の新しいモデルを発表し、背景ノイズや話の中断にも強い高精度な音声認識を実現した。
フィラーワードの自動除去
Gemini 3.5 Transcribe は「um」や「ah」といったフィラーワードを自動的に検出し、編集を行う機能を提供し、自然な音声によるテキスト編集を可能にする。
カスタム辞書と専門用語対応
ユーザーは独自の語彙をモデルに提供でき、特定のスペル要件や専門用語を自動的に認識・保持させることで、手動での修正作業を削減できる。
なぜ重要か・誰に関係するか
この発表が重要なのは、音声認識技術における誤変換や不要語の除去という実用課題を AI が自律的に解決できる点にある。開発者や企業の AI 導入担当者は、多言語対応とカスタム辞書機能を活用することで、議事録作成やデータ入力業務の自動化効率を大幅に向上させる判断材料を得る必要がある。
背景や根拠まで確認しますか?
元記事の内容を、読みやすい日本語で続けて確認できます。
この記事をシェア
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み