エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
Google、音声認識モデル「Gemini 3.5 Transcribe」を公開
記事へのコメント0件
- 注目コメント
- 新着コメント
このエントリーにコメントしてみましょう。
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
Google、音声認識モデル「Gemini 3.5 Transcribe」を公開
Googleは8月26日(現地時間)、次世代音声認識モデル「Gemini 3.5 Transcribe」の提供を開始したと発表... Googleは8月26日(現地時間)、次世代音声認識モデル「Gemini 3.5 Transcribe」の提供を開始したと発表した。従来の音声認識モデルでは難しかった背景ノイズや専門用語、話者の言い間違いにも強く、会話音声をそのまま正確かつ自然なテキストへリアルタイムで変換できる点が特徴だ。 Gemini 3.5 Transcribeは、GeminiアプリやAndroidで既に展開されている音声機能として活用されてきた。今後はGoogle AI StudioおよびGemini Enterprise Agent PlatformのAPIとしても利用可能になり、開発者は独自のボイスエージェントやリアルタイム字幕生成ツール、通話後分析パイプラインなどに容易に組み込める。 同モデルは、「リアルタイムストリーミング(Live API)」と「録音音声処理(Interactions API)」の2種類の

