一般的な会話では、どうしても「えーと」や「あー」といった言いよどみが発生する。しかし、それがそのまま文字起こしされるとちょっとカッコ悪い。Googleが8月26日にリリースした最新音声認識モデル「Gemini 3.5 Transcribe」でこれが解決しそうだ。言いよどみだけでなく、背景雑音や専門用語、発話中の言い直しなどに対する補正能力を備え、生の音声を即座に整え、フォーマット済みテキストへ直接変換する。
アンソロピック、評価額141兆円でOpenAI超えへ──人類史上最大の資金調達ラウンド(Forbes JAPAN) - Yahoo!ニュース
株式会社旭東トレーディングLexar、最大14,000MB/sのPCIe 5.0対応M.2 NVMe SSD「NM990」「Professional NM1090 PRO」を日本発売
ORM が引き受けている責務を分解してみる | ashunar0
【速報】OpenAI社長「すまん、今日出すGPT6でAGIに到達したわw」
無料でPDF・電子書籍・Word文書・テキストファイルなどからローカルAIを使って検索&要約ができる「DocuBrowser」、個人情報の認識も可能
まだコメントはありません。
コメントを送信しました。