Improved dictation in ChatGPT
OpenAIはChatGPTの音声入力に新しい音声認識モデルを展開しました。
全プラン対象の裏側の更新で、日本語を含む複数言語・アクセント・騒音環境での文字起こし精度を改善しています。
対象はChatGPTのdictation機能で、使い方の変更はありません。
評価では、主要テスト言語で前の本番モデルより単語誤り率が少なくとも10%低下したとされています。
日本語、韓国語、中国語、ウルドゥー語、ベトナム語、アクセント付き英語、長文のスペイン語・フランス語・イタリア語・ポルトガル語で改善が示されています。
騒がしい公共空間や職場、ささやき声、文字と数字の組み合わせにも強くなっています。
全プラン対象の製品品質改善であり、API変更や移行期限はありません。