OpenAIが音声認識モデル「Whisper」をオープンソースで公開した。Webから収集した68万時間の多言語・マルチタスクの教師ありデータで学習したエンコーダ・デコーダ型Transformerで、英語音声認識で人間に近い頑健性と精度に到達。多言語の文字起こしと英語への翻訳にも対応する。商用API中心の路線を取っていた同社がモデルと推論コードを公開した点でも注目された。