OpenAIが回答前に時間をかけて「考える」推論モデルOpenAI o1のプレビュー版o1-previewとo1-miniを公開した。強化学習で思考の連鎖(chain of thought)を磨くよう訓練され、推論時により多くの計算を使うことで、数学・コーディング・科学の難問でGPT-4oを大きく上回る性能を示した。学習の規模だけでなく、推論に使う時間を増やすことでも性能が伸びると示した点が、当時としては新しかった。