NEWS
OpenAI、GPT-4o を発表——音声・画像・テキストを一つのモデルで
OpenAI がマルチモーダルモデル GPT-4o を発表。音声・画像・テキストを単一モデルで処理し、応答速度と日本語性能が大きく向上しました。
OpenAI が、新しいフラッグシップモデル「GPT-4o」を発表しました。
「o」は omni(全方位)の意味で、テキスト・音声・画像を一つのモデルでまとめて扱えるのが特徴です。
応答速度は GPT-4 Turbo の約 2 倍、API 価格は半分。
人間の会話に近いテンポで音声のやり取りができるデモも公開され、大きな話題になりました。
日本語を含む多言語の処理性能も向上しています。
速さと賢さの両立という点で、日々の運用に組み込みやすいモデルだと感じます。