OpenAIは最新のGPT-4oを発表しました。これは、ChatGPTを支えるGPT-4言語モデルの大幅なアップグレードです。この新しいバージョン「O」は「omni(全方位)」を意味し、速度の向上と、テキスト、ビジョン、オーディオを処理できる能力が大幅に強化されています。

これは基本機能を備えた無料プランがあり、有料オプションでは容量が5倍になります。展開は段階的に行われ、テキストと画像機能はまずChatGPTで利用可能になります。
GPT-4o の主なハイライトは「ネイティブマルチモーダリティ」にあります。ユーザーはテキスト、画像、動画、さらには音声コマンドを通じて操作でき、将来の ChatGPT バージョンにおける高度な音声アシスタント体験への道を開きます。

「OpenAIは公式ウェブページで、『音声入力に対して最短で232ミリ秒、平均で320ミリ秒で応答でき、人間の会話における反応時間と似ている』と述べました。
この短いデモはOpenAIのTikTokアカウントからのもので、ChatGPTアプリがiPhoneのカメラを通じて従業員の周囲を正しく理解できることを示しています。
さらに、OpenAIはデスクトップアプリのChatGPT for Macをリリースし、今年後半にWindowsバージョンを提供する予定です。展開は月曜日に開始され、まずChatGPT Plus加入者に提供され、数週間以内により広範なリリースが行われます。
OpenAI の GPT-4o のフルデモでは、ChatGPT がコードの全体的なチェーンを理解し、コンピュータ画面へのアクセスが与えられたときにグラフも理解できました。

これらすべては、Mac上でChatGPTと直接会話できるVoice Modeを使用しています。
このニュースは、OpenAIがAppleとiPhoneにChatGPTを統合するという契約を結んだとする以前の報告の直後に出ました。iOS 18が優先されます。
0 Comments
Leave a Reply