ChatGPT の開発元である OpenAI は、最新の GPT-4 モデルに失望している業界専門家たちから強い反発を受けています。
ChatGPT の開発元である OpenAI は、最新の GPT-4 モデルに失望している業界専門家たちから強い反発を
受けています。
以前はその速度で称賛されていたものの、最近の AI モデルバージョンは、認識される弱点、怠惰、知性の欠如のために広く批判されています。にもかかわらずOpenAI の初期の主張
、ユーザーはこのモデルに対して不満を表明しており、前世代と比較して劣っていると見なしています。
多くのユーザーが Twitter やオンラインフォーラムで、GPT-
4 の期待外れのパフォーマンスについて懸念を表明しています。誤った回答、入力データの追跡が失われるように見えること、指示に従うことの難しさなどの事例が報告されています。ソフトウェアコードに大括弧を含めるという単純なタスクでさえ、AI モデルにとっては困難であることが示されています。本質的に、GPT-4 は最近生成されたプロンプトを単に繰り返すだけに留まっているようです。
ある開発者によれば、GPT-4 の現状は非常に期待外れで、ウェブサイトにコード機能を追加するのに信頼できないとのことです。かつての高級車が古い車に変えられてしまったようだと例え、その開発者はこのようなサービスには決してお金を払わないと断言しました。
より速くなったが、有用性は低下?
別のユーザーは、結果の生成が速くなったにもかかわらず、品質が低下しているという問題を強調しました
。文章の明瞭さを向上させたり、アイデアを生成するといった基本的なクエリでさえ、困難なタスクとなっています。品質の低下は、モデルの有用性に対する懸念を引き起こしています。
観測者たちは、AI モデルが無秩序にループする結果を生成する傾向に気付いており、それが
かつての有用性を失ったという結論に至っています。この事実は、AI が短期間で達成した大幅な進歩と人気を考えると
特に衝撃的です。
専門家たちはまた、GPT-4 の根本的な再設計が、そのパフォーマンス低下の理由である可能性を示唆しています
。以前はその精度と高コストで知られていましたが、より高速だが精度が低い結果へのモデルの移行は、多くの人を失望させました。
3 月の大型 GPT-4 のリリースは、テクノロジー分野で非常に期待されていました。その
マルチモーダル機能は、テキストと画像の両方の理解を可能にし、さらに期待を高めました
。しかし、そのようなモデルは開発者の間で長期的に好まれ続けるとは限らないようです。
コスト削減が品質低下につながる可能性
業界関係者は、OpenAI が MoE(専門家の混合)アプローチを模索しているのではないかと推測しています
。これは、より小型の GPT-4 モデルがさまざまな専門分野に特化するというものです。この
アプローチは、品質を維持しながらコストを削減することを目指しています。しかし、この新しいシステムへの移行が
GPT-4 のパフォーマンスに影響を与え、ユーザーを不満にさせているようです。
OpenAI はまだこれらの懸念に対して公式な回答を提供していません。GPT-4 のアーキテクチャに関するリーク情報が
オンラインで出回る中、同社がユーザーや専門家から提起された問題にどのように対処するかは
まだわかりません。
まとめ
OpenAI の非常に期待された GPT-4 モデルは、パフォーマンスの低下と弱体化した論理により批判に直面しています
。ユーザーはその精度、信頼性、指示に従う能力に失望を表明しています
。根本的な再設計と専門家混合アプローチの採用がこれらの問題を引き起こした可能性がありますが
、この状況に対する OpenAI の対応は依然として不明です。GPT-4 の将来と、開発者の間での立ち位置は
現時点では不透明です。
会員向け解説
トレンドの深掘り
適切な会員レベルでログインすると、解説全文と出典メモをご覧いただけます。
Strategic Circle 限定
Strategic Circle
すべての読者に公開されています。参加してログインすると トレンド解説 を閲覧できます。
Strategic Circle に参加Leadership Alliance 会員限定
Leadership Alliance
関係性の裏付け、障害経路、情報源メモを必要とする通信事業者、投資家、政策チーム向けです。ログインするとご覧いただけます。
Leadership Alliance に参加スナップショット
カテゴリー
グローバルのクラウドサービストレンド地域
グローバルシグナルに注目
業界・市場コンテンツ種別
イベント主要領域
業界・市場トピック
業界・市場影響
中信頼度
限定的な確信度 (72%)信頼度スコアガイド
複数の公開情報源

