- Apple の研究チームは現在、Reference Resolution As Language Model(ReALM)と呼ばれる革新的な人工知能(AI)モデルを開発しています。
- このモデルは、文脈における言語を理解し、デバイス上で完全に機能するように設計されており、大きな計算能力を必要としません。
- 最近の研究論文は、この新しい AI モデルが Apple の内蔵音声アシスタントである Siri の機能を向上させる可能性があることを示唆しています。
Apple の研究者たちは、文脈言語を理解できるとされる Reference Resolution As Language Model(ReALM)と呼ばれる人工知能(AI)モデルに関する新しい論文を発表しました。
Resolution As Language Model
この AI モデルは ReALM と呼ばれ、Reference Resolution As Language Model の頭字語です。論文は、このモデルの主な焦点は、人間の話し方でより一般的な文脈的な言語的手がかりを用いてタスクを実行し完了することであると強調しています。
ReALM は、スマートデバイス上でタスクを実行するように設計されています。
これらのタスクは、画面上のエンティティ、会話エンティティ、バックグラウンドエンティティの 3 つのセグメントに分かれています。
研究論文で述べられているように、画面上のエンティティはデバイスの画面に表示されるタスクであり、会話エンティティはユーザーがリクエストした内容に基づき、バックグラウンドエンティティはアプリで音楽が再生されているようなバックグラウンドで発生するタスクです。
こちらもお読みください:MM1:Apple 初のマルチモーダル AI モデル
こちらもお読みください:Apple、WWDC 2024 で visionOS の進歩を発表へ
ChatGPT との比較
論文はまた、そのような制約のある環境で動作するにもかかわらず、この AI モデルは OpenAI の GPT-3.5 および GPT-4 を「大幅に」上回ると述べています。GPT-3.5 や GPT-4 のような大規模な LLM よりもはるかに少ないパラメータを使用します。
論文はさらに、このモデルはテキストのみのベンチマークテストで GPT-3.5 よりも高いスコアを獲得したが、ドメイン固有のユーザーディスコースでは GPT-4 を上回ったと述べています。
この論文は有望ですが、まだ査読を受けていないため、その有効性は不確かです。しかし、肯定的なレビューが得られれば、Apple はこのモデルを商品化し、Siri をより賢くするために使用する可能性があります。

