- サンフランシスコに拠点を置く企業 Writer が開発した新機能 Palmyra-Vision は、画像、グラフ、図表から AI によるテキスト生成を提供します。
- 革新的な Palmyra-Vision は、CEO の May Habib 氏が強調するように、複数モデル手法を用い、驚異的な精度を実現しています。
- Habib 氏は、こうしたツール使用時の人間の監督の重要性を強調しています。
サンフランシスコの Writer という企業は、生成 AI ライティングツールを開発しています。同社は本日、自社の Palmyra モデル向けの新機能 Palmyra-Vision を発表しました。この機能により、グラフや図表を含む画像からテキストを生成できます。
Palmyra-Vision のテキスト生成 AI
Palmyra-Vision は、複数モデル手法を用い、各モデルに画像の内容を特定する特定のタスクを割り当てた上で、4 ナイン(99.99%)の精度でテキストを生成します。
同社の CEO 兼共同創設者である May Habib 氏は、写真からテキストを生成する能力を含め、マルチモーダルコンテンツに重点を置くという戦略的選択について語ります。
「当社はマルチモーダル入力に注力しますが、出力はテキスト、つまりテキスト生成とテキストによる情報提供に重点を置きます」と、Habib 氏は述べています。
この技術には、グラフや図表から重要な情報を自動的に把握し、最新製品情報でサイトを更新するテキストを生成できる e コマースサイトなど、さまざまな応用が考えられます。
コンプライアンスチェックも別の例です。たとえば製薬会社は、Palmyra-Vision を使用して広告コンテンツが FDA 基準に準拠しているか自動的に検証できます。
あわせて読みたい:Twitter と Tesla の元エンジニアが AI ニュースリーダーParticle を発表
Habib 氏、人間の監督の重要性を強調
Habib 氏によると、ワークフローの一部として人間によるレビューなしでこれらのツールを使用することは推奨されません。彼女は、どのモデルも事実を誇張したり歪曲したりする可能性があるため、誰かが結果を検証することが不可欠だと考えています。
同社、クラウドプラットフォームとの協業を検討
Crunchbase の統計によると、同社はこれまでに 1 億 2600 万ドルを調達しています。事業拡大を目指す中で、現在主要なクラウドインフラプラットフォームとの提携交渉を行っています。
昨年 9 月には、Iconiq 主導で 1 億ドルのシリーズ B ラウンドを完了しました。

