• テキスト透かし手法は、ChatGPT が単語を選択する方法に小さな変更を加え、文章内に不可視の透かしを作成し、後で別のツールによって検出できるようにするものです。
  • OpenAI は、テキスト透かしの潜在的な悪影響について慎重であり、特に悪意ある行為者による回避の脆弱性や、非英語話者など特定のグループに不均衡な影響を与える可能性を挙げています。

当社の見解
OpenAI のテキスト透かし手法は、ChatGPT による文章生成の検出に焦点を当てることで、潜在的な不正コンテンツを特定するための的を絞ったアプローチを提供し、この問題の解決に重要な役割を果たします。しかし、この手法は、悪意ある行為者による回避の脆弱性や、非英語話者などの特定のグループに不均衡な影響を与える可能性についても、重要な考慮事項を提起しています。

-Lia XU、BTW レポーター

経緯

The Wall Street Journalによると、OpenAI はテキスト透かし手法を開発し、AI 生成テキストを検出することで、特に ChatGPT を使って課題を書く不正学生の検出に焦点を当てています。この手法は、ChatGPT の単語選択方法に微妙な変更を加え、文章内に不可視の透かしを作成し、後で別のツールで検出できるようにするものです。

しかし、OpenAI の広報担当者は次のように述べました。「複雑さと、OpenAI 外のより広範なエコシステムへの影響が予想されるため、慎重なアプローチを取っています。悪意ある行為者による回避の脆弱性や、非英語話者などのグループへの不均衡な影響を含む重大なリスクを評価しつつ、代替案を模索しているからです。」

OpenAI はまた、ブログを更新し、テキスト透かしは一部の AI 生成コンテンツをうまく検出できるものの、悪意ある行為者によって容易に回避される可能性があり、非ネイティブスピーカーが AI を有益な文章作成ツールとして使用するのを阻害する可能性があると指摘しました。

関連記事:米政府の安全審査を受ける OpenAI の次期モデル

関連記事:AI の未来を形作る法案を支持する OpenAI

重要性

このテキスト透かし手法は、学生が課題で AI を使って不正を行う事例を特定することで、教育機関が学術的誠実性を維持するのに役立ちます。学術的不正を抑止し、公正な評価慣行を促進することができます。ChatGPT の文章のみを検出することに焦点を当てることで、他の手法と差別化され、AI 生成テキストのより正確な識別が保証されます。このターゲットアプローチにより、潜在的な不正事例を検出するツールの有効性が向上します。

しかし、倫理的な導入のためには、悪意ある行為者による回避のリスクや非英語話者などの特定のユーザーグループへの潜在的な影響を考慮することも極めて重要です。導入にあたってはバランスの取れたアプローチを模索する必要があります。OpenAI がテキスト透かし手法に関連するリスクを調査し検討する慎重な戦略は、責任ある AI 技術の開発への取り組みを示しています。この影響力により、ツールの導入が倫理基準に適合し、様々なユーザーグループやエコシステムへの悪影響が最小限に抑えられます。