- レディング大学の研究によると、AI が生成した試験回答が実際の学生の回答をしばしば上回る。
- 中国では、AI モデルが全国試験の国語科目で良い成績を収めたが、数学では苦戦し、AI の微細な言語理解や抽象的推論の限界が浮き彫りになった。
我々の見解
最近の研究は、AI が実際の学生を試験で上回ることを示し、従来の評価方法の欠陥を露呈している。AI は言語で優れているが、数学や抽象的推論では苦戦する。これは、教育者が評価戦略を再考し、教育の誠実性を維持するために AI の影響を受けた世界に適応する必要性を浮き彫りにする。
–BTW レポーター、Jasmine Zhang
何が起きたのか
最近のレディング大学の研究により、AI が生成した試験回答が実際の学生の回答をしばしば上回ることが明らかになり、学術的誠実性に対する重大な懸念が生じている。
研究者らは AI ツールのChatGPTを使用して、心理学の学士課程の学生を装った回答を作成し、これらの AI エッセイがほとんど検出不可能で、疑念を抱かれたのはわずか 6%に過ぎないことを発見した。この結果は、検出されない不正行為の可能性を浮き彫りにし、評価方法の早急な改革を求めている。
同様の懸念が中国でも聞かれ、全国大学入試で AI モデルが評価された。AI は国語と英語で好成績を収めたが、数学では苦戦し、混乱を招く誤った回答を生成した。これは、AI が微細な言語と抽象的推論を理解する上での限界を示している。
両方の研究は類似しているが、結果は異なっていた。これは、両国の教育制度の違い、AI のレベル、実施された試験の種類の違いによる可能性がある。
両方の研究は、世界中の教育機関が AI の増大する影響力に適応し、AI 支援による不正を検出・軽減できる公正で堅牢な評価システムを確保する必要性を示している。
あわせて読みたい:製造業者、精度への懸念から生成 AI の導入を延期
あわせて読みたい:シンガポール大臣、「混沌とした」未来を避けるため AI フレームワークを求める
なぜ重要なのか
AI が大学生の試験で実際の学生を上回る可能性があることを明らかにした最近の研究は、教育システム全体への警鐘である。これは単なる学術的不正に留まらず、教育の未来に関わる問題だ。
ほぼ検出不可能で高得点の試験回答を生成する AI の能力は、我々の評価方法の欠陥を露呈している。我々は本当に学生の知識を測定しているのか、それとも無意識に彼らの技術力を評価しているのか?
さらに、中国の高校 AI 試験結果は、AI が言語では卓越している一方で、数学と抽象的推論では失敗することを示した。
この二面性は、教育における AI の可能性と限界の両方を浮き彫りにする。教育者が従来の評価方法を再考し、AI の影響を受ける世界に適応する時が来ている。おそらく、より抽象的な評価が将来には適しているだろう。
AI の能力を受け入れつつ、不正使用を検出・防止する堅牢なシステムを確保することが重要になる。教育の誠実性が問われており、我々の対応が学習の未来を形作るだろう。

