評価プロセスの先行事例:分野横断の比較
評価という営みが、いま構造的に揺らいでいます
第3回では、視点を変えて、実際に異なる分野がAI時代の評価プロセスにどう対応してきたかを横断的に比較します。分野ごとに個別最適化されたルールの背後にある、共通の設計原則を見つけることが狙いです。
この記事でわかること
- 文学賞に見る6区分のAI利用規定
- 学術出版における3類型と国際団体の4原則
- 定義の精度で参考になる2つのモデル
- 「プロセス評価」という発想がなぜ限界を持つのか
文学賞:6つの規定パターン
日本の主要文学賞22件超の生成AI条項は、次の6区分に収斂しています(AI teller、2026年9月時点)。
| 区分 | 内容 | 代表例 |
|---|---|---|
| ①受付 | AI生成作品も受付 | 星新一賞、創元SF短編賞 |
| ②申告のみ | 利用範囲を限定せず申告のみ | ハヤカワSFコンテスト、文藝賞 |
| ③限定+申告 | 補助的利用に限定し申告を要求 | 江戸川乱歩賞、電撃小説大賞(22件中8件) |
| ④最終確認 | 最終候補段階で確認 | 群像新人文学賞、新潮新人賞 |
| ⑤対象外 | AI使用・AI執筆は対象外 | 警察小説新人賞、アルファポリス |
| ⑥記載なし | 募集要項に記載なし | ファンタジア大賞など |
学術出版:3類型と国際4原則
学術出版はさらに体系的な3類型に整理されています。Science(AAAS)の禁止型、Elsevier・Springer Nature・Wiley・SAGEなど大手出版社が採る開示必須の許容型、Emeraldのような用途別条件付き型です。STM・COPE・WAME・ICMJEのガイドラインは、開示・透明性・人間の説明責任・AIへの著作者性付与の禁止という4原則で概ね一致しています。
いずれの分野でも共通しているのは、規定そのものの精緻化は進んでいても、それが実際に機能しているかどうかの検証は別問題として残っているという点です。第1回で見た「AI利用ポリシー導入率約70%に対し、実際の開示率は約0.1%」というギャップは、規定の存在と実効性が別物であることを端的に示しています。
定義の精度で参考になる2モデル
小説投稿サイト「小説家になろう」は、AI利用を「直接使用」「間接利用」「補助的利用」「不使用」の4段階に区分し、「誰が最終編集の主体だったか」を軸にした定義を採用しています。これは、生成物のどこまでが人間の創作的関与によるものかを切り分ける、実務的に応用範囲の広い枠組みです。
米国ロマンス作家協会(RWA)は「AI-assisted」と「AI-generated」を明確に区別したうえで、違反が疑われる場合に専門の審査委員会が調査し、当事者に不服申立ての機会を与える手続きを制度化しています。事後統制の仕組みを規定に組み込むという発想は、査読や助成金審査のような他の評価プロセスにも転用可能です。
プロセス評価という発想の限界
デザイン分野では、グッドデザイン賞が「人を中心に考え、目的を見出し、それを実現する一連のプロセス」そのものをデザインと定義し、成果物だけでなくその解に至った思想・思考・方法論を評価する哲学を1957年の前身制度以来採用しています。
しかし、生成AIはもっともらしい開発ストーリーを後付けで生成することを既に得意としており、プロセスの言語化自体をクローズアップして評価基準に据えても、提出者本人がAIに語らせた説明と実際の思考過程を評価者が区別する手段がありません。プロセス評価は、目利きの検証困難性という問題に形を変えて回帰してしまいます。この限界は、査読における「研究の動機や意義の説明」を重視する評価にも同様に当てはまります。
ここまでの分野横断の知見を踏まえ、評価プロセスの目的そのものを再定義し、メタ評価という発想がどう応えるかを提示します。
参考文献
本シリーズ5回分を通読形式に統合した完全版レポートを公開しています。知の重荷の整理からメタ評価という解、開示・権利設計まで、まとめてご覧いただけます。
→ AI時代の評価プロセスと、メタ評価という解(完全版レポートを読む)
