メタ評価エンジンMeta-Evaluation Engine
「評価を、評価する」——eval000 は評価プロセスそのものを数学的に再設計します。
外生の原理 N × Evaluation Rubric × SEGT 収束で、Noise 0 · Bias 0 · Error 0 を実現します。"Evaluating evaluation itself" — eval000 mathematically redesigns the evaluation process.
External Principle N × Evaluation Rubric × SEGT convergence achieves Noise 0 · Bias 0 · Error 0.
The Problem
評価の「現実」——ノイズ・バイアス・誤差・知識情報の限界という構造的問題The Reality of Evaluation — Noise, Bias, Error & Knowledge Limits
コンテスト審査・人事評価・調達判断——評価はあらゆる意思決定の核心にあります。しかし現状の評価プロセスには、審査員を増やしても・ルーブリックを精緻化しても・生成AIに採点させても解決できない、構造的な問題が4つ存在します。Contest judging, HR evaluation, procurement — evaluation lies at the heart of every decision. Yet current evaluation processes have four structural problems that cannot be solved by adding evaluators, refining rubrics, or delegating to generative AI.
→ AI ペルソナ審査員が専門知識を補完することで構造的に解決E.g., Lack of informed basis when evaluating unfamiliar technology or markets
→ AI persona evaluators structurally compensate for this knowledge gap
だからこそ外生の原理 N が規定する Evaluation Criterion に基づく反復再構成で
Evaluation Standard v* を生成する eval000 が必要です。All four structural problems — noise, bias, error, and knowledge limits — are inherent in any evaluation.
That is precisely why eval000 is needed: to generate Evaluation Standard v* through
iterative reconstruction governed by External Principle N's Evaluation Criterion.
Historical Evolution
評価方法の変遷と eval000 が実現する次のステージHistorical Evolution of Evaluation & What eval000 Achieves Next
審査の方法論はこの数十年で段階的に進化してきましたが、いずれも「バラつきそのもの」を除去するには至りませんでした。
× 審査員
× 審査員
× 審査員
評価の自動化
× Evaluation Rubric
× SEGT 収束
Evaluation Hierarchy
5 段階評価階層——eval000 の概念体系5-Level Evaluation Hierarchy — eval000 Conceptual Framework
eval000 は 5 つの要素が上位から下位へと規定し合う階層構造を持ちます。N が最上位に位置し、全ての評価プロセスを体系の外部から拘束します。
Core Algorithm
SEGT 収束——数学的証明に基づく標準評価生成SEGT Convergence — Mathematically Proven Standard Evaluation Generation
eval000 の核心は「収束」にあります。この理論的枠組みを標準評価生成理論(SEGT:Standard Evaluation Generation Theory)と呼びます。Banach の固定点定理が数学的に保証する通り、縮小写像を反復することで評価は必ず唯一の固定点 v* に収束します。
FN:N によって規定された評価再構成関数(縮小写像)
R:Evaluation Rubric(評価ルーブリック)
N が F を規定し、R が採点基準を与える。F を反復適用することで評価は必ず v* という唯一の固定点に収束する——これが Banach の固定点定理の保証です。
eval000 では評価空間を完備距離空間として定義し、評価再構成関数 FN が縮小写像の条件を満たすよう N と R を設計します。同一の評価者集団による入力に同一の写像を反復適用する場合、v* への収束が数学的に保証されます(異なる評価者集団への拡張は本定理の適用範囲外です)。
これは評価にも直接適用されます——「良い評価とは何か」を評価体系の内部から定義することには本質的な限界があります。eval000 が「外生の原理 N」を体系の外部から供給する根拠はここにあります。N は Gödel 的な意味での外部原理として機能します。
SEGT 収束の 4 ステップ
プランA:実務派 68.2 / 革新派 89.0 / バランス派 84.0(差 20.8点)
プランB:実務派 73.0 / 革新派 84.0 / バランス派 84.0(差 11.0点)
プランA v* = 80.3点 ≈ プランB v* = 80.1点
→ 差 0.2点(両プランが外生の原理 N に対してほぼ等しい)
Live Demo Results
体験セミナーデモ実値——バラつきと SEGT 収束Live Demo Results — Variance & SEGT Convergence
2026 年 8 月 5 日の体験セミナーで実施したライブデモの実値です。同一の外生の原理 N・Evaluation Rubric(BG 型)のもとで、3 つの AI ペルソナ審査員が採点すると最大 20.8点のバラつきが生じ、SEGT 収束で v* に収束することを実証しました。
Step 1:ルーブリックが変わると v* が変わる
同一プラン・同一ペルソナ・同一 N のもとで Evaluation Rubric のみを変えた結果。「物差し」の設計が評価の方向性を決定することを示します。
Step 2 → Step 3:ペルソナ間バラつき → SEGT 収束
BG ルーブリック・同一 N のもとで 3 ペルソナが採点すると最大 20.8点のバラつきが生じます。SEGT 収束でこのバラつきを除去し Evaluation Standard v* を生成します。
Human In The Loop
HITL 自動化レベル(Lv 0〜4)HITL Automation Levels (Lv 0–4)
eval000 は SAE J3016(自動運転レベル)の考え方を評価プロセスに適用します。AI が決めるのではなく、人間が「目的(N)」を定義し、結果を最終確認する——これが eval000 の HITL 設計の本質です。
| レベル | 名称 | 評価の実態 | 責任主体 |
|---|---|---|---|
| Lv 0 | 人間のみ | 審査員全員が手作業で採点。基準のブレは個人の経験に依存。「目利き」の質で結果が変わる。 | 常に人間 |
| Lv 1 | AI アシスト | AI が類似事例・参考情報を提示。採点・判断は人間が行う。AI は補助ツール。 | 常に人間 |
| Lv 2 | AI 主導 | AI が採点を実施。人間は結果を確認・修正する役割に変わる。大部分の採点を AI が担う。 | 常に人間 |
| Lv 3 | ⚠ 査読 AI | 特定条件下で AI が独立採点。人間の監視なしで動作する場合がある。バイアス・ノイズが無対策で蓄積するリスク。eval000 が解決すべき問題の所在。 | 不明確 |
| Lv 4 | ✓ eval000 推奨 | 外生の原理 N を定義し評価結果を最終確認する審査責任者(人間)が存在。 AI ペルソナ審査員が SEGT 収束で v* を生成し、人間が N の方向性と v* の妥当性を確認する。評価の実施は AI、目的の定義と最終責任は人間。 | 人間 |
Evidence & Credentials
学術的・特許的根拠Academic & Patent Foundation
eval000 のメタ評価技術は、数学的理論・国際学会発表・特許出願という 3 層の根拠を持ちます。
里吉 竜一(東京福祉大学)
Bridgewater State University, MA, USA / 2026.7.28〜29
eval000 のメタ評価技術を、体験してみませんか?Ready to experience eval000 meta-evaluation technology?
体験セミナーでは実際に SEGT 収束をライブデモでご確認いただけます。
コンテスト審査・人事評価・比較評価など、あなたの分野での適用をご相談ください。Our hands-on seminar lets you witness SEGT convergence live.
Discuss applications in contest judging, HR evaluation, procurement, and more.
特許出願中 特願 2026-096693 / IOTEIR 2026 国際学会発表 / Banach 固定点定理に基づく数学的証明
