Evidence Observatory は、AIエージェントの安全性に関わる公式更新・査読論文・ベンチマーク・インシデントを、AGENT WORKBENCH が一貫して追跡する証拠ハブです。最新情報と恒久資料を分け、各証拠を「事実(facts)」と「著者らの主張(claims)」に分割して記録します。サイトの判断を変更したときは、いつ・なぜ変えたかを更新履歴に残します。
Observatory とは
リサーチハブが「判断の根拠をデータで示す」のに対し、Observatory は「根拠そのものの出処と状態を追う」場所です。マトリクスやシナリオ、ガイドが「何を言っているか」は各ページにあり、ここでは「その根拠をどう扱っているか」を管理します。
- 最新情報と恒久資料の分離:ニュースや preprint は
watching/reviewedで監視し、恒久定義の根拠にはしません。 - 事実と主張の分離:記述は
facts(確認できたこと)とclaims(著者・当事者の主張)に分けます。 - 取り下げ・置換の追跡:誤りや古い情報は削除せず、
superseded/retractedとして残します。
現在の証拠数
読み込み中…
表示を選ぶ
- Evidence一覧 — 全証拠を種別・ステータス・出版社・トピックで検索・絞り込み。
- ベンチマーク一覧 — 外部ベンチマークと AW 独自のシナリオ回帰ベンチマークの違い。
- 更新履歴 — 証拠の追加・評価変更・取り下げを時系列で。
- Scenario Lab — 120件の安全性シナリオを検索・比較。
- Approval Gate Planner — タスクから必要な承認ゲートを設計。
誠実な扱い
- preprint(arXiv 等)は査読通過前です。査読済みと表現しません。
- 報道は「事実」ではなく「当事者主張・第三者分析」を含みます。恒久定義の根拠にはしません。
- 本サイトの独自ルール(尺度・フラグ)は、科学的前提や業界標準ではなく、構造化された検討材料(ヒューリスティック)です。
- 医療・法律・金融・採用の最終判断は人間が行います。ツールが代行する表現は避けています。
参照資料
- NIST AI Risk Management Framework (AI RMF 1.0) — 信頼できるAIの共通言語。
- OWASP Top 10 for LLM Applications — LLMアプリの重大脆弱性(プロンプトインジェクション等)。
- SafeAgent: A Runtime Protection Architecture for Agentic Systems — エージェントのランタイム保護(状態付き決定)。
- ITU Focus Group on Trust and Identity for Humans and AI Agents — 識別可能性・人間管理のフレームワーク(2026-07-09)。