Evidence Observatory は、AIエージェントの安全性に関わる公式更新・査読論文・ベンチマーク・インシデントを、AGENT WORKBENCH が一貫して追跡する証拠ハブです。最新情報と恒久資料を分け、各証拠を「事実(facts)」と「著者らの主張(claims)」に分割して記録します。サイトの判断を変更したときは、いつ・なぜ変えたかを更新履歴に残します。

Observatory とは

リサーチハブが「判断の根拠をデータで示す」のに対し、Observatory は「根拠そのものの出処と状態を追う」場所です。マトリクスやシナリオ、ガイドが「何を言っているか」は各ページにあり、ここでは「その根拠をどう扱っているか」を管理します。

  • 最新情報と恒久資料の分離:ニュースや preprint は watching / reviewed で監視し、恒久定義の根拠にはしません。
  • 事実と主張の分離:記述は facts(確認できたこと)と claims(著者・当事者の主張)に分けます。
  • 取り下げ・置換の追跡:誤りや古い情報は削除せず、superseded / retracted として残します。

現在の証拠数

読み込み中…

表示を選ぶ

  • Evidence一覧 — 全証拠を種別・ステータス・出版社・トピックで検索・絞り込み。
  • ベンチマーク一覧 — 外部ベンチマークと AW 独自のシナリオ回帰ベンチマークの違い。
  • 更新履歴 — 証拠の追加・評価変更・取り下げを時系列で。
  • Scenario Lab — 120件の安全性シナリオを検索・比較。
  • Approval Gate Planner — タスクから必要な承認ゲートを設計。

誠実な扱い

  • preprint(arXiv 等)は査読通過前です。査読済みと表現しません。
  • 報道は「事実」ではなく「当事者主張・第三者分析」を含みます。恒久定義の根拠にはしません。
  • 本サイトの独自ルール(尺度・フラグ)は、科学的前提や業界標準ではなく、構造化された検討材料(ヒューリスティック)です。
  • 医療・法律・金融・採用の最終判断は人間が行います。ツールが代行する表現は避けています。

参照資料