01AISIはひとつの国際機関の名前ではない

AI Safety Institute(AISI)は、同じ名称・権限を持つ世界共通の組織ではありません。日本にはAIセーフティ・インスティテュート(AISI)、英国にはAI Security Institute(AISI)、米国にはCenter for AI Standards and Innovation(CAISI)があります。いずれも公的機関ですが、設置場所と公式に掲げる任務は国ごとに違います。[1][3][5]

名称の変化にも注意が必要です。英国は2025年2月にAI Safety InstituteからAI Security Instituteへ名称を改め、米国は2025年6月に従来のU.S. AI Safety InstituteをCAISIへ再編すると発表しました。古い記事や文書に「英米のAISI」とあっても、現在の正式名称や担当範囲を確認して読む必要があります。[4][6]

02日本:評価方法・ガイダンスと国内外の連携

日本のAISIは、2024年2月に情報処理推進機構(IPA)内に事務局を設置しました。公式の業務説明は、安全性評価に関する調査や基準・ガイダンスの検討、評価の実施方法、AIの安全性に関する技術・事例の調査、海外機関との連携を挙げています。評価手法や事業者向けの実務知見を整える色合いが強く、英国の組織内評価チームや米国の国家安全保障向け評価と同じ役割だと決めつけないことが大切です。[1]

活動例として、AISIは2026年4月に2025年度の年次レポートを公開しました。同年の活動一覧には、ヘルスケア領域の評価観点ガイドや、民間企業と検討したAIセーフティ評価環境に関する報告も掲載されています。[2][7]

2026年7月改訂の評価観点ガイド(第1.20版)は、AIエージェント特有の「観測と制御」を設け、自律的な挙動と外部環境との相互作用を評価項目に加えました[11]。同月のAIロボティクス向けガイドは、物理・心理・社会的リスクを整理し、カフェ搬送ロボットと遠隔操作型小型配送ロボットを例に9項目の評価観点を示します[12]。これらは評価の参照枠を示すガイドであり、個別製品の安全認証結果を示すものではありません。

03英国:政府の研究機関として先端モデルを評価

英国のAI Security Instituteは、科学・イノベーション・技術省(DSIT)内の研究機関です。公式説明では、先端AIのリスクと対策について政府の科学的理解を深めることを使命とし、モデルの公開前評価、公開後の試験、研究機関や開発企業との協力、政策担当者への知見提供を挙げています。評価ツールInspectの公開や研究助成も活動に含まれます。[3][4]

具体例として、英国AISIとCAISIは2026年7月、Moonshot AIのKimi K3を対象にサイバー能力の暫定共同評価を公表しました。報告は公開・非公開の少数ベンチマークによる評価とし、米国の閉鎖型モデルについては最大能力を測る目的で、システム側のセーフガードを無効にした条件も含むと説明しています。したがって、通常の保護機能を有効にした製品の挙動をそのまま比較した結果ではありません。[9]

つまり、英国AISIの特徴は、研究だけでなく、モデルへの技術的アクセスを伴う評価や評価手法の開発を政府内で担う点にあります。ただし個別のテスト報告が対象とするモデル・能力・条件は限られるため、ひとつの結果を全用途の安全証明として読むことはできません。実際の評価範囲は各報告書の方法と制約を確認してください。

04米国:NISTのCAISIと、似た名前のコンソーシアムを区別

米国のCAISIは、国立標準技術研究所(NIST)内に置かれたCenter for AI Standards and Innovationです。NISTは、民間開発者・評価者との任意の合意に基づく協力、AIシステムの測定・セキュリティに関するガイドやベストプラクティス、国家安全保障上の懸念につながる能力の非機密評価を役割として示しています。公式説明が挙げる評価分野にはサイバー、生物、化学兵器関連の能力などがあります。[5][6]

「CAISI」と「NIST AI Consortium」は別のものです。前者はNIST内のセンター、後者は政府・企業・研究機関等が参加するコンソーシアムです。NISTは2026年5月、旧AI Safety Institute ConsortiumをNIST AI Consortiumへ改称し、より広いAI測定・評価の活動を掲げました。旧称に「AI Safety Institute」が含まれていたため、資料を読むときは機関と参加型コンソーシアムを取り違えないようにします。[8]

2026年9月、CAISIはGLM-5.3を脆弱性発見・exploit開発に関する4つのサイバー評価で調べ、同機関が評価した米国モデル群の最前線より約4か月分後ろと、課題難度を調整した複合指標で推定しました。この月数は評価済みのモデルと課題に限る時点付きの比較です。未公開モデルや現実の環境全体を網羅せず、製品の安全性認証を意味しません。[10]

05機関の発表や評価結果を読むときの確認点

三機関は評価、技術研究、ガイダンス、国際協力で一部重なりますが、所管と優先分野は同一ではありません。公開資料を比較するときは、次の点を確認すると役割を読み違えにくくなります。

  1. 誰が公表したか: 公的機関の研究結果か、企業が定めた安全枠組みか、複数組織の協働か。
  2. 何を評価したか: 対象モデル、能力・リスク領域、評価時点、試験環境と方法。
  3. 結果の限界: 未公開の試験条件、サンプル数、公開版と内部版の差など、結論の範囲を決める条件。
  4. 何を決める資料か: 技術的な測定・ガイダンスなのか、企業内の開発・配備判断なのかを分ける。

AIの評価設計やベンチマークの限界はFrontier AI評価の解説、開発企業が公表する閾値や配備方針はFrontier AI安全枠組みの比較で扱っています。機関の評価、企業の自主的な方針、法令上の要件は、相互に関係しても同じ種類の資料ではありません。

Primary sources / references

参考資料

  1. AISIについてJapan AI Safety Institute · 公開日記載なし(2026年9月26日閲覧) — 日本AISIの設置場所と公式に掲げる業務を確認。
  2. AIセーフティ年次レポート2025Japan AI Safety Institute · 2026年4月28日 — AISIの2025年度活動と、関連する国内外機関・企業との連携方針を確認。
  3. About — The AI Security InstituteUK Department for Science, Innovation and Technology · 公開日記載なし(2026年9月26日閲覧) — 英国AISIの所管、任務、公開前後の評価、研究・助成の説明を確認。
  4. Department for Science, Innovation and Technology Annual report and accounts 2024-25UK Department for Science, Innovation and Technology · 2025年 — 英国AI Safety Instituteが2025年2月にAI Security Instituteへ改称したことを確認。
  5. Center for AI Standards and Innovation (CAISI)National Institute of Standards and Technology · 公開日記載なし(2026年9月26日閲覧) — CAISIのNIST内での役割、企業との任意協力、ガイド作成、評価分野を確認。
  6. Statement on Transforming the U.S. AI Safety Institute into CAISIU.S. Department of Commerce · 2025年6月3日 — 米国AISIからCAISIへの再編発表と、継続してNIST内に置かれることを確認。
  7. AI政策動向マンスリー情報Japan AI Safety Institute · 2026年5月13日 — ヘルスケア評価ガイド、民間企業との評価環境検討、年次レポートなど2026年の国内AISI活動を確認。
  8. NIST Expands AI Consortium’s Scope, Calls for New MembersNational Institute of Standards and Technology · 2026年5月29日 — AI Safety Institute ConsortiumからNIST AI Consortiumへの名称変更と、組織の役割の違いを確認。
  9. UK AISI / CAISI Preliminary Assessment of Kimi K3's Cyber CapabilitiesUK AI Security Institute and National Institute of Standards and Technology · 2026年7月23日(2026年8月28日更新) — 英国AISIとCAISIの共同評価の公表例、限定されたベンチマーク、閉鎖型モデルの評価条件を確認。
  10. CAISI’s Assessment of Z.ai’s GLM-5.3 Cyber CapabilitiesNational Institute of Standards and Technology · 2026年9月17日 — 4つのサイバー評価と、CAISIの課題難度調整済み複合指標が示す比較範囲を確認。
  11. AIセーフティに関する評価観点ガイド(第1.20版)の公開Japan AI Safety Institute · 2026年7月7日 — エージェント特有の観測と制御、自律的な挙動、外部環境との相互作用を追加した改訂。
  12. AIロボティクスに関するセーフティ評価観点ガイドの公開Japan AI Safety Institute · 2026年7月23日 — 物理・心理・社会的リスクと、2つの想定ケースに基づく9項目の評価観点。