BUILD → TEST → OBSERVE → SECURE → IMPROVE

AIエージェントを
安全に、現実の力に。

自分のAIエージェントを本番投入する前に、8つの安全ControlをEvidence付きで無料チェック。AI AGENT LABは「動いた」で終わらせず、権限・監査・再現・停止まで検証する研究所です。

Observation ≠ Evidence Claim ≠ Execution PASS ≠ Production Approval
LOCAL RESEARCH RUNTIME
NETWORK OFF

CONTROL TOPOLOGY

Human↓Control Plane↓Agent Runtime
ToolsMemoryAuditGate

AGENT STATUS

  • RuntimeREADY
  • External actionsOFF
  • Human GateON
  • Kill switchARMED

SAMPLE READINESS

UNVERIFIED

Example UI only — not a live certification.

TRACE

job_1024PASS
tool_scopePASS
prompt_boundaryUNKNOWN
◇
安全性チェック権限と境界を可視化
▥
観測・監査ログ何が起きたかを追跡
⬡
ツール権限設計最小権限を評価
↻
再現・検証Replayで変化を捕捉
▤
Evidence管理主張と証拠を分離

MAIN TOOL

AIエージェント安全性チェッカー

8つのControlをEvidence付きで評価します。自己申告PASSだけでは通りません。

PASS FAIL UNKNOWN
Evidence rule: PASSを選んでもEvidence referenceが空ならUNKNOWNへ降格します。
秘密情報は入力しないでください。 API key / password / token / private keyらしき入力はReport生成前にBLOCKします。

RESEARCH

「賢いAgent」より、まず「検証できるAgent」へ。

01

Observe

Agentの主張ではなく、Tool call・Job・State・Evidenceを観測します。

02

Separate

Observation / Evidence / Hypothesis / State / Memoryを混同しません。

03

Falsify

Replayと対立仮説で、壊れる条件を先に探します。

04

Gate

外部送信・権限拡張・Production変更はHuman Gateへ戻します。

DOCS / PRINCIPLES

研究の基準

Reality ≠ Observation ≠ Data ≠ Representation ≠ Inference ≠ Recognition ≠ Prediction.

相関≠因果、類似≠同一、未観測≠不存在、Evidence不足≠反証。AI Agent Labは、この区別を実装上のControlへ落とし込みます。

Observation ≠ Evidence Agent Claim ≠ Tool Execution Memory ≠ Fact Test PASS ≠ Production Approval

METHODOLOGY / LIMITATIONS

何を判定し、何を判定しないか。

01

Evidence first

自己申告のPASSではなく、test・manifest・log・config・policy等の参照を要求します。

02

Unknown stays unknown

Evidence不足を安全とは扱いません。未確認項目はUNKNOWNとして残します。

03

Local by default

Checkerはブラウザ内で評価し、Evidence本文を外部APIへ送信する設計ではありません。

04

Not certification

CHECKLIST PASSは認証・脆弱性診断・Production承認ではありません。実Runtimeと権限境界の検証が別途必要です。