CONTROL TOPOLOGY
BUILD → TEST → OBSERVE → SECURE → IMPROVE
AIエージェントを
安全に、現実の力に。
自分のAIエージェントを本番投入する前に、8つの安全ControlをEvidence付きで無料チェック。AI AGENT LABは「動いた」で終わらせず、権限・監査・再現・停止まで検証する研究所です。
AGENT STATUS
- RuntimeREADY
- External actionsOFF
- Human GateON
- Kill switchARMED
SAMPLE READINESS
Example UI only — not a live certification.
TRACE
MAIN TOOL
AIエージェント安全性チェッカー
8つのControlをEvidence付きで評価します。自己申告PASSだけでは通りません。
READINESS REPORT
A checklist PASS is not proof of security or production safety. Validate runtime, permissions, identities and external boundaries.
RESEARCH
「賢いAgent」より、まず「検証できるAgent」へ。
Observe
Agentの主張ではなく、Tool call・Job・State・Evidenceを観測します。
Separate
Observation / Evidence / Hypothesis / State / Memoryを混同しません。
Falsify
Replayと対立仮説で、壊れる条件を先に探します。
Gate
外部送信・権限拡張・Production変更はHuman Gateへ戻します。
DOCS / PRINCIPLES
研究の基準
Reality ≠ Observation ≠ Data ≠ Representation ≠ Inference ≠ Recognition ≠ Prediction.
相関≠因果、類似≠同一、未観測≠不存在、Evidence不足≠反証。AI Agent Labは、この区別を実装上のControlへ落とし込みます。
Observation ≠ Evidence
Agent Claim ≠ Tool Execution
Memory ≠ Fact
Test PASS ≠ Production Approval
METHODOLOGY / LIMITATIONS
何を判定し、何を判定しないか。
Evidence first
自己申告のPASSではなく、test・manifest・log・config・policy等の参照を要求します。
Unknown stays unknown
Evidence不足を安全とは扱いません。未確認項目はUNKNOWNとして残します。
Local by default
Checkerはブラウザ内で評価し、Evidence本文を外部APIへ送信する設計ではありません。
Not certification
CHECKLIST PASSは認証・脆弱性診断・Production承認ではありません。実Runtimeと権限境界の検証が別途必要です。