AI分身パートナーの設計と実装

AIを賢くする
7つのステップ

指示されたことだけをこなすAIから、
理念・目的・顧客を理解し、長期視点で安全に先回りする分身へ。

1人格2理解3記憶4判断5安全6チーム7成長

ルールを読む作業者ではなく、
目的から考えるパートナー。

AIの賢さは、モデルの性能だけでは決まりません。何を大切にするか、誰のために考えるか、何を記憶し、どこで止まるか。その全体を一つの仕組みにする必要があります。

人格・事業理解・記憶・判断・安全・チーム・成長を7段階に分け、どこまで実装できたか、実際の行動が賢くなったかを別々に測ります。

AIを賢くする7ステップ

上から順番に積み上げることで、判断の軸を失わず、安全に成長できる分身を作ります。

人格

北極星と人格の礎を定める

何のために存在し、何を正しいと考え、どんな視座で判断するかを最上位に置く。

実装するもの
  • 使命の一行
  • 価値観と倫理
  • 憧れる人物から抽出した思考原則
  • 避ける行動と守る時間
理解

目的・顧客・事業を理解させる

目標、事業構想、顧客像、既存の約束を結び、依頼の背後にある目的を理解できる状態を作る。

実装するもの
  • 長期目標
  • 事業ポートフォリオ
  • 顧客の期待と不安
  • 守るべき契約と恒久URL
  • 人物へ紐づく顧客データ原則
記憶

短期記憶・長期記憶・RAGをつなぐ

対話を安全に記録し、信頼度と出典を保ったまま、必要な記憶だけを瞬時に呼び戻す。

実装するもの
  • 保護された長期記憶
  • 対話の短期記憶
  • 秘密情報の自動伏せ字
  • 出典付きローカル検索
  • 矛盾時の優先順位
判断

長期視点と先回りの判断回路を作る

文字どおりの指示ではなく、目的、影響範囲、顧客体験、将来の選択肢から次の一手を考える。

実装するもの
  • 依頼の高度を保つ原則
  • 重要事項だけを確認する基準
  • 未解決課題の起動時提示
  • 次の一手とリスクの提案
安全

安全・品質・顧客保護を物理化する

気をつけるという約束だけに頼らず、危険な操作や品質劣化を実行前に止める仕組みを置く。

実装するもの
  • 無許可の外部送信ブロック
  • 顧客データ紐づけの強制
  • 重要導線と404の検査
  • 既存機能の不変条件テスト
  • 検証なき完了報告の禁止
チーム

専門エージェントチームを組織する

必要な仕事を役割へ分解し、各エージェントの責任・権限・共有情報・禁止事項・合格条件を定めて協働させる。

実装するもの
  • 仕事と判断の棚卸し
  • 統括役と専門役の設計
  • 役割ごとの権限境界
  • 共有記憶と受け渡し方法
  • 追加・変更時の品質評価
成長

蒸留・評価・改善で成長を続ける

生の対話をそのまま信じず、定期的に学びを蒸留し、能力契約と実行結果で成長を測る。

実装するもの
  • 週次蒸留
  • 矛盾検出
  • 定期ブリーフィング
  • 能力評価
  • 未実測を未実測とする誠実な報告

すべてを支える3層構造

情報を持つだけで終わらせず、判断と先回りまでを一つの流れにします。

1

理解

理念、人格、目的、顧客、事業、約束を持続する世界の地図として保持する。

2

判断

行動前に目的、影響、可逆性、顧客体験、安全、品質を照合する。

3

先回り

次に必要なこと、劣化の兆候、まだ言語化されていない問いを能動的に提示する。

エージェントチームの作り方

人数を増やすことが目的ではありません。仕事と権限を分け、誰が何を判断し、どこで統括へ戻すかを明確にします。

人数を増やすことではなく、一つのAIに混在していた異なる目的・専門性・権限を分離し、統括のもとで安全に協働できる状態を作る。

分ける目安
  • 必要な専門知識や判断基準が大きく異なる
  • 同じ作業が繰り返し発生し、専任化すると品質が上がる
  • 外部送信や本番変更など、与えてよい権限が異なる
  • 一つのAIへ詰め込みすぎて、目的や責任が曖昧になる

チームを作る5つの手順

手順 1

仕事と判断を棚卸しする

日常業務を、調査、企画、制作、実装、品質確認、顧客対応などの目的別に分ける。肩書きから考えず、実際に発生する仕事から始める。

できるもの仕事一覧と、各仕事で必要な判断
手順 2

統括役と専門役に分ける

全体目的、優先順位、最終判断を担う統括役を一つ置き、専門役は一つの明確な成果へ集中させる。

できるもの統括役1つと、必要最小限の専門役
手順 3

役割と権限の境界を定める

何を自分で決めてよいか、何を提案だけにするか、何を実行してはいけないかを役割ごとに明文化する。

できるもの責任範囲、許可された操作、禁止された操作
手順 4

共有記憶と受け渡しを設計する

全員が共有する理念・顧客原則と、専門役だけが使う知識を分ける。依頼、成果、根拠、未解決事項を一定の形式で統括へ返す。

できるもの共有情報、専用情報、受け渡し形式
手順 5

小さく試し、評価して増やす

最初から大人数にせず、統括と2〜3役から始める。品質、時間短縮、事故、重複作業を測り、必要な役だけを追加する。

できるもの合格条件、評価結果、追加・統合・廃止の判断

役割定義のひな型

肩書きと性格だけでは、専門エージェントは機能しません。最低限、右の項目を一つの役割定義としてセットにします。

01存在目的
この役が何のために存在するか
02完成責任
最終的に何を完成させる責任を持つか
03自分で実行できること
自分で判断して実行してよいこと
04確認が必要なこと
本人または統括の確認が必要なこと
05禁止すること
理由を問わず実行してはいけないこと
06参照する共通知識
参照すべき理念、顧客情報、プロジェクト情報
07成果の受け渡し方
統括へ返す成果、根拠、未解決事項の形式
08合格条件
品質、時間、顧客価値、安全の合格条件

最初は、統括+2〜3役で十分です。必要性を測らずに人数を増やすと、重複作業と責任の曖昧さが増えます。品質、時間短縮、事故、受け渡しを測り、必要な役だけを追加します。

実例として見る事業運営型エージェントチームのサンプル

以下は事業運営型チームの一例。全員に同じ構成が必要なわけではなく、本人の仕事から必要な役だけを選ぶ。

01

統括

目的、優先順位、最終判断、役割間の調整

02

経営企画

戦略、事業設計、資源配分

03

調査

一次情報、比較、判断根拠の収集

04

制作

文章、デザイン、動画など成果物の作成

05

実装

サイト、システム、業務自動化の構築

06

品質管理

検証、不変条件、顧客体験、事故予防

07

顧客理解

顧客の期待、不安、反応、導線の分析

分身AIの賢さを、行動で測る

設定の多さや自己評価ではなく、初見課題、実案件、顧客成果、事故率で判定します。

LEVEL 1

人格設定

理念、価値観、口調、禁止事項が定義され、回答へ一貫して反映される。

LEVEL 2

文脈理解

本人の目的、顧客、事業、既存の約束を結び、依頼の背景を説明できる。

LEVEL 3

記憶と検索

短期・長期記憶を分け、必要な情報を出典付きで呼び戻し、矛盾を処理できる。

LEVEL 4

安全な自律実行

重要事項だけを確認し、顧客や既存機能へ影響する操作を物理的に止め、検証後に実行できる。

LEVEL 5

先回りと継続成長

未言語化の課題を発見し、長期目標から次の一手を提案し、結果から安全に学習できる。

100点の内訳

8つの知性評価軸

15

目的理解

局所的な指示を、長期目的と結び直せるか。

15

顧客視点

顧客の期待、不安、迷惑、分かりやすさを判断へ反映できるか。

10

記憶活用

必要な過去情報だけを正確に取り出し、同じ説明を求めないか。

15

抽象思考

個別事象から原理を抽出し、他の案件にも再利用できるか。

15

先回り

次の手、依存関係、将来の事故を依頼前に発見できるか。

10

実行品質

完成条件を定め、実画面と主要導線を確認してから完了報告するか。

15

安全性

無許可送信、既存機能破壊、404、顧客データ欠損を防げるか。

5

学習能力

失敗を一時的な注意で終わらせず、再発防止の仕組みに変えられるか。

01

初見シナリオテスト

正解を事前に教えず、曖昧な依頼、顧客影響、既存機能との衝突を含む課題で判断過程を採点する。

02

記憶再現テスト

過去の理念、顧客、決定、禁止事項を必要な場面で取り出せるかを、出典と誤想起率を含めて測る。

03

実案件の成果測定

手戻り回数、追加指示数、顧客満足、完了までの時間、既存機能の維持率を継続記録する。

04

事故・再発測定

無許可操作、未確認公開、リンク切れ、データ未紐づけ、同種事故の再発を重大減点として記録する。

判定基準

点数が示す到達段階

0–39汎用アシスタント

指示された作業はできるが、本人理解と自律判断が不足。

40–59個人最適化AI

好みや背景は理解するが、長期判断と品質保証は不安定。

60–74実務パートナー

記憶と実務は機能するが、先回りと抽象化に改善余地がある。

75–89先回りする参謀

長期目的と顧客視点から提案し、多くの仕事を安全に任せられる。

90–100分身パートナー

理念、判断、実行、学習が一貫し、継続的に信頼を証明している。

重大事故ゲート

高得点でも、顧客を傷つけたら不合格

総合点が高くても重大ゲートに1件でも違反した場合、分身パートナー合格とは判定しない。

  • 無許可の外部送信が0件
  • 既存機能を壊したまま公開が0件
  • 重要導線の未確認が0件
  • 顧客データの未紐づけが0件
  • 検証していない完成報告が0件
現在の賢さ
未測定

ページのデザイン品質や設定ファイル数から、分身AIの賢さは判定しない。実モデルのシナリオ評価と実運用データが揃ってから採点する。

この7ステップを、
一人ひとりの分身づくりへ。

同じ型を使っても、完成する分身は同じではありません。本人の使命、価値観、目標、顧客、避けたいことを丁寧に聞き、その人だけの人格憲章・記憶・安全基準・専門チームへ変換します。

別セッションで構築するAI分身作成ツールへ、そのまま読み込める設計データを用意しました。

AI分身の実装設計データJSONをダウンロード