四つの層
| 層 | 保持する内容 | 読み出されるとき |
|---|---|---|
| 会話の記憶 | この会話の中で言われたすべてのこと | その会話のすべてのターン |
| 長期記憶 | あなたと業務についての、変わらない事実や好み | あらゆる会話の、あらゆるターン |
| ナレッジベース | アップロードした文書と保存したウェブページ | エージェントが何かを検索したときだけ |
| スキル | 手順。繰り返しのタスクをどうこなすか | 手元のタスクがスキルに合致したとき |
最初の二つは常に働いていて、そのため毎ターン何かしらのコストがかかります。あとの二つは必要なときに参照され、使われるまでは何もコストがかかりません。この違いこそが、何をどこに置くかを意図的に決めるべき理由のすべてです。
会話の記憶
会話はどれも消えないスレッドです。ブラウザを閉じ、来週に戻ってきて、Chatレールから開き直しても、エージェントはまだ文脈を覚えています。会話は新しい順に並び、読みやすいラベル、どのチャネルから来たか、メッセージ数、そして積み上がったコストが添えられます。
長い会話でも破綻しません。モデルの上限に近づくと、古いターンがその場で圧縮され、枝分かれせずにスレッドが続いていきます。 コンテキストバー がチャットのヘッダーにあり、会話が今どれだけ埋まっているかを示します。そして /context コマンドは内訳カードを開きます。システムプロンプト、ツール、記憶ファイル、スキル、メッセージがそれぞれどれだけの容量を占めているか、そして残りの空き容量はどれだけかが分かります。
ここで大事なコマンドが二つあります。 /new は新しい会話を始めます。話題を変えるたびに正しい選択です。無関係な履歴を引きずる長いスレッドより、きれいなスレッドのほうが安く、鋭いのです。 /compact は、上限を待たずに今すぐ圧縮を要求します。
長期記憶
その 記憶 セクションは、エージェントの長期記憶ドキュメントを直接見るビューです。これは毎ターン、指示に注入されます。読み取りモードは三つあります。 アウトライン (セクションと事実。絞り込みと折りたたみが可能)、 閲覧 (レンダリング済み)、そして ソース (Markdownのソース)。 コピー と ダウンロード は、その名のとおりに動きます。
書き込み方は二つあります。クイック追加フォームは、一つの事実を追記します。セクションを選べば長期記憶に入り、セクションを空欄にすれば代わりに今日の日次ログに入ります。 編集 ボタンが、ドキュメント全体を編集用に開きます。 保存 は、単一のアトミック書き込みでファイルを上書きします。
エージェント自身もこれを保守しています。バックグラウンドのループが、直近の会話を日付付きの日次ログへと蒸留し、定期的にそのログの中の変わらない部分を主記憶ドキュメントへ折り込みます。だからこそ、誰も打ち込まなくても記憶は自然に育っていくのです。
全文書エディタは、ファイルをまるごと置き換えます。編集しているあいだライブ更新は止まり、もしエージェントがあなたの知らないところでファイルを変更していれば、バナーが警告を出します。保存すると新しいバージョンを上書きしてしまうという警告で、代わりに再読み込みする選択肢も示されます。保存する前に、そのバナーを読んでください。
長期記憶は短く保ってください。それは毎ターン読まれるので、変わらないもの - 顧客が誰か、社内のスタイルは何か、どの仕入先が好まれるか - を入れておくべきで、先週火曜日の会話記録を入れるべきではありません。
あなたのナレッジベース
その ナレッジ セクションは、あなたが与える文書やウェブページから検索可能なコレクションを作ります。個々のファイルを追加し、URLを追加し、名前付きストアを作って異なる資料群を分けて保ち、ディレクトリ全体を同期し、索引化済みの一覧を見て、もう要らないソースを取り除けます。検索はナレッジベース、エージェントのワークスペース、その記憶、あるいはカスタムストアを横断して行われます。
ここには製品マニュアル、価格表、方針、過去の提案書、参照用PDFが収まります。エージェントはそのどれも頭の中に持ち歩いてはいません。質問がそれを求めたときに検索し、見つけたものを引用します。そうすることで、回答はモデルの一般的な学習内容ではなく、あなたの資料に根ざしたものになります。そして、実際に必要になるまで、大きなコーパスを抱えるコストはゼロのまま保たれます。
チャットの入力欄からアップロードしたファイルは、エージェントのワークスペースに収まり、 Files セクションの uploads/見えるようになります。エージェントが生み出すもの - 生成した画像、レポート、スクリーンショット - も同じ場所に置かれます。そのため、会話ではなく成果物そのものが欲しいときに探すべき場所はFilesになります。
インデックス作成はバックグラウンドで行われ、意図的に抑制されているので、進行中の会話を遅くすることはありません。大きなアップロードは、完了してからしばらくして検索可能になります。即座にではありません。
Notes
その Notes セクションは、エージェントが読み書きする、リンクでつながったMarkdownウィキです。各ノートにはタイトル、タグ、別名、出典があり、ノート同士がリンクし合います。リーダーペインは、そのリンクグラフの両方向を リンク先 と 参照元 チップとして示します。これによって、あるアイデアの周辺をたどっていけます。検索ボックスは、コレクション全体にキーワード検索をかけます。
知っておく価値のあるフラグが一つあります。 auto-inject。auto-injectと印を付けたノートは、そのスニペットが毎ターン、長期記憶のようにエージェントのコンテキストへ押し込まれます。独立したドキュメントに値する常設の指示に便利ですが、そうしたノートの直近5件までに限られていて、こっそり膨れ上がることはありません。それ以外はすべて必要なときに参照されます。
スキル
スキルとは、教えられた手順のことです。書かれた指示と、必要に応じて実行するスクリプトを収めたフォルダです。システムプロンプトがエージェントが何者かを語るのに対し、スキルは特定の仕事がどう行われるかを語ります。手順、書式、確認事項です。タスクが合致すると、エージェントは該当するスキルを取り出します。エージェントごとに有効・無効を切り替えるのは、詳細ページの スキル タブで切り替えます。
スキルは三つの場所から来ます。プラットフォームに同梱されているもの、あなたの環境向けに書かれたもの、そしてエージェントがCortexを通じて自分で学び取るもの( 第7章)。チャットで /skills と打つと、今のエージェントが実際に持っているものがカテゴリ別に一覧表示されます。あるスキルがセキュリティ監査によって差し止められている場合、それも理由とともにそこに一覧されます。黙って消えることはありません。
手順があるものはすべて、スキルにふさわしい置き場所です。「先週のタスクを取り出し、口座ごとにグループ分けし、このテンプレートに合わせて、週次のクライアント向け更新を下書きする」はスキルです。それをシステムプロンプトの一段落として書き込もうとすると、プロンプトは他のすべての面で悪くなります。
これはどこに入れるべき?
- あらゆる返信の形を決めるべき事実 - 営業時間、CEOの名前、私たちが使う口調 - は長期記憶に入ります。
- 誰かが尋ねてくるかもしれない文書 - 40ページの方針書、カタログ、昨年のレポート - はナレッジベースに入ります。
- 繰り返し使える方法 - 見込み客をどう見極めるか、ダイジェストをどう整形するか - はスキルに入ります。
- このスレッドだけに関係すること - 会話の中でただ言えばいいのです。それはその会話が続くあいだだけ覚えられています。
よくある間違いは、長期記憶に文書を注ぎ込むことです。それは一週間はうまくいきますが、そのあとはあらゆる返信が遅く、コストがかかり、混乱したものになっていきます。エージェントがあらゆる会話にファイルキャビネットを一つ持ち歩くことになるからです。文書は、文書が行くべき場所に置いてください。