$ ssh clawdbot.space --loading...
$ ssh clawdbot.space --loading...
トークン予算管理をマスターし、エージェントを高速・正確・低コストに。
全てのLLMにはコンテキストウィンドウの制限があります。エージェントが超過すると品質が低下し、ハルシネーションが増え、指示が忘れられ、コストが急増します。このガイドでコンテキスト管理のプロになりましょう。
コンテキスト内の全トークンが毎回のAPI呼び出しでコスト発生。膨張した100Kコンテキスト=$1.50/リクエスト。
LLMは無関係なコンテキストで性能低下。不要な情報で精度20-30%ダウン。
大きいコンテキスト=遅い応答。最初のトークンまでの時間がサイズに比例。
| Component | Tokens | Priority | Notes |
|---|---|---|---|
| SOUL.md | ~500-2K | 常時ロード | エージェントのアイデンティティ。簡潔に。 |
| AGENTS.md | ~300-1K | 常時ロード | ロール定義。マルチエージェントで増加。 |
| memory.md | ~1K-10K | 常時ロード | 肥大化の最大原因。積極的管理が必要。 |
| アクティブ会話 | ~2K-50K | 動的 | 現在のチャット履歴。スライディングウィンドウで自動管理。 |
| ツール結果 | ~1K-20K | 呼び出し毎 | Webスクレイプ、ファイル読取、検索結果。急速に膨張。 |
毎週レビュー。古い事実を削除、重複をマージ、構造化データをSQLiteへ。目標:2Kトークン以下。
openclaw memory status
全てを常にロードする必要はない。@includeでタスクに応じて条件付きロード。
@include(coding-rules.md) when task.type == 'code'
Webスクレイプは10K+トークンに。組み込みサマライザーで圧縮。
openclaw config set tools.web.summarize true
コンテキストに残す過去メッセージ数を制限。古いメッセージは自動要約。
openclaw config set context.sliding_window 20
大規模知識ベースはSQLiteまたはベクターDB。オンデマンドクエリ。
openclaw memory index --to sqlite
| Component | Budget | Tip |
|---|---|---|
| SOUL.md | 800 | 最大1ページ。全ての語に意味を。 |
| AGENTS.md | 500 | 簡潔なロール説明。詳細は個別ファイルへ。 |
| memory.md | 1,500 | 上位30ファクトのみ。構造化データ→SQLite。 |
| 会話履歴 | 8,000 | 20メッセージのスライディングウィンドウ+自動要約。 |
| ツール結果 | 3,000 | 全Web/ファイル結果を要約。ツールごとの出力を制限。 |
| レスポンス予約 | 4,000 | モデルの思考と応答のためのスペースを確保。 |