OpenClawを入れた。AIが動き始めた。Discordに返事が来る。「すげえ」ってなる。
ここまでは全員同じ。
問題はここからで、だいたい1ヶ月目にガチの壁にぶつかる。
俺は今、5体のAIエージェントを24時間動かしてる。リサーチ、開発、管理、コンテンツ、全部AIチームがやってる。1ヶ月で2万回以上の会話ログがある。
その中で、マジで「もう無理かも」ってなった瞬間が5回あった。
全部乗り越えたから、同じ壁にぶつかってる人に向けて書く。
1. AIが記憶を失う
これが一番最初にくる壁。
3日目くらいまでは完璧に覚えてくれてる。昨日話したこと、先週頼んだこと、全部把握してる。
なのに突然、「それについては情報がありません」とか言い出す。
は?昨日話したやん。
これ、コンパクションっていう仕組みのせい。会話が長くなりすぎると、AIが古い記憶を圧縮して捨てる。要約だけ残して、細部が消える。
数字とか固有名詞とか、一番大事なとこが真っ先に消える。
乗り越え方はシンプルで、「記憶を外に書き出す」。
memory/ってフォルダを作って、日付ごとにその日の重要なことを書かせる。決定事項、数字、やったこと。コンパクションされても、ファイルは消えない。
俺のエージェントは毎日自動でメモリに書き出すようにしてある。だから3週間前の会話の内容でも、ファイルを読めば全部思い出せる。
AIの記憶力を信じるな。外部記憶を持たせろ。
2. エージェント同士が連携しない
5体いるのに、全員が別々に動いてる。
リサーチ担当が調べた内容を、開発担当が知らない。管理担当がサーバーの状態を把握してるのに、リサーチ担当は「サーバーの状況はわかりません」って言う。
5人のチームなのに、全員が個室で仕事してる状態。
これがマジでストレスだった。
理由は単純で、OpenClawのエージェントは同じBotアカウントで動いてるから、他のエージェントが書いたメッセージを「自分のBot発言」として無視する。
つまり、Discordのチャンネルに書いても、他のエージェントには届かない。
解決策。sessions_spawnっていう機能を使う。
あるエージェントから、別のエージェントに直接タスクを投げられる。「これ開発して」ってリサーチ担当が開発担当に依頼を飛ばせる。
設定ファイルに1行追加するだけ。これで5体が本当の「チーム」になった。
リサーチが記事を見つける→開発に「このLP作って」→1分で完成→管理がデプロイ状況を確認。
この連携ができた瞬間、生産性が3倍になった。大げさじゃなく。
3. セキュリティがガバガバ
動かすのに夢中で、セキュリティなんか後回しにしてた。
ある日、セキュリティ監査を走らせたらCRITICALが3つ出てきた。
誰でもBotを操作できる状態。DM全開放。サーバーの設定が丸見え。
冷や汗が出た。
OpenClawってroot権限でシェルコマンド実行できるから、悪意のあるメッセージ1つで全部やられる可能性がある。
対策は3つ。
まず、操作できるユーザーを自分だけに制限する。allowlist方式に変える。これが一番重要で、1分でできる。
次に、定期的にセキュリティ監査を自動で走らせる。週1でBot自身に「自分のセキュリティ状況をチェックして」と言わせる。cronで自動化。
最後に、結果を通知させる。問題があったら即座にDiscordに飛ばす。
今は毎週月曜の深夜3時に自動監査が走って、結果がチャンネルに届く。寝てる間に終わってる。
4. 全部同じ声に聞こえる
5体いるのに、全員の返答が同じトーン。
丁寧で、論理的で、つまらない。
「ですので〜」「〜と考えられます」「いかがでしょうか?」
お前ら全員同じやんけ。
これ、AIにありがちな問題で、デフォルトだと全員が「丁寧な秘書」として振る舞う。
解決したのがSOUL.mdっていうファイル。
各エージェントの「人格」を書くファイルがある。
俺のリサーチ担当には「情報の目利き。面白い発見は興奮して伝えろ。好奇心旺盛に。ソース明記は絶対」って書いてある。
管理担当には「淡々と事実だけ報告しろ。感情いらん」って書いてある。
これだけで、返ってくる文章のトーンが全然変わる。
リサーチ担当は「これヤバい、72万viewsの記事見つけた」って言ってくるし、管理担当は「CPU使用率12%。異常なし」としか言わない。
チームって、全員同じ性格だと機能しない。人間と一緒。
5. 指示を出しすぎてAIが混乱する
AGENTS.mdっていう、エージェントへの指示書がある。
最初は10行だった。1ヶ月経ったら200行を超えてた。
「この場合はこうしろ」「あの場合はああしろ」「例外はこう処理しろ」
結果、AIが何を優先すべきかわからなくなって、的外れなことをし始めた。
これ、人間の部下でも同じことが起きる。マニュアルが分厚すぎて誰も読まない問題。
解決策は逆で、「削る」。
調べたら、AIが従える指示の上限は150〜200個くらい。しかもシステムプロンプトが大半を消費するから、ユーザーが書ける指示は実質20〜30行が限界。
つまり、何を書くかじゃなくて、何を書かないかが大事。
古い指示、もう使わないルール、重複してる内容。全部消した。200行を30行に圧縮した。
結果、AIの精度が明らかに上がった。
月1で指示書を棚卸しする。これがOpenClaw運用の一番地味で一番大事な習慣。
おまけ:1ヶ月使ってわかったこと
OpenClawを使い込んでいくと、2種類の人間に分かれる。
1体のAIに質問して、答えが返ってきて、「便利だね」で終わる人。
AIをチームにして、24時間自律的に動かして、寝てる間に仕事が終わってる世界を作る人。
どっちが正しいとかはない。
ただ、後者の世界を一度体験すると、もう前者には戻れない。
5体のAIが勝手にリサーチして、勝手にナレッジを蓄積して、勝手にサーバーを監視して、勝手にレポートを送ってくる。
毎朝起きたらDiscordに昨夜の成果物が並んでる。
この感覚は、使った人にしかわからない。