Raspberry Pi 5:
$80 AIサーバー
/** 正直なガイド。実際に機能するもの、しないもの、8GB RAMから最大限を引き出す方法。 */

🤖 Pi 5(8GB RAM)のモデル互換性
⚙️ Pi 5の推奨設定
🚀 セットアップ手順
Raspberry Pi 5で動くもの・動かないもの
Raspberry Pi 5には専用のGPUメモリがなく、MetalやCUDAの経路もないため、すべてがCPU上でシステムRAMを使って動きます。これは同容量のApple Siliconよりはるかに低い上限を意味し、この構成で失望する最大の原因でもあります。
| モデル規模 | 8 GBに収まるか | 実際の挙動 |
|---|---|---|
| 1B〜3B(4-bit) | 余裕で収まる | 実用になる範囲。ルーティング、分類、短い応答、スキルの起動には十分です。 |
| 7B〜8B(4-bit) | 短いコンテキストでかろうじて | 動きますが、対話用途としては遅すぎます。バックグラウンド処理なら許容範囲です。 |
| 14B以上 | 不可 | スワップが始まり事実上ハングします。前提にしないでください。 |
7B以上のモデルに応答性を求めるなら、これは適切なハードウェアではなく、チューニングでは変わりません。Raspberry Piの価値は、安価・静音・低消費電力の常時稼働ホストとして小さいモデルやオーケストレーションを担うことです。より大きなモデルは別の場所で動かし、そこへ問い合わせる設計はまったく妥当です。
Raspberry Pi OS(64bit)へのインストール
必ず64bitイメージを使ってください。32bit版では十分なメモリを扱えず、armhfビルドが存在しない依存関係もあります。
sudo apt update && sudo apt full-upgrade -y sudo apt install -y curl git # Node 22 LTS — the Raspberry Pi OS package is usually too old curl -fsSL https://deb.nodesource.com/setup_22.x | sudo -E bash - sudo apt install -y nodejs node --version
Raspberry Pi OS同梱のNodeは古すぎます。NodeSourceから入れないと、バグのように見えて実際はバージョン起因の構文エラーが出ます。
curl -fsSL https://ollama.com/install.sh | sh # a 3B class model is the realistic ceiling on 8 GB ollama pull llama3.2:3b ollama run llama3.2:3b --verbose "reply with the single word: ready"
先にモデル単体で応答を確認してください。Raspberry Piでは初回ロードが遅く、ハングと誤解されがちです。
curl -fsSL https://openclaw.ai/install.sh | bash openclaw --version openclaw doctor
sudoでグローバルに入れるとバイナリがシステムのPATHに載ります。後述のsystemdユニットはこれに依存します。
openclaw gateway install openclaw gateway start openclaw gateway status
`gateway install` がsystemdユニットを生成します。自分で書くとアップグレード時に競合するため避けてください。8 GB環境ではOOM killerが実際に動くので、信頼する前に再起動後もサービスが戻ることを確認してください。
チューニング:ストレージ、スワップ、熱、コンテキスト
「使えるPi」と「壊れて見えるPi」の差は、ほぼ次の4つの設定で決まります。順に進めてください。いずれも段階的ではなく崖です。
# Boot from SSD, not microSD, if you possibly can. lsblk -o NAME,ROTA,SIZE,MOUNTPOINT # Check what the card is actually doing under load: sudo apt install -y iotop sudo iotop -o
モデルのロードはI/Oバウンドです。microSDでは20秒のロードが数分になり、ページの読み戻しのたびに推論が止まります。NVMe HATかUSB 3のSSDが、単体で最も効く改善です。
# Swap on a microSD will destroy the card and stall inference. # Either move it to SSD or size it small and accept OOM instead. sudo dphys-swapfile swapoff sudo sed -i 's/^CONF_SWAPSIZE=.*/CONF_SWAPSIZE=512/' /etc/dphys-swapfile sudo dphys-swapfile setup && sudo dphys-swapfile swapon free -h
microSDへのスワップは致命的です。ハングに見えるほど遅く、カードを摩耗させます。SSDに置くか、小さくしてOOM killerに任せてください。後者は少なくとも速く目に見えて失敗します。
# Sustained inference will thermally throttle a passively cooled Pi. vcgencmd measure_temp vcgencmd get_throttled # 0x0 means it has never throttled # watch it during a long generation: watch -n 2 'vcgencmd measure_temp; vcgencmd get_throttled'
パッシブ冷却のPi 5は長い生成中に必ずスロットリングします。get_throttledが0x0以外を返すなら、連続時のスループットは短時間のテスト値を下回っています。この用途では公式のアクティブクーラーは必須です。
# Keep the context small — it costs RAM you do not have. openclaw config set agents.defaults.bootstrapTotalMaxChars 20000 openclaw config set agents.defaults.bootstrapMaxChars 8000 openclaw gateway restart
bootstrapファイルはセッションごとにシステムプロンプトへ注入され、8 GB環境ではその分のメモリに余裕はありません。単一の「コンテキスト長」設定は存在せず、この2つの文字数バジェットが文書化された調整手段です。まず下げ、エージェントが必要な情報を保持できているか確認し、余裕を計測できた箇所だけ戻してください。
Raspberry Piが正解でない場合
- ✗7B以上のモデルに対話並みのレイテンシを求める場合。Apple Siliconを買うか、GPUを借りてください。
- ✗負荷が散発的でバースト的な場合。常時稼働のPiは、使い終えたら破棄できるVPSより手間の面で高くつきます。
- ✗複数モデルの同時実行、あるいはモデル+DB+ブラウザが必要な場合。8 GBではそこまで届きません。
- ✗Piの価格に惹かれていて、SSD・アクティブクーラー・まともな電源を計算に入れていない場合。合計すると出費が倍になることも珍しくありません。