RouteHubの設定方法

MIERU CREW 運用マニュアル — モデルの呼び分け・予算デグレード・Rate Limitフォールバック

仕組みの全体像(最初に読んでください)

AI社員は実モデル名を直接呼びません。全LLM呼び出しはRouteHub Coreを経由し、モデルエイリアスで解決されます。設定はすべて LLM Control ページで行います。

エイリアス役割実モデルの例
crew-fastコストが安い高速モデルopenai/gpt-4o-mini
crew-balanced中間モデルopenai/gpt-4.1-mini
crew-strongコストは高いが高性能なモデルopenai/gpt-4.1
crew-autoプロンプト内容から難易度を判定し、上の3つへ自動振り分け
本マニュアルの操作にはMIERU CREWコンソールへのログインが必要です(アカウントの作成・ログイン方法は「0. アカウント登録とログイン」を参照)。
このマニュアルで設定する3つの機構: ①呼び分け(crew-autoの難易度判定)②予算デグレード(予算接近時に安いモデルへ自動格下げ)③フォールバック(Rate Limit・障害時に別プロバイダへ切替)。
1高性能モデルと安価モデルを定義する(Models & Aliases)

LLM Control → Models & Aliases タブを開きます。「モデルエイリアス実定義」の表で、各エイリアスに実モデル(provider/model形式)とAPIキー環境変数を割り当てます。

Models & Aliasesタブ(プロバイダAPIキー)
⚠ 「保存してRouteHub Coreを再起動」を押すと反映のためにRouteHub Coreが再起動します(30〜60秒程度、LLM実行が一時停止)。
2プロンプトの内容で呼び分ける(Routing Policies)

LLM Control → Routing Policies タブで、crew-auto の難易度判定ルールを設定します。プロンプトに含まれるキーワード・タグからスコアを計算し、スコアに応じてfast / balanced / strongへ振り分けます。

設定項目意味
fast上限スコアこのスコア以下なら安価モデル(fast)で処理2
balanced上限スコアこのスコア以下ならbalanced、超えたら高性能モデル(strong)5
strongキーワード(+2/語)含まれるとスコアが上がる語(=高性能モデルに寄せたい話題)法・税・契約・個人情報・コンプライアンス
mediumキーワード(+1/語)やや複雑な話題分析・比較・提案・見積
fastタグ(-2)/ strongタグ(+3)タスク種別タグによる強制的な寄せfast: cs_classify、strong: high_risk

例えば「この契約書の法的リスクを分析して」というプロンプトは、strongキーワード(法・契約・リスク)でスコアが上がり高性能モデルへ、「今日の予定を要約して」は低スコアのまま安価モデルへルーティングされます。設定は「Router設定を適用」で即時反映されます(再起動不要)。

Routing Policiesタブ(crew-auto難易度判定)
キーワード判定を使いたくないAI社員には、AI社員ごとの既定ポリシー(採用時の設定 / Manifestの llm.default_policy)で crew-fast / crew-balanced / crew-strong を固定指定することもできます。
3予算に近づいたら安いモデルへ自動で下げる(Budgets)

LLM Control → Budgets タブの「予算ペーシング設定」で、AI社員別の月次予算に対する消化ペースを監視し、ペース超過時に使えるモデルの上限を自動で引き下げます。

設定項目意味既定値
デグレード警告閾値日次/週次ペース比がこの値以上 → 上限をbalancedへ引き下げ(strongを使わせない)0.8
デグレード限界閾値ペース比がこの値以上 → 上限をfastへ引き下げ(最安モデルのみ)1.0
回復ヒステリシス幅ペース比が「閾値 − この幅」を下回ったら1段ずつ自動回復(バタつき防止)0.1

同じタブ下部の「予算実績(仮想キー単位)」で、AI社員ごとの今日/今週の消化状況とデグレード状態を確認できます。各AI社員の月次予算額そのものはAI社員のカード(またはVirtual Keysタブ)から変更します。設定は即時反映(再起動不要)です。

Budgetsタブ(予算ペーシング設定と予算実績)
4Rate Limit時の切替先を設定する(fallback)

再び Models & Aliases タブの「モデルエイリアス実定義」で、各エイリアスのfallback先(順序どおり)列に、Rate Limit(429)やプロバイダ障害時に切り替えるモデルを指定します。

モデルエイリアス実定義(fallback先とリトライ/cooldown設定)
⚠ fallback先のモデルもAI社員の仮想キーの許可リストに含まれている必要があります(標準構成の crew-*-anthropic / crew-fallback は許可済み)。独自エイリアスを増やした場合はVirtual Keysタブで許可モデルを確認してください。

動作確認と監視