local-commander

ローカル LLM を判断役に据える開発オーケストレーター。タスクの難度を仕分け、必要な場面のみ人の承認を挟み、実装・レビュー・マージまでを自動化。

local-commander は、ローカル LLM を実行時の司令塔に据える AI 開発オーケストレーターです。MacBook Pro M3 + LM Studio で検証し、NVIDIA DGX Spark 上での常時稼働へ移行する前提のひな形アプリです。開発タスクを分類し、Implementation Brief、Codex 用プロンプト、Codex 結果評価、トークン使用量(実 API usage + 概算)を記録します。

Codex CLI や Claude Code を司令塔にすることはありません。Codex CLI は、ローカル LLM が `cloud-needed` と判断し、かつ利用者が `--run-codex` を明示し、人間承認ゲートを通過した場合にのみ呼ばれる外部エージェントです。

主な機能

タスク分類と Implementation Brief 生成

ローカル LLM がタスクを local-ok / cloud-needed / spec-missing に分類し、対応する Implementation Brief を生成します。

人間承認ゲート付き外部エージェント連携

cloud-needed かつ利用者が --run-codex を明示し、人間承認(--human-approved)を通過した場合のみ Codex CLI(--agent claude 指定時は Claude Code)を呼び出します。

トークン使用量の記録とコスト集計

各ステップの文字数と概算トークン数(chars ÷ 3.5)を記録し、OpenAI 互換 API が usage を返す場合は実測トークン数も保存します。npm run cost でモデル別・runId 別に集計します。

ライブ統制盤(Web UI)

npm run server で起動する常駐 Web UI(既定 http://localhost:4317)から、ジョブ一覧・承認インボックス・コストを一望できます。

Claude Code MCP 連携(eln-judge)

stdio MCP tool としてローカル LLM の判断だけをオフロードします。ファイル本文はシムがローカルで読み、tool の戻り値には判断・要約のみを含みます(v1 は読み取り専用)。

Asana / GitHub 連携と分類ベンチマーク

Asana API・GitHub API からタスクを取り込む TaskSource に対応し、npm run benchmark で複数モデル横断の分類精度・安全性・速度を計測します(M1〜M6)。

社内運用

プロダクト一覧に戻る

local-commander についてのお問い合わせは、ヘッダーの「お問い合わせ」からご連絡ください。

local-commander