OpenSquilla は、トークン効率の高いマイクロカーネルAIエージェントで、各プロンプトを実際に処理できる最も安いモデルへルーティングします。「For You」フィードで、あるユーザーが固定モデルとスマートルーティングで2つの新規プロジェクトを実行したところ、トークン数は18.9%増えたのにコストは19.2%減ったと報告しました。コストを決めるのは毎回どこのティアに落ちるかだからです。Apache 2.0でセルフホスト可。永続メモリ、多層サンドボックス、内蔵ウェブ検索、ローカル埋め込みをひとつの共有ターンループに統合します。
主な機能
- スマートルーティング: MLルーターが毎回候補モデルをランク付け。単純なプロンプトは安いティアへ、複雑なものは上位へ。ハイブリッド特徴解析は手作り特徴と埋め込みベースの意味特徴を組み合わせます。
- 複数モデルアンサンブル: 難問は複数候補に割り当てて回答を集約し、単一モデルを超える場合も。コスト対応のフォールバックが単一モデルで足りる時はアンサンブルをスキップ。
- マイクロカーネル構造: 約100行のコンパクトなコアオーケストレーター+5層分離。機能はプラグイン可能で、エラーは自動スキップ・ロールバック。
- 4層の永続メモリ: コンテキストを蓄積し、エージェントはゼロから始めない。
- ローカル埋め込み: ONNXのオンデバイス推論(オフライン・データはローカルに保持)。任意でOpenAI/Ollamaバックエンド。
- 広いチャネル対応: ターミナル、Web、Slack、Discord、Telegram、MS Teams、Matrix、Lark、DingTalk、WeCom、QQ を1つの設定エージェントで。
- 耐久性のあるスケジュール: SQLiteベースのセッションと CronExpression を解析するスケジューラー。
使用シナリオ
このツールを使うべき人は?
- オンプレミスチーム: データがネットワークから出ない完全オフラインのルーティングが必要な人。
- コンプライアンス重視の組織: 3層ポリシー、ハッシュ化された意思決定ログ、人間の承認ゲートを求めるところ。
- 予算制約のあるビルダー: ルーターが最もコスト効果の高いモデルを選び、同コストでより多くのタスクを実行したい人。
- マルチチャネル運用者: 1つのエージェントを多プラットフォームで届けたい人。
解決する問題
- フロンティア呼び出しの浪費: 簡単なタスクへの高額モデルは、エージェントスタックで最大の回避可能コストです。
- 単一モデルの上限: 1つのモデルで安さと難しさの両方をカバーするのは難しく、ルーティングとアンサンブルがコスト品質フロンティアを広げます。
- データ流出リスク: ローカルルーティングとオンデバイス埋め込みが敏感な作業を境界内に保ちます。
料金プラン
| プラン | 価格 | 備考 |
|---|---|---|
| オープンソース | ¥0 | Apache 2.0、セルフホスト可、主要機能すべて。 |
| TokenRhythm API | 従量課金 | 公開時に68元のクレジット、招待特典、毎日抽選。 |
60-80% のトークンコスト削減はプロジェクト自身の主張です。OpenClaw や Hermes Agent との比較も自作ベンチマークなので、監査済みデータではなく方向性の参考として扱ってください。
優位性と独自の価値提案
- コンテンツ依存の選択: 設定固定のフォールバックチェーンとは違い、OpenSquilla はタスク複雑度と実行状態に基づき毎回選択します。
- コストフォールバック付きアンサンブル: 複数モデル集約で品質を上げつつ、1モデルで足りる時は重い実行をスキップ。
- セルフホスト&オフライン: MLルーターがローカルで動き、ルーティング判断を社内に留められます。
はじめに
- リポジトリをクローンし、ソースからインストール、またはリリースパッケージを取得。
- プロバイダーを設定: レイヤーは OpenRouter、OpenAI、Anthropic、Ollama、DeepSeek、Gemini、Qwen/DashScope など約20社に接続。
- コンソールを起動: ターミナル(
agent)、Web UI、またはチャットチャネルを選択。 - ルーティングを有効化: 毎回のティアをルーターが決定。難問にはアンサンブルを任意で有効化。
一次リソース:OpenSquilla 公式サイト、GitHub リポジトリ、機能カタログ。
よくある質問
OpenSquilla はモデルですかフレームワークですか?
フレームワーク/ランタイムです。設定したモデルへルーティングするもので、ウェイトは自作しません。
完全にオフラインで動きますか?
はい。MLルーティングとONNX埋め込みはローカルで動作。任意のウェブ検索とホスト型プロバイダーだけがマシンの外に出ます。
OpenClaw とどう違いますか?
OpenSquilla の自作表は自身を「マイクロカーネル+MLルーティング」、OpenClaw を「プラグインエコシステム+設定固定の主従フォールバック」と位置づけます。これらはベンダー主張なので、自タスクで検証を。
対応プロバイダーは?
OpenRouter、OpenAI、Anthropic、Ollama、DeepSeek、Gemini、Qwen/DashScope、および約20社。スキーマ変更不要。
代替案
- LangGraph:明示的制御フローのグラフベースエージェントフレームワーク。
- CrewAI:ロールベースのマルチエージェントフレームワーク。
- OpenCode:コーディングワークフロー向けのエージェントCLI。
ヒントとベストプラクティス
- 必要な時だけアンサンブルを有効化: コストフォールバックがあるので、毎回集約分を払う必要はありません。
- プロバイダー予算を宣言: 毎回のルーティングは、消費ティアの上限も決めてこそ意味があります。
- ベンダー比較は方向として読む: 削減と品質差は OpenSquilla 自身の並列テストに基づきます。
まとめ
OpenSquilla は、「大半のターンはフロンティアモデルを必要としない」と確信するチームのためのものです。ルーティング、メモリ、サンドボックス、検索、チャネル対応を、監査可能な Apache 2.0 コアとともに1つのセルフホスト型ランタイムにまとめました。固定モデルプランが些細な質問でクレジットを燃やすのが痛手なら、ルーティングは最も安い構造的解決策であり、OpenSquilla はそれを設定可能かつローカルで実現します。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
agentmemory
agent-memory.dev
AI コーディングエージェント向けの永続・検索可能メモリ。LongMemEval で R@5 95.2%、SQLite でローカル動作、MCP・フック・54 ツールで Claude Code・Cursor・Codex に対応。
Trigger.dev
trigger.dev
TypeScript で AI エージェントを構築するためのオープンソースの耐久実行プラットフォーム。タイムアウトなしの長時間タスクとチャットエージェントを、チェックポイント再開、リトライ、キュー、可観測性とともに提供。実際の計算時間のみ課金。
UI-TARS-desktop
agent-tars.com
ByteDance のオープンソース視覚マルチモーダルエージェントスタック。人間のように PC とブラウザを操作し、Agent TARS CLI・リモートオペレータ・UI-TARS-1.5 を提供。
関連インサイト

Anthropic Subagent: マルチエージェント時代のアーキテクチャ革命
Anthropicのマルチエージェントアーキテクチャ設計を徹底解説。Subagentによるコンテキストウィンドウ制限の突破、90%のパフォーマンス向上、Claude Codeでの実際の応用について学びます。
AI アシスタントをチャットボックスに押し込むな:Clawdbot は戦場を間違えた
Clawdbot は便利だが、Slack や Discord に入れて操作するのは最初から間違った設計だ。チャットツールはタスク操作のためのものではなく、AI もおしゃべりのためではない。

Grok Bot と Hermes Bot:一人に、ようやく参謀本部と事務局がつく
Grok Bot は Cursor Pro+ に入った。Hermes Bot は VPS で走る。より賢いチャット窓ではない。助言するのは参謀本部、実行するのは事務局、決裁するのはあなただ。