OpenSquilla
OpenSquilla は、ローカルスマートルーターとメモリ統合によって開発者のトークンコストを 60~80% 削減し、品質をほぼ落とさないオープンソース AI エージェントフレームワークです。
ツール概要
OpenSquilla はエージェントと LLM プロバイダーの間にローカルで動作するモデルルーター(LightGBM/ONNX ベース)を配置し、毎回の複雑さを判断して、単純な問い合わせには安価なモデル、複雑な推論には高性能モデルを自動選択します。また 4 層のメモリにより約 80% のトークンをキャッシュし、コストをさらに圧縮します。PinchBench での 25 タスクのテストでは、OpenSquilla のスコアは 0.9251 で、常に Claude Opus 4.7 を使った場合の 0.9255 とほぼ同等でありながら、総コストは 6.233 ドルから 0.688 ドルに削減されました。
主な利点:品質を損なわない大幅なコスト削減、ローカルルーティングによるプロンプトのプライバシー保護、マイクロカーネルアーキテクチャ(コア約 100 行)によるプラグイン障害の影響回避と容易なモデル切替/ツール追加(5 行)、OpenClaw からのワンクリック移行、Slack/Discord/WhatsApp や中国のチャットツールへの対応、v0.4.0 での自己検証と自動テスト・修正機能。
欠点と導入ハードル:安定した MetaSkill は 9 個のみで、一部は LaTeX や ffmpeg などの外部ツールに依存、ネスト不可、単純なタスクでは過剰設計になりがち、自然言語トリガーの誤作動リスク、Linux やコマンドラインの知識が必要。
頻繁に AI エージェントを利用しトークンコストを重視する開発者や、データのローカル管理とコスト予測可能性を求める AI スタートアップに適しています。たまにしか使わないユーザーや完全なターンキーソリューションを求める場合には不向きです。プロジェクト自体はオープンソースで無償ですが、利用するモデルの API 呼び出しには使用量に応じた費用がかかります。