mcp-ollama
mcp-ollama
API課金型オーケストレーターからのオフロードを目的として、ローカルのOllamaモデルをラップするMCPサーバー。
ローカルモデルに作業を委譲する9つのツール(テキスト生成、要約、コードタスク、機械的な変換、コミット/PR/変更履歴のドラフト作成)を提供します。オーケストレーターが何をローカルにルーティングするかを決定し、このサーバーがそのルーティングを実行します。
トランスポート: stdio
ランタイム: Node 18以上
デフォルトモデル:
hermes3:8b(OLLAMA_MODELで上書き可能)Ollamaホスト:
http://localhost:11434(OLLAMA_HOSTで上書き可能)モデルの重み、外部への通信、テレメトリは一切含まれません。 すべてのリクエストはOllamaが実行されているホスト内で完結します。
ライセンス: Apache-2.0
なぜこれが必要か
トークン単位で課金されるオーケストレーター(Claude Code、Cursor、Anthropic API、Cline、Aiderなど)では、分類、docstring作成、コミットメッセージ作成のたびにコストが発生します。その作業のほとんどは、最先端の巨大モデルを必要としません。同じマシン上のOllamaにルーティングすれば、同じ作業を無料で、より高速に行えます。mcp-ollamaはそのルーティングの窓口となります。
オーケストレーションを行うモデルが、何をどこにルーティングするかを決定します。このサーバーは単なる配管であり、タスク分類について賢い判断をしようとはしません。適切なツールを選び、テキストを渡し、結果を受け取るだけです。
Related MCP server: ProjectBrain
インストール
ソースから
git clone https://github.com/true-alter/mcp-ollama.git
cd mcp-ollama
npm install
npm run buildまた、少なくとも1つのモデルをプル済みのOllamaインスタンスが実行されている必要があります:
# Default — 8B, fast, good for classifications and short generations
ollama pull hermes3:8b
# Optional — code-specialised, heavier, better for local_code tasks
ollama pull qwen2.5-coder:32bDocker
docker build -t mcp-ollama .
docker run -i --rm \
-e OLLAMA_HOST=http://host.docker.internal:11434 \
-e OLLAMA_MODEL=hermes3:8b \
mcp-ollama提供されているDockerfileはhost.docker.internal:11434を指しているため、コンテナからホスト上のOllamaにアクセスできます。
実行 (stdio)
node dist/index.jsStdioサーバーはMCPクライアント(Claude Code、Cursorなど)によって起動されます。直接実行するのはデバッグ目的の場合のみです。
Claude Codeの設定
claude mcp add --transport stdio ollama -- node /absolute/path/to/mcp-ollama/dist/index.jsまたは ~/.claude/settings.json に記述します:
{
"mcpServers": {
"ollama": {
"transport": "stdio",
"command": "node",
"args": ["/absolute/path/to/mcp-ollama/dist/index.js"],
"env": {
"OLLAMA_HOST": "http://localhost:11434",
"OLLAMA_MODEL": "hermes3:8b"
}
}
}
}ツール
ツール | 用途 |
| システムプロンプトとユーザープロンプトを使用した汎用的な生成 |
| テキストの要約 |
| 特定の質問に対するテキストの分析 |
| 指定されたスタイルでのコンテンツドラフト作成 |
| コードタスク: docstring / テスト / 解説 / レビュー / 型定義 / リファクタリング提案 |
| Diffベースのタスク: コミットメッセージ / PR説明 / 変更履歴 / 要約 / 影響分析 |
| 機械的なコード変換 |
| ローカルのOllamaホストで利用可能なモデルの一覧表示 |
| ローカルのOllamaホストへのモデルのプル |
ツールの完全なスキーマはMCPのイントロスペクションを通じて公開されるため、MCP対応クライアントであれば自動的に列挙されます。
環境変数
変数 | デフォルト | 用途 |
|
| Ollama HTTPエンドポイント |
|
| ツール呼び出しで |
ツール呼び出し時にmodelを明示的に上書きすることも可能です。環境変数のデフォルト値は、指定がない場合にのみ適用されます。local_codeは呼び出しごとにコード特化モデルを指定した方がうまくいく傾向がありますが、local_summarizeやlocal_draftはデフォルトのままで十分です。
モデル選択のガイドライン
ワークロード | 推奨モデル | 理由 |
分類、ワンライナー、タグ付け |
| 最速のラウンドトリップ、低コスト |
コミットメッセージ、変更履歴、要約 |
| 高品質、16GB GPUでも快適に動作 |
コードレビュー、docstrings、テスト |
| コード特化モデル |
フォールバック / 未知のモデル |
| まず確認してからルーティング |
ホストで何が利用可能か不明な場合は、セッション開始時にlocal_modelsを使用してください。
トラブルシューティング
ツール呼び出し時に Ollama error 404 が発生する場合。 モデルがプルされていません。ollama pull <name>を実行するか、クライアントからlocal_pullを呼び出してください。
fetch failed / 接続拒否。 Ollamaが実行されていないか、OLLAMA_HOSTの設定が間違っています。curl $OLLAMA_HOST/api/tagsで確認してください。コンテナ内ではlocalhostはコンテナ自身を指すため、macOS/Windowsではhost.docker.internalを、LinuxではブリッジIPを使用してください。
ツール呼び出しが遅い。 コールド状態のモデルへの最初の呼び出しにはロード時間がかかります。同じOllamaプロセス内での後続の呼び出しははるかに高速です。モデルが利用可能なVRAMより大きい場合、OllamaはCPUにフォールバックします。ollama psで確認してください。
出力が空、または切り捨てられる。 max_tokensのデフォルトはツールごとに2048です。長い生成を行う場合は、ツール呼び出し時にmax_tokensを明示的に指定してください。
セキュリティ体制
mcp-ollamaは、設定されたOLLAMA_HOST以外へのネットワーク呼び出しを一切行いません。テレメトリ、分析、自動更新のping送信もありません。ツールへの入力はOllamaのHTTP APIにそのまま転送され、レスポンスが中継されるだけです。サーバー自体は呼び出し間でステートレスです。
Ollamaをlocalhost(デフォルト)で実行している場合、ループ全体がホスト内で完結します。OLLAMA_HOSTをリモートエンドポイントに向ける場合は、そのエンドポイントのセキュリティ体制を信頼できるものとして扱ってください。誤ってサードパーティのホストにプロンプトを送信してしまうリスクは常に存在します。
セキュリティ上の問題を報告する場合は、SECURITY.mdを参照してください。
貢献
バグ報告や小さなパッチを歓迎します。CONTRIBUTING.mdを参照してください。大きな設計変更については、時間を投資する前にまずIssueを開いてスコープについて議論してください。
ALTERの一部として
mcp-ollamaは、AI経済のためのアイデンティティインフラストラクチャの一部としてALTERによって保守されています。ALTERアイデンティティMCPサーバーはmcp.truealter.comでホストされています。TypeScriptクライアントについては@truealter/sdkを参照してください。
ライセンス
Apache License 2.0。全文はLICENSEを参照してください。Copyright 2026 Alter Meridian Pty Ltd (ABN 54 696 662 049)。
Tool Schema Changelog
Recent tool additions, removals, and schema changes observed during successful MCP inspections. Dates show when Glama detected each change.
No tool schema history has been recorded yet.
This server cannot be installed
Maintenance
Related MCP Connectors
AI Reasoning Cache & Consensus Layer with 11 MCP tools via Streamable HTTP.
AI-native git hosting — repos, PRs, issues, CI gates, and AI code review over MCP (60 tools).
MCP server for progressive tool usage at any scale (see https://klavis.ai)
Nifty's MCP server — exposes tasks, projects, messages, and files as tools for AI agents.
Related MCP Servers
- AlicenseCqualityDmaintenanceA privacy-first MCP server that provides local LLM-enhanced tools for code analysis, security scanning, and automated task execution using backends like Ollama and LM Studio. It enables symbol-aware code reviews and workspace exploration while ensuring that all code and analysis remain strictly on your local machine.36ISC
- AlicenseBqualityBmaintenanceLocal MCP server providing project cognition capabilities for AI coding agents, including context packs, impact analysis, and git diff review through stdio communication.103MIT
- AlicenseNot gradedqualityBmaintenanceSelf-hosted MCP server using Ollama for local AI-powered code analysis, refactoring, and optimization. Integrates with VS Code via Continue or Roo.MIT
- AlicenseNot gradedqualityCmaintenanceMCP server for reviewing code changes using LLMs, supporting Copilot, Ollama, and OpenAI-compatible endpoints.MIT
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/true-alter/mcp-ollama'
If you have feedback or need assistance with the MCP directory API, please join our Discord server