jiro
Jiro Search API 🔍
Локальная и AI-нативная веб-поиск и скрейпинг-запрос API — это готовая замена самостоятельному размещению SerpAPI с MCP-сервером, агентными исследованиями и встроенной правовой поддержкой.
Jiro напрямую парсит Google, Bing, DuckDuckGo, Brave, YouTube, Amazon, eBay, Yandex и Baidu — без стороннего поискового API, без оплаты за каждый запрос и без привязки к облаку. Результаты кэшируются локально в SQLite (кэш-ответы менее чем за 50 мс), предоставляются через REST API, совместимый с SerpAPI, и предназначены для вызова AI-агентами: схемы вызова функций для OpenAI/Anthropic/Gemini, сервер Model Context Protocol (MCP), обёртки LangChain/LlamaIndex и агентный цикл /ai/search, который планирует → ищет → читает страницы → формирует ответ с цитатами. Используйте собственные ключи (BYOK) для прокси, решения CAPTCHA и LLM-провайдеры.
Статус: MVP, готовый к использованию (открытый исходный код, MIT). Разверните его самостоятельно за $0 или подпишитесь на Jiro Cloud для управляемого прокси-парка, SLA и панели соответствия. Ответственное использование: поисковые системы активно защищаются от ботов. Поэтому с резидентских IP (и с прокси BYOK) Google/DuckDuckGo работают; с IP дата-центров Jiro автоматически переключается между движками (
google → bing → brave → duckduckgo). Уважайте условия каждого движка иrobots.txt.
Зачем Jiro? (Альтернатива самостоятельно развёртываемому сервису SerpAPI)
Проблема с закрытыми поиковыми API | Решение Jiro с открытым кодом |
💸 SerpAPI стоит $200+/мес за 100 тыс. запросов | Бесплатно — запускайте на своей инфраструктуре (MIT) |
☁️ Привязка к облаку: ваши запросы покинули ваш сеть | 100% локально — ваши запросы, ваши данные, ваша безопасность |
🤖 Нет встроенной интеграции с AI-агентами | MCP + Function Calling + LangChain/LlamaIndex из коробки |
⚖️ Юридическая серая зона (robots.txt, ToS) | Встроенное соответствие: парсер |
🔍 Хрупкие парсеры ломаются при изменении интерфейсов | Самовосстанавливающиеся селекторы + автоматическая цепь из 9 движков |
Related MCP server: Scout MCP Server
Начало работы в одну команду
pip install jiro-search # or: uv tool install jiro-search
jiro serve # API on http://localhost:8000 (docs: /docs)Всё — рабочий API поискового движка, который разворачивается на своих мощностях один команда.
# Search (SerpAPI-compatible endpoint)
curl "http://localhost:8000/search.json?engine=google&q=python+web+scraping&num=5"
# Scrape a page into clean markdown
curl -X POST http://localhost:8000/scrape \
-H "Content-Type: application/json" \
-d '{"url":"https://example.com","format":"markdown"}'
# Agentic research with citations
curl -X POST http://localhost:8000/ai/search \
-H "Content-Type: application/json" \
-d '{"query":"What is the best Python web scraping library in 2026?","max_sources":5}'Матрица возможностей
Возможность | Jiro (OSS) | SerpAPI | ScraperAPI | Bright Data |
Веб-поиск — 9 движков | ✅ | ✅ | ❌ | ❌ |
Universal Web Scraper (markdown/text/html/JSON) | ✅ | ❌ | ✅ | ✅ |
Агентные исследования ( | ✅ | ❌ | ❌ | ❌ |
MCP-сервер (stdio + Streamable HTTP + SSE) | ✅ | ❌ | ❌ | ❌ |
Function-Calling Schema (OpenAI/Anthropic/Gemini) | ✅ | ❌ | ❌ | ❌ |
Соответствие требованиям (robots.txt, ToS, аудит) | ✅ | ❌ | ❌ | ❌ |
Гладский Сервер / Air-Gapped | ✅ | ❌ | ❌ | ❌ |
BYOK прозрачное + CAPTCHA | ✅ | ❌ | Частично | ✅ |
Open-source (MIT) | ✅ | ❌ | ❌ | ❌ |
Цена | Free | $200+/mo | $199+/mo | $500+/mo |
Что включено
Область | Возможности |
Механизмы | Google (Паулина/news/videos/shopping/places), Bing (вес/картинки/news/videos), Brave (без/невес/видео), DuckDuckGo (без/кар), YouTube, Amazon, eBay, Yandex, Baidu |
Отказоустойчиа | Автоматический отказ от движков, чередование UA, повтора с экспоненциальным ростом, переключатель цепи для каждого движка, обнаружение бот-стен, option Playwright fallback для JS-гenри صفحات |
Кэш | SQLite (WAL) или Redis с TTL, |
Скрапинг | URL → markdown/text/html/json, извлечение readable, для распоз; OpenGraph/Twitter/JSON-LD metadata, link/images, извлечение схем для LLM, custom CSS/XPath/JSONPath recipes |
AI-остинс | OpenAI/Anthropic/Gemini schemas; MCP-сервер ( |
BYOK | HTTP?/SOCKS5 socks; вопросы: BrightData/Posts/VPN/ScraperAPI/ZenRows/Smartproxy; CAPTCHA solvers (2Captcha/value); LLM keys (OpenAI, Anthropic, Gemini, OpenRouter, LM Studio) — всё через config/env |
Async multifunk |
|
Команда | Hashed API„”its, admin roles + scopes, per-key rates, JWT, tracked counts (-/usage, ✓/metrics) |
Ops | Prometheus |
Конфиден.циаль | Никогда телеметрия, запросы по умолчанию не разделяют, все данные в локалях |
Rat ref | async pamphlets + selectolax (C-), ~15 core-зависимостей, старт < 1 с |
Jiro против SerpAPI, ScraperAPI, Bright Data
Jiro — это достойный opеn-source, self-hostable проект, который combines search + scrape + agentic AI research + MCP of the basis, and the mount Assembly Legal comprehension in the base. Locked competitors ask $200–$3 bill/month for this by measure, goal of self-hostal-м.
→ Inside: vs SerpAPI · vs ScraperAPI · vs Bright Data
Интеграция с AI-Агнимами
Протокол Model Context (MCP)
Существовал бМодельный протокол Context (stdio, Streamable HTTP, legacy SSE), пришло в Jiro: веб-поиск в живом, скрапинг страниц, исследования.
jiro mcp # MCP server over stdio
jiro mcp --transport http # Streamable HTTP + SSE on :8000/mcpИнструментам: enquiry (search то 9 использует, 3 типа) · scrape · фразам: aid_search * анализ формируется)*. документы: search_and_summarize, compare_engines. Автодополнене: двигатели, типы, диапазоны, вых.
Claude Desktop
{
"mcpServers": {
"jiro": {
"command": "jiro",
"args": ["mcp"],
"env": { "JIRO_CONFIG": "~/.jiro/config.yaml" }
}
}
}Cursor / Continue.dev / Zed / Клине
Подключите MCP-клиент к серверной команде jiro mcp (подр. docs/mcp).
Function Calling (OpenAI / Anthropic / Gemini)
from jiro.ai.tools import openai_tools, anthropic_tools, gemini_tools
tools = openai_tools() # OpenAI / OpenRouter / OllamaLangChain / LlamaIndex
from jiro.ai.tools import langchain_tools, ToolSpec
tools = langchain_tools(search_fn=my_search, scrape_fn=my_scrape, ai_fn=my_ai_search)→ Tutorial: Build a Deep Research Agent with Jiro + Claude (MCP)
API Reference
Интерактивная документация по **ВАЖНО**http://localhost:7000/docs (Swagger) и http://localhost:8000/openapi.json.
Метод | Конечная точка | Опис |
|
| Совмещенный SerpAPI — |
|
| Псевдоним / JSON-тело |
|
| До 10 параллельных запросов |
|
| SSE-поток (single or multiple движком) |
|
|
|
|
| До 50 URL |
|
| План → поиск → ТОП-N → синтез ответа с ссылками |
|
| SSE-поток ( |
|
| Многошаговое автономное исследование |
|
| LLM-извлечение из URL/текста по кастомной схеме |
|
|
|
|
| Статус, движки, счётчики Prometheus |
|
| Управление хешированными ключами (admin) |
|
| Обмен API-ключа на JWT |
Аутентификация: изначально заголовок X-API-Key: jsk_... или параметр ?api_key=..., либо Authorization: Bearer <jwt>. Когда auth.enabled: false (по умолчанию), API открыт для локально использования.
RCLI
jiro serve # start the API server
jiro search web "python scraping" --engine bing --num 5 --json
jiro scrape "https://example.com" --format markdown
jiro ask "best python scraping library?" --max-sources 5
jiro mcp # MCP server over stdio
jiro config init # write ~/.jiro/config.yaml
jiro config show
jiro keys create --name "ci" --role user # prompts for admin key
jiro keys list
jiro keys revoke key_abc123
jiro usage --days 7
jiro plugins create myengine --author "Your Name" # scaffold a new engineConfiguration & Config
Настройки — в ~/.jiro/config.yaml или $JIRO_CONFIG. Замените при необходимости переменной окружения: JIRO_SERVER__PORT=9000, JIRO_AUTH__ENABLED=true. Секреты вносят через env: api_key: ${OPENAI_API_KEY}.
Сервис | Конфигурация | Пример из env |
Прокси (пользовательский) |
|
|
Прокси (BrightData) |
|
|
Прокси (Oxylabs/ScraperAPI/ZenRows/Smartproxy) |
|
|
CAPTCHA (2Captcha / CapSolver) |
|
|
LLM (OpenAI/Anthropic/Gemini/OpenRouter) |
|
|
LLM (Ollama, локально) |
| — |
Кэш Redis |
|
|
Развертывание
Docker
docker compose up -d # http://localhost:8000Helm (Kubernetes)
helm install jiro ./helm \
--set config.env.JIRO_AUTH__ENABLED=true \
--set config.envFromSecret=jiro-secretsВключает Deployment, Service, PVC (данные SQLite), опциональный Ingress и опциональный кэш Redis (--set redis.enabled=true).
Настройка команды (авторизация включена)
export JIRO_AUTH__ENABLED=true JIRO_JWT_SECRET=$(openssl rand -hex 32)
jiro keys create --name admin --role admin --admin-key "$ADMIN"
jiro keys create --name "alice" --role user --rate-limit 30💡 Open Core и монетизация
Jiro — open-source (MIT) и всегда будет бесплатным для самостоятельного размещения. Устойчивая модель:
Выпуск | Что это | Лицензия | Для кого |
Jiro OSS | Полный поиск/скрейпинг/AI/MCP, все движки, плагины, соответствие требованиям | MIT | Все — $0 |
Jiro Cloud (дорожная карта) | Управляемый хостинг, автоскейлинг, глобальный пул резидентных прокси, SLA, SSO, картина соответствия | SaaS | Команды и агенты |
Jiro Enterprise (дорожная карта) | Лицензия для автономной сети (BSL-1.0), путь к SOC 2, выделенная поддержка, приватные движки-плагины | Source-available | Финтех/Юр/Гос/ИИ-лаборатории |
Мы монетизируем удобство, соответствие и поддержку — но никогда не код. Вклад сообщества остаётся под лицензией MIT.
→ Дорожная карта: docs/ROADMAP.md
Документация
Производительность
Метрика | Значение |
Запуск | < 1 с |
Кэшированный поиск (SQLite) | ~1–3 мс за полный цикл в процессе |
Живой поиск Bing | ~0.3–0.8 с с IP дата-центра |
| ~0.3–0.9 с первое обращение, затем кэш |
Набор тестов | 380 тестов |
Структура проекта
jiro/
├── ai/ LLM providers, tool schemas, agentic loop (research + multi-step agent + SSE)
├── scraping/ HTTP client (UA rotation, retries, circuit breaker, proxy manager, browser fallback),
│ engines: google/bing/brave/duckduckgo/youtube/amazon/ebay/yandex/baidu
├── server/ FastAPI app: routers (search, scrape, ai, stream, jobs, admin, ops, system)
├── auth.py API keys (SHA-256 hashed), JWT, rate limiting
├── browser.py Playwright browser fallback (lazy, graceful degradation)
├── cache.py SQLite / memory cache manager
├── captcha.py BYOK CAPTCHA solvers (2Captcha, CapSolver)
├── config.py YAML + env config with ${VAR} interpolation
├── db.py SQLite (WAL): cache, api_keys, usage, jobs, semantic_cache, tos_acknowledgments
├── extract.py readability + metadata + HTML→Markdown
├── jobs.py async job queue + webhooks (HMAC-signed)
├── mcp.py MCP server (stdio): tools, prompts, resources, autocompletion
├── models.py Pydantic contracts
├── proxy.py BYOK proxy manager (provider presets, rotation, cooldown)
├── recipes.py CSS / XPath / JSONPath extraction recipes
├── redis_cache.py Redis cache backend
├── semantic.py embedding-based semantic cache
└── cli.py Typer CLI
tests/ parser fixtures + unit/API/integration/chaos/property testsРазработка
git clone https://github.com/DevAnimecx/jiro.git && cd jiro
pip install -e ".[dev,browser,redis,recipes]"
pytest -m "not network" # skip network-dependent tests
jiro serve --reloadСтатус дорожной карты
Фаза 1 (MVP) — ✅ CLI, конфигурация, сервер FastAPI, веб-движки google/bing/ddg, совместимый с SerpAPI JSON, кэш SQLite, аутентификация по API-ключу, схема инструментов OpenAI,
/ai/search, Dockerfile.Фаза 2 — ✅ Brave + Bing видео, типы изображений/новостей, командные ключи, MCP-сервер, обёртки LangChain/LlamaIndex, партия-скрейпинг,
/metrics, fallback через Playwright, BYOK-прокси + CATCOMPHA, SSE, Redis.Фаза 3 — ✅ многошаговое исследование
/ai/agent, рецепты CSS/XPath/JSONPath, извлечение LLM, реестр плагинов, асинхронные задачи + вебхуки.Фаза 4 — частично: семантический кэш готов; конвейеры RAG, горизонтальное масштабирование, маркетплейс парсеров сообщества пока остаются будущей работой. Входит Helm-чарт.
Лицензия и ответственное использование
MIT. Jiro — это инструмент для скрейпинга: уважайте условия использования каждого поисковика и robots.txt, соблюдайте корректные частоты запросов и используйте прокси/решения CAPOCHA на своё усмотрение. Весь трафик исходит из вашей сети; запросы видны только тем поисковикам, к которым вы обращаетесь.
Сообщество и поддержка
💬 GitHub Discussions — вопросы и идеи
🐛 Issues — баги и запросы функций
🐦 Следите за запуском: @DevAnimecx
Разработано Adarsh Kushwah · Blackvault Technology
Локально-ориентированный, AI-нативный поиск и скрейпинг — бесплатно, открыто и доступно для самостоятельно хостинга.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseNot gradedqualityCmaintenanceProvides 42+ MCP tools for browser automation, web scraping, and search, enabling AI agents like Claude and Cursor to browse, extract data, and run research agents on the live web.8

Scout MCP Serverofficial
AlicenseNot gradedqualityCmaintenanceEnables web search, scraping, extraction, and crawling through an MCP interface, allowing coding agents to access real-time web data.1MIT- AlicenseAqualityBmaintenanceEnables AI agents to perform multi-engine web search, fetch web pages, and extract clean Markdown content via MCP, with no API keys required.35MIT
- AlicenseNot gradedqualityBmaintenanceEnables AI agents to perform web searches with full content retrieval and multi-engine provenance, including trust scoring and local corpus persistence, via MCP integration.42Apache 2.0
Related MCP Connectors
Web research for agents: quality-scored Google search, webpage extraction, and deep research.
Hosted MCP with 91 agent tools: X, domains, SEO, Maps, Trends, Search, YouTube, TikTok, and more.
The best web search for your AI Agent
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/DevAnimecx/jiro'
If you have feedback or need assistance with the MCP directory API, please join our Discord server