Skip to main content
Glama
mobus-ai

MobusMCP

Official
by mobus-ai

Mobus

Datensatzsuche für KI-Assistenten Entdecken, betrachten und analysieren Sie Datensätze von 20 Plattformen in einem einzigen Gespräch.

License: MIT Node.js MCP TypeScript


Verbindung zu Claude herstellen

Fügen Sie Mobus in unter einer Minute zu Claude hinzu. Keine Installation, keine API-Schlüssel, nichts muss ausgeführt werden.

  1. Öffnen Sie claude.ai (oder Claude Desktop / Mobile)

  2. Gehen Sie unten links auf Einstellungen → Connectors

  3. Klicken Sie auf Add custom connector

  4. Nennen Sie ihn Mobus und fügen Sie diese URL ein:

https://mobus-production.up.railway.app/mcp
  1. Starten Sie einen neuen Chat und versuchen Sie:

"Suche nach Luftqualitätsdatensätzen mit einer kommerziellen Lizenz"

Das ist alles. Alle 15 Tools sind sofort verfügbar.



Related MCP server: dataset-search-mcp

Was es tut

Fragen Sie einfach Ihren KI-Assistenten.

"Suche nach Luftqualitätsdatensätzen mit einer kommerziellen Lizenz" "Zeige eine Vorschau der ersten 20 Zeilen dieses Zenodo-Datensatzes" "Finde SEC-Einreichungen, die Klimarisiken erwähnen" "Erstelle ein APA-Zitat für diesen Hugging Face-Datensatz" "Prüfe, ob dieser Datensatz kommerziell genutzt werden kann" "Visualisiere diesen Datensatz"

Mobus verteilt Anfragen parallel an jede konfigurierte Plattform, prüft Lizenzen, zeigt Daten in der Vorschau an, generiert Zitate und verfolgt die akademische Herkunft – und schlägt elegant fehl, wenn ein API-Schlüssel fehlt.


Tools

Entdeckung

  • search_datasets — durchsucht alle 20 Plattformen gleichzeitig

  • find_research_datasets — in wissenschaftlichen Arbeiten verwendete Datensätze

  • find_similar — Datensätze, die einem vorhandenen ähneln

Bewertung

  • get_dataset_details — vollständige Metadaten

  • preview_dataset — erste N Zeilen

  • compare_datasets — 2-5 Datensätze im direkten Vergleich

Qualität & Compliance

  • assess_quality — fehlende Werte, Duplikate, Statistiken

  • check_license — kommerziell / akademisch / intern

  • check_compatibility — Schema-Abgleich mit Ihrem eigenen

Zitation & Ausgabe

  • generate_citation — APA, BibTeX, Chicago

  • visualize_dataset (Funktioniert nur lokal - bitten Sie Claude, ein Artefakt zu generieren). — interaktives ECharts-Dashboard

  • watch_query — Überwachung auf neue Datensätze

Fortgeschrittene Forschung

  • get_dataset_provenance — Einführung in Arbeit & Historie

  • get_dataset_lineage — Varianten & Derivate

  • trace_citation_graph — Analyse der Zitationskette


Unterstützte Plattformen

Keine Authentifizierung erforderlich

  • data.gov

  • Zenodo

  • OpenML

  • UCI ML Repository

  • AWS Open Data

  • World Bank

  • WHO GHO

  • NASA Earthdata

  • Eurostat

  • arXiv

  • Census.gov

  • SEC EDGAR

  • Crossref

Optionale Authentifizierung

  • Hugging Face (schneller mit Token)

  • Socrata (schneller mit Token)

  • Semantic Scholar

Erfordert Schlüssel

  • Kaggle

  • Google Dataset Search

Eingeschränkt

  • Papers with Code (API abgeschaltet)

  • Econdb (erfordert jetzt Schlüssel)

Fehlende Schlüssel führen dazu, dass die jeweilige Plattform automatisch übersprungen wird. Der Server stürzt niemals ab.


Lokal ausführen (optional)

Wenn Sie das Hosting lieber selbst übernehmen möchten, anstatt die oben genannte gehostete Version zu verwenden:

git clone https://github.com/hrantvirabyan/Mobus.git
cd Mobus
npm install
cp .env.example .env   # fill in any keys you have (all optional)
npm run build

Cursor

Fügen Sie dies zu ~/.cursor/mcp.json hinzu:

{
  "mcpServers": {
    "mobus": {
      "command": "node",
      "args": ["/absolute/path/to/Mobus/dist/main.js"]
    }
  }
}

Starten Sie Cursor neu. Alle 15 Tools erscheinen im Chat.

Claude Desktop

Gleiches Konfigurationsformat, in ~/Library/Application Support/Claude/claude_desktop_config.json (macOS) oder %APPDATA%\Claude\claude_desktop_config.json (Windows).

API-Schlüssel (alle optional)

Variable

Für

Wo

KAGGLE_USERNAME / KAGGLE_KEY

Kaggle

kaggle.com/account → API

HF_TOKEN

Hugging Face

huggingface.co/settings/tokens

GOOGLE_API_KEY / GOOGLE_CSE_ID

Google

console.cloud.google.com

SOCRATA_APP_TOKEN

Socrata

dev.socrata.com/register


Tool-Referenz

search_datasets

Parameter

Typ

Standard

Beschreibung

query

string

erforderlich

Suchanfrage

sources

string[]

alle

Einzubeziehende Plattformen

limit

number

5

Ergebnisse pro Quelle (max 20)

license

string

—

z. B. cc-by-4.0

format

string

—

z. B. csv, parquet

updated_after

string

—

ISO-Datum

modality

string

—

z. B. tabular, image

get_dataset_details

Parameter

Typ

Beschreibung

source

string

Plattform

dataset_id

string

Datensatz-ID

preview_dataset

Parameter

Typ

Standard

Beschreibung

source / dataset_id

string

erforderlich

—

rows

number

10

Max 100

visualize_dataset (Funktioniert nur lokal - bitten Sie Claude, ein Artefakt zu generieren)

Generiert ein interaktives ECharts-Dashboard mit Spaltenauswahl, Filter-Builder, Zeilenbereichsauswahl, 9 Diagrammtypen, sortierbarer Tabelle und PNG/SVG/CSV/JSON-Export.

Parameter

Typ

Standard

Beschreibung

source / dataset_id

string

erforderlich

—

rows

number

200

Max 500

open

boolean

true

Browser automatisch öffnen

compare_datasets

Parameter

Typ

Beschreibung

datasets

array

2-5 {source, dataset_id} Objekte

check_compatibility

Parameter

Typ

Beschreibung

source / dataset_id

string

—

schema

array

[{name, type?}]

find_similar

Parameter

Typ

Standard

Beschreibung

source / dataset_id

string

erforderlich

—

limit

number

5

Max 20

generate_citation

Parameter

Typ

Standard

Beschreibung

source / dataset_id

string

erforderlich

—

format

string

apa

bibtex, apa, chicago

assess_quality

Parameter

Typ

Standard

Beschreibung

source / dataset_id

string

erforderlich

—

sample_rows

number

100

Max 500

check_license

Parameter

Typ

Beschreibung

source / dataset_id

string

—

use_case

string

commercial / academic / internal / redistribution

watch_query

Parameter

Typ

Beschreibung

action

string

add / remove / list / check

query / sources / watch_id

—

Siehe Aktion

find_research_datasets

Parameter

Typ

Standard

Beschreibung

query

string

erforderlich

Forschungsthema

limit

number

10

Max 20

semantic

boolean

false

SPECTER v2 Embeddings

get_dataset_provenance / trace_citation_graph / get_dataset_lineage

Derzeit eingeschränkt — abhängig von der Papers with Code API, die abgeschaltet wurde.


Bekannte Probleme

  • Papers with Code API wurde nach der Übernahme durch HuggingFace abgeschaltet — Tools für Herkunft/Provenienz/Zitationsgraph geben Fehler zurück

  • Econdb erfordert jetzt einen Schlüssel — gibt nichts zurück, bis Unterstützung hinzugefügt wird

  • arXiv drosselt bei hoher paralleler Last (Adapter verwendet 3s Drosselung)


Mitwirken

Siehe CONTRIBUTING.md. Wenn Mobus Ihnen Zeit spart, hilft ein GitHub-Stern anderen, es zu finden.

Lizenz

MIT — siehe LICENSE.

Related MCP Connectors

Related MCP Servers

  • A
    license
    B
    quality
    D
    maintenance
    Connects open data to LLMs via MCP, enabling easy access to public datasets and publishing new datasets with community help.
    3
    MIT
  • A
    license
    Not graded
    quality
    D
    maintenance
    Unified MCP server for discovering open datasets across Hugging Face, Zenodo, and Kaggle, with ranked search results and one-click Colab starter code generation.
    1
    MIT
  • A
    license
    A
    quality
    A
    maintenance
    Enables Claude and other MCP-compatible agents to process documents, extract structured data, detect PII, and export LLM-ready datasets through natural language tool calls.
    8
    1
    MIT