Skip to main content
Glama
SAKURAfan1023

Scholar Library

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault
TEXTIN_APP_IDNoTextIn 应用 ID,按需配置;本地文字层解析不需要
OPENALEX_API_KEYNoOpenAlex 检索 API key;按服务商当前要求配置
SCHOLAR_DATA_DIRNo本地库目录,用于存放 SQLite、原件、证据与导出。默认 ~/.local/share/scholar-library~/.local/share/scholar-library
EMBEDDING_API_KEYNo可选语义向量服务 API key;非必需
TEXTIN_SECRET_CODENoTextIn 密钥,按需配置;本地文字层解析不需要

Instructions

Guidance the server publishes about itself, which clients place ahead of the tool catalog so the model reads it before choosing anything.

This server publishes no instructions, or was last inspected before Glama recorded them.

Capabilities

Features and capabilities supported by this server

Protocol revision2025-11-25

CapabilityDetails
tools
{
  "listChanged": false
}
prompts
{
  "listChanged": false
}
resources
{
  "subscribe": false,
  "listChanged": false
}
experimental
{}

Tools

Functions exposed to the LLM to take actions

NameDescription
workspace_statusA

检查安装版本、本地库、已配置凭据(不返回秘密)、项目;不发起联网请求。

create_projectA

建立单人研究项目;input_root是用户明确指定的输入目录。policy须反映用户授权,默认全部关闭;预算是累计页数和请求上限。

update_project_policyA

按用户授权修改项目服务与预算;先读取当前revision。预算不能低于已预留用量。

list_input_filesA

仅列输入目录第一层的普通文件名和大小,不读内容、不递归、不上传。

list_recordsB

分页找回文献、版本、任务、笔记、关系、检索和核验记录。job列表不重提;内容记录要求host_text授权。

add_workA

保存题录(title必填;doi/pmid/arxiv、authors、year、journal、url等)。一致标识和标题才自动复用;冲突保留独立记录。

read_recordA

分页读取已保存研究、方法评价、来源、关系或检索记录的完整JSON。先list_records找ID;按next_offset续接。

update_workB

修订题录和阅读/纳入状态,保留历史;excluded必须提供理由。selection:unread/reading/included/excluded/read。

search_literatureA

在crossref/openalex/arxiv/pubmed检索,分别报告失败及成功。保存检索式与结果,不自动纳入或下载;会消耗项目请求预算。

resolve_identifierA

解析DOI、pmid:或arxiv:标识符并保存题录;不获取全文。

verify_workA

联网核对DOI与标题及Crossref更新通知,保留证据和查询时间;未查到撤稿不等于可靠。

import_referencesA

导入授权目录内的BibTeX、RIS或CSL-JSON题录;附件须另行导入,不爬取付费数据库。

import_documentB

本地导入PDF/DOCX/PNG/JPG/MD/TXT,保留不可变原件;不上传。每个新文件版本单独保存。

download_fulltextA

从用户选定的公开HTTPS地址下载PDF,最多100MiB;检查每次重定向,不处理账号、付费墙或登录页。

parse_local_pdfA

免费离线解析PDF文字层,无上传;扫描页需TextIn OCR。公式、表格、阅读顺序须看原页复核。切换解析器会使旧引用过期。

parse_documentA

按项目授权向TextIn上传原件并解析指定页范围;每批最多100页。页范围只限制处理,上传的是整个文件。相同版本和范围复用原任务,包括失败/未知提交。

get_parse_jobB

默认只读本地任务;poll=true查询已有远端任务,至少间隔3秒。结果保存并合并各批页面,不重新上传。

retry_parseA

仅按用户明确重试决定调用。失败/提交未知可能已计费;本次另预留页数,不能保证上游只计费一次。先get_parse_job读取revision。

resume_parse_observationB

用户解决限流后恢复已知任务的查询;不会上传或重提,下一次get_parse_job(poll=true)才联网。

find_duplicate_candidatesA

查找同标识冲突或标题相似的候选,不自动合并不同版本或附件。最多比较最近1000条,候选上限100。

save_method_reviewB

保存宿主的方法评价及局限,必须关联该文献原文;这是AI评价而非已确认的来源身份或客观质量分数。

extract_fieldsB

调用TextIn字段/表格抽取,会上传整个PDF或图片并预留全部页数;结果需复核,不成为原始证据索引。相同请求复用任务。

read_extractionB

有界读取已缓存的TextIn原始抽取JSON文本;保留上游位置字段,无可靠定位的字段不得作为核验通过的证据。

read_parse_resultA

有界读取已缓存的完整xParse原始JSON,包含上游返回的表格结构、字符细节和页元数据;不上传或重提。按next_offset续接。

read_documentB

按原文顺序分页读取当前解析片段、页序和质量信息,不调用OCR。无页码的DOCX/文本用段落定位。

read_evidenceA

读取准确引用片段及版本、页序、原始坐标和识别疑点。单片段不证明完整上下文。

read_pageA

返回原始PDF页或图片的真实MCP图像,用于核对公式、图表、双栏及OCR误差。page为从1开始的PDF页序,不是印刷页码。

search_libraryB

本地中英文关键词检索,限定可选版本和字符预算;仅召回当前原文证据,摘要和笔记不作为原始证据。

build_evidence_packB

构建有界证据包和关联阅读线索。默认本地关键词;semantic=true会将问题发送至项目配置的embedding服务,需要授权与已建索引。

index_semantic_searchB

将最多32个原文片段发送到已配置的embedding服务并本地保存向量;重调续接,模型改变后使用新索引。

save_researchA

保存宿主生成的阅读卡片/回答/综述。author主张必须引原文;引用须同项目、当前解析、精确摘录。此工具仅校验引用完整性,语义支持需宿主/用户检查。产物不进入原文索引。

connect_papersA

保存文献联系;支持/反对关系必须提供两端原文证据和具体条件说明。similar仅是线索。

export_researchB

导出MD/JSON/CSV/BibTeX/RIS/CSL-JSON/HTML/PDF/DOCX及证据清单;拒绝过期产物。style=gb7714或apa;原全文不打包。

convert_documentB

将已有解析导出为Markdown、结构JSON和表格文本CSV;不重新上传,不承诺Word版式还原。

preview_deletionA

预览删除文献及关联索引的影响;混合研究产物标记过期,输入原件、旧导出、备份和服务商数据保留。

delete_workA

仅在用户明确要求删除并查看最新预览后调用,使用预览digest防止影响范围变化。

backup_libraryA

备份整个本地文献库和原件;要求其他连接已关闭,备份可能包含多个项目,不含凭据。

restore_libraryA

从用户指定可信备份恢复至全新目录,校验哈希和数据库;不覆盖现有库,恢复后云服务和正文输出权限全部关闭。

Prompts

Interactive templates invoked by user choice

NameDescription

No prompts

Resources

Contextual data attached and managed by the client

NameDescription

No resources

TDQS

B3.4/5.0

Scored across 38 tools

Disambiguation4/5

Tools are mostly well separated by resource and action (e.g., search_literature vs search_library, parse_local_pdf vs parse_document). Some adjacent read/extract/parse-job tools (read_extraction vs read_parse_result, get_parse_job vs retry_parse vs resume_parse_observation) require careful reading, but descriptions clarify boundaries.

Naming Consistency4/5

All names use snake_case and nearly all follow a verb_noun or action_object pattern. workspace_status is a minor noun-only exception, but the overall naming convention is predictable and readable.

Tool Count2/5

38 tools is above the typical 3-15 band and exceeds the 25+ heavy threshold. The parsing, extraction, and job-management pipeline contains many granular tools that could be consolidated for easier agent selection.

Completeness4/5

The surface covers project setup, import, parsing, search, evidence building, export, deletion, backup/restore, and more. Minor lifecycle gaps exist (e.g., no explicit project-level delete/list beyond workspace_status), but major research workflows are well covered.

Maintenance

ActivityMaintained
ResponsivenessNo issues