Scholar Library
Server Configuration
Describes the environment variables required to run the server.
| Name | Required | Description | Default |
|---|---|---|---|
| TEXTIN_APP_ID | No | TextIn 应用 ID,按需配置;本地文字层解析不需要 | |
| OPENALEX_API_KEY | No | OpenAlex 检索 API key;按服务商当前要求配置 | |
| SCHOLAR_DATA_DIR | No | 本地库目录,用于存放 SQLite、原件、证据与导出。默认 ~/.local/share/scholar-library | ~/.local/share/scholar-library |
| EMBEDDING_API_KEY | No | 可选语义向量服务 API key;非必需 | |
| TEXTIN_SECRET_CODE | No | TextIn 密钥,按需配置;本地文字层解析不需要 |
Instructions
Guidance the server publishes about itself, which clients place ahead of the tool catalog so the model reads it before choosing anything.
This server publishes no instructions, or was last inspected before Glama recorded them.
Capabilities
Features and capabilities supported by this server
Protocol revision2025-11-25
| Capability | Details |
|---|---|
| tools | {
"listChanged": false
} |
| prompts | {
"listChanged": false
} |
| resources | {
"subscribe": false,
"listChanged": false
} |
| experimental | {} |
Tools
Functions exposed to the LLM to take actions
| Name | Description |
|---|---|
| workspace_statusA | 检查安装版本、本地库、已配置凭据(不返回秘密)、项目;不发起联网请求。 |
| create_projectA | 建立单人研究项目;input_root是用户明确指定的输入目录。policy须反映用户授权,默认全部关闭;预算是累计页数和请求上限。 |
| update_project_policyA | 按用户授权修改项目服务与预算;先读取当前revision。预算不能低于已预留用量。 |
| list_input_filesA | 仅列输入目录第一层的普通文件名和大小,不读内容、不递归、不上传。 |
| list_recordsB | 分页找回文献、版本、任务、笔记、关系、检索和核验记录。job列表不重提;内容记录要求host_text授权。 |
| add_workA | 保存题录(title必填;doi/pmid/arxiv、authors、year、journal、url等)。一致标识和标题才自动复用;冲突保留独立记录。 |
| read_recordA | 分页读取已保存研究、方法评价、来源、关系或检索记录的完整JSON。先list_records找ID;按next_offset续接。 |
| update_workB | 修订题录和阅读/纳入状态,保留历史;excluded必须提供理由。selection:unread/reading/included/excluded/read。 |
| search_literatureA | 在crossref/openalex/arxiv/pubmed检索,分别报告失败及成功。保存检索式与结果,不自动纳入或下载;会消耗项目请求预算。 |
| resolve_identifierA | 解析DOI、pmid:或arxiv:标识符并保存题录;不获取全文。 |
| verify_workA | 联网核对DOI与标题及Crossref更新通知,保留证据和查询时间;未查到撤稿不等于可靠。 |
| import_referencesA | 导入授权目录内的BibTeX、RIS或CSL-JSON题录;附件须另行导入,不爬取付费数据库。 |
| import_documentB | 本地导入PDF/DOCX/PNG/JPG/MD/TXT,保留不可变原件;不上传。每个新文件版本单独保存。 |
| download_fulltextA | 从用户选定的公开HTTPS地址下载PDF,最多100MiB;检查每次重定向,不处理账号、付费墙或登录页。 |
| parse_local_pdfA | 免费离线解析PDF文字层,无上传;扫描页需TextIn OCR。公式、表格、阅读顺序须看原页复核。切换解析器会使旧引用过期。 |
| parse_documentA | 按项目授权向TextIn上传原件并解析指定页范围;每批最多100页。页范围只限制处理,上传的是整个文件。相同版本和范围复用原任务,包括失败/未知提交。 |
| get_parse_jobB | 默认只读本地任务;poll=true查询已有远端任务,至少间隔3秒。结果保存并合并各批页面,不重新上传。 |
| retry_parseA | 仅按用户明确重试决定调用。失败/提交未知可能已计费;本次另预留页数,不能保证上游只计费一次。先get_parse_job读取revision。 |
| resume_parse_observationB | 用户解决限流后恢复已知任务的查询;不会上传或重提,下一次get_parse_job(poll=true)才联网。 |
| find_duplicate_candidatesA | 查找同标识冲突或标题相似的候选,不自动合并不同版本或附件。最多比较最近1000条,候选上限100。 |
| save_method_reviewB | 保存宿主的方法评价及局限,必须关联该文献原文;这是AI评价而非已确认的来源身份或客观质量分数。 |
| extract_fieldsB | 调用TextIn字段/表格抽取,会上传整个PDF或图片并预留全部页数;结果需复核,不成为原始证据索引。相同请求复用任务。 |
| read_extractionB | 有界读取已缓存的TextIn原始抽取JSON文本;保留上游位置字段,无可靠定位的字段不得作为核验通过的证据。 |
| read_parse_resultA | 有界读取已缓存的完整xParse原始JSON,包含上游返回的表格结构、字符细节和页元数据;不上传或重提。按next_offset续接。 |
| read_documentB | 按原文顺序分页读取当前解析片段、页序和质量信息,不调用OCR。无页码的DOCX/文本用段落定位。 |
| read_evidenceA | 读取准确引用片段及版本、页序、原始坐标和识别疑点。单片段不证明完整上下文。 |
| read_pageA | 返回原始PDF页或图片的真实MCP图像,用于核对公式、图表、双栏及OCR误差。page为从1开始的PDF页序,不是印刷页码。 |
| search_libraryB | 本地中英文关键词检索,限定可选版本和字符预算;仅召回当前原文证据,摘要和笔记不作为原始证据。 |
| build_evidence_packB | 构建有界证据包和关联阅读线索。默认本地关键词;semantic=true会将问题发送至项目配置的embedding服务,需要授权与已建索引。 |
| index_semantic_searchB | 将最多32个原文片段发送到已配置的embedding服务并本地保存向量;重调续接,模型改变后使用新索引。 |
| save_researchA | 保存宿主生成的阅读卡片/回答/综述。author主张必须引原文;引用须同项目、当前解析、精确摘录。此工具仅校验引用完整性,语义支持需宿主/用户检查。产物不进入原文索引。 |
| connect_papersA | 保存文献联系;支持/反对关系必须提供两端原文证据和具体条件说明。similar仅是线索。 |
| export_researchB | 导出MD/JSON/CSV/BibTeX/RIS/CSL-JSON/HTML/PDF/DOCX及证据清单;拒绝过期产物。style=gb7714或apa;原全文不打包。 |
| convert_documentB | 将已有解析导出为Markdown、结构JSON和表格文本CSV;不重新上传,不承诺Word版式还原。 |
| preview_deletionA | 预览删除文献及关联索引的影响;混合研究产物标记过期,输入原件、旧导出、备份和服务商数据保留。 |
| delete_workA | 仅在用户明确要求删除并查看最新预览后调用,使用预览digest防止影响范围变化。 |
| backup_libraryA | 备份整个本地文献库和原件;要求其他连接已关闭,备份可能包含多个项目,不含凭据。 |
| restore_libraryA | 从用户指定可信备份恢复至全新目录,校验哈希和数据库;不覆盖现有库,恢复后云服务和正文输出权限全部关闭。 |
Prompts
Interactive templates invoked by user choice
| Name | Description |
|---|---|
No prompts | |
Resources
Contextual data attached and managed by the client
| Name | Description |
|---|---|
No resources | |
TDQS
Scored across 38 tools
Tools are mostly well separated by resource and action (e.g., search_literature vs search_library, parse_local_pdf vs parse_document). Some adjacent read/extract/parse-job tools (read_extraction vs read_parse_result, get_parse_job vs retry_parse vs resume_parse_observation) require careful reading, but descriptions clarify boundaries.
All names use snake_case and nearly all follow a verb_noun or action_object pattern. workspace_status is a minor noun-only exception, but the overall naming convention is predictable and readable.
38 tools is above the typical 3-15 band and exceeds the 25+ heavy threshold. The parsing, extraction, and job-management pipeline contains many granular tools that could be consolidated for easier agent selection.
The surface covers project setup, import, parsing, search, evidence building, export, deletion, backup/restore, and more. Minor lifecycle gaps exist (e.g., no explicit project-level delete/list beyond workspace_status), but major research workflows are well covered.