Skip to main content
Glama
newgepard

opensheet

by newgepard

OpenSheet

没有数据库的数据库 UI。

你的表格就是磁盘上的普通 .jsonl 文件。编辑一个单元格——git diff 只显示一行变化。 关闭 OpenSheet 后,jq、DuckDB、Excel、pandas 和你的 AI 代理仍然可以读取所有内容。

License: MIT Runtime dependencies: 0 Tests: 329 Network calls: 0

中文文档


这是什么

电子表格数据库工具必须把你的行数据放在某个地方。常见的答案是:一个你还得自己运行的数据库、 一个随应用附带的存储引擎,或者一个应用自有格式的单一二进制文件。这三种方案都能用, 但都意味着这个工具横亘在你和数据之间。

OpenSheet 的数据源是一个你已经知道怎么读的文本文件。一个文件夹就是一个库, 里面的每个 .jsonl 就是一张表,一行就是一条记录。没有数据库、没有账号、没有服务器、 没有同步。删掉 OpenSheet,你的数据纹丝不动。

$ cat my-library/campaigns.jsonl
{"id":"KS-001","project":"Modular Mechanical Keyboard","raised_usd":412870,"rating":5}
{"id":"KS-002","project":"Solar Camp Lantern","raised_usd":88250,"rating":4}

$ jq -r 'select(.rating == 5) | .project' my-library/campaigns.jsonl
Modular Mechanical Keyboard

这就是全部存储格式。电子表格 UI 只是它之上的一个视图,而不是包裹它的外壳。

Related MCP server: Universal JSON Agent MCP

快速开始

需要 Python 3.9+。无需 pip install、无需 Docker、无需构建步骤。

git clone https://github.com/newgepard/opensheet
cd opensheet
PYTHONPATH=src python3 -m opensheet ~/my-library/

它会在浏览器中打开 http://127.0.0.1:<free port>。把它指向一个包含 .jsonl 文件的文件夹、 指向单个 .jsonl 文件,或者指向一个空文件夹从零开始。

macOS 桌面应用 —— 一个 860 KB 的原生外壳(Swift + WKWebView,使用系统 WebKit):

bash shell/build.sh
open shell/build/OpenSheet.app

保真承诺

其他一切都围绕这一点构建,而且它是经过测试验证的,不是嘴上说说。

1. 未触碰的行按字节原样写回。 在一个 10,000 行的表中编辑一个单元格, git diff 恰好显示一行变化。你没有碰过的行绝不会被重新序列化——不会重排、不会重格式化、 不会重新转义。

2. 非 ASCII 文本绝不转义。 {"名前":"甲"} 保持原样。它绝不会变成 {"\u540d\u524d":"\u7532"}——那是 json.dumps 的默认行为,会让文件在除 JSON 解析器之外的 所有工具里都不可读。

3. 稀疏文件保持稀疏。 如果一行没有某个键,OpenSheet 不会为它凭空造一个。 给一个有 50,000 行现有数据的表添加字段,不会重写其中任何一行。

撤销是作为逆命令实现的,而不是快照回滚,正是为了让承诺 1 在撤销后依然成立: 编辑一个单元格,按 ⌘Z,保存——git diff 是空的。快照恢复实现看起来在屏幕上是对的, 却会悄悄重新序列化它碰过的每一行。

Editing one cell; git diff shows a single changed line

支撑这一点的是:指纹检查拒绝覆盖在 OpenSheet 背后发生的更改,写入通过临时文件加 os.replace() 完成,每次保存都会在打开时的快照旁边保留一个 .bak

功能特性

  • 你的数据是你拥有的文件 —— 纯 .jsonljq、DuckDB、pandas、Excel 和 git 都能读

  • 一切皆可撤销 —— ⌘Z / ⇧⌘Z;批量删除会折叠成一步撤销

  • 13 种字段类型 —— 文本、数字、单选、多选、日期、复选框、URL、附件、公式、 跨表查找、创建/更新时间、自动编号。数字可以渲染为进度条、货币、评分或百分比 而不改变存储的值

  • 4 种视图类型 —— 网格、看板、画廊,外加每个视图的筛选、排序、分组、统计、 行高、冻结列和列顺序

  • 10,000 行依然流畅 —— 虚拟滚动;实测加载 7.5 MB 的表耗时 57 ms,保存耗时 59 ms

  • 导入和导出 —— 从 CSV、XLSX、JSON、SQLite 和 .grist 导入;导出为 CSV、XLSX、JSON、 JSONL、Markdown 和 Parquet

  • 附件保持本地 —— 文件存放在 <library>/assets/,单元格保存相对路径, 不会上传到任何地方

为代理而生,而不是用 AI 装饰

给电子表格加一个 AI 按钮是一个功能。选择一种代理无需适配器就能读写存储格式则是一种架构。 OpenSheet 选择了后者,其他一切都由此而来:文件是面向行的,所以追加就是 >>; 格式是文本,所以 grep 能用;写入者是单一的,所以字节保真在并发访问下依然成立。

一个 MCP 服务器与 HTTP 服务器运行在同一个进程中,共享同一个 Store 实例:

{
  "mcpServers": {
    "opensheet": {
      "command": "python3",
      "args": ["-m", "opensheet", "/path/to/libraries", "--mcp", "--mcp-root", "/path/to/libraries"],
      "env": { "PYTHONPATH": "/path/to/opensheet/src" }
    }
  }
}

工具:list_librarieslist_tablesget_schemaqueryupsert_rowsupsert_rows 返回一张回执——inserted / updated / unchanged 计数以及每个的主键—— 并支持 dry_run。与磁盘上已有内容完全相同的行计为 unchanged,文件不会被触碰。

同一进程不是实现细节。 字节保真依赖于进程内状态:每一行到达时的字节是什么。 两个各自持有自己副本的进程会各自认为对方的写入是"更改",并在下次保存时重新序列化整个文件。 第二个进程会检测到锁文件并转发给第一个进程,所以始终只有一个写入者。

代理也可以绕过 OpenSheet 直接追加到文件。它们这样做时保持保真完整的规则记录在 直接写入指南 中。

架构

graph TD
    A["my-library/"] --> B["campaigns.jsonl<br/>source of truth"]
    A --> C["suppliers.jsonl"]
    A --> D[".opensheet/<br/>schema · views · links"]
    B --> E["store.py<br/>row passthrough · atomic write"]
    C --> E
    E --> F["single process"]
    F --> G["HTTP + browser UI"]
    F --> H["MCP over stdio"]
    G --> I["native macOS shell"]

.opensheet/ 存放字段类型、列宽、视图定义和跨表链接。删掉它,你失去的是格式,不是数据—— 字段类型会回退到推断。

为什么它保持小巧

后端只用 Python 标准库。前端是纯 JavaScript——没有框架、没有构建步骤。 macOS 外壳是 184 KB 的 Swift,跑在系统 WebKit 上,而不是打包一个浏览器。

DuckDB 是可选的,而且是只读的,服务于 SQL 面板和 Parquet 导出。它从不参与筛选、 排序或分组,也从不写入。所有写入都经过 store.py

按构造无网络

没有遥测、没有更新检查、没有 CDN 资源、没有在线演示。浏览器只请求同源的 /api/* 路径, 服务器只绑定 IPv4 回环地址,桌面外壳自身不持有任何 TCP 连接。 tests/test_offline.py 强制执行所有这些。

验证

bash tests/opensheet-全量验收-20260815.sh

329 个测试:188 个 JavaScript 单元测试、83 个 Python 测试、42 个浏览器端到端测试(Playwright)、 8 个保真往返测试、8 个库往返测试。 保真测试是逐字节比较文件,而不是逐字段比较——一个只检查值的测试会在承诺 1 被悄悄破坏时 依然通过。

浏览器测试需要在 web/ 内执行 npm install 来安装 Playwright 的 Chromium。

OpenSheet 不会做什么

评论、权限、实时协作、自动化、托管版本、在线演示。 每一项都需要账号系统或公网地址,这与第一条设计约束相矛盾:数据绝不离开你的机器

这是一个刻意的边界,而不是路线图的缺口。

状态

已在日常使用中正常工作,但有两个粗糙之处值得你在尝试前了解:

  • UI 目前只有中文。 代码、注释和界面字符串都是中文的。英文本地化还没做。

  • 桌面外壳仅限 macOS。 Web 版可以在任何能运行 Python 的地方运行。

贡献

欢迎提交 Issue 和 PR。在触碰存储层之前,有两点需要了解:

  1. store.py 中的行透传逻辑就是产品本身。修改它意味着要保持保真测试通过, 而那些测试比较的是字节,不是字段。

  2. 代码注释目前是中文的。非常欢迎翻译帮助。

许可证

MIT —— 见 LICENSE

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

0Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

Related MCP Servers

  • F
    license
    Not graded
    quality
    Not graded
    maintenance
    Provides AI agents with database-like operations over LanceDB with automatic BGE-M3 multilingual embedding generation, enabling semantic search, CRUD operations, and safe schema migrations across structured data.
  • A
    license
    A
    quality
    B
    maintenance
    Turns a folder of CSV, Parquet, and JSON files into a single SQL-queryable source for AI agents, supporting JOINs across files with read-only sandboxed access.
    6
    2
    MIT
  • A
    license
    A
    quality
    D
    maintenance
    Enables AI assistants to read, write, query, and manage JSON data files with automatic ID and timestamp generation.
    6
    20
    1
    MIT

View all related MCP servers

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/newgepard/opensheet'

If you have feedback or need assistance with the MCP directory API, please join our Discord server