zhiji_ingest_file
Ingest files (audio, video, images, PDFs, etc.) by converting to text via Whisper, OCR, or document parsing into long-term memory. Supports path, URL, or base64. Audio also gets acoustic emotion analysis.
Instructions
把一个文件(音频/录音/图片/PDF/Word/Excel/视频等)经知己既有抽取管线(Whisper 语音转写 / Tesseract OCR / 文档解析)转成文本后写入长期记忆——这是让音视频与文档'进记忆'的入口(zhiji_memory_ingest 只收文本)。来源三选一:path=MCP 服务器本机可读的文件路径(适合 stdio 本地客户端);url=http(s) 链接(桥接可下载);base64=内联字节(适合远程 HTTP 客户端的小文件)。⚠️ 音视频转写在 CPU 上可能耗时数分钟,请把客户端超时调大并耐心等待。★音视频还会做声学情绪分析(音量/语速/声纹情绪)存入情绪库;isUserVoice=true(确认是用户本人的录音/视频)时,声学情绪进一步汇入用户画像「声学情绪基调」——非用户本人的音频(播客/他人声音)务必留默认 false,否则会污染画像。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| url | No | 文件的 http(s) URL(与 path/base64 三选一) | |
| path | No | MCP 服务器本机可读的文件绝对路径(与 url/base64 三选一) | |
| base64 | No | 文件内容的 base64(与 path/url 三选一);大文件不建议内联 | |
| filename | No | 原始文件名(含扩展名,用于识别类型;判定音视频也靠它) | |
| userEmail | No | 用户标识;缺省用 MB_USER_EMAIL | |
| isUserVoice | No | 音视频专用:true=确认这段录音/视频是用户本人的声音→声学情绪汇入其画像;默认 false=不确定/他人声音,只存情绪库不进画像(防污染) | |
| conversationId | No | 归属会话 ID;缺省自动生成 mcp-file-<时间戳> |