适合谁
- 需要处理多种文档格式并提取结构化数据的开发者和数据工程师。
- 需要在 MCP 环境中集成文档处理功能的 AI 代理。
- 需要从代码库中提取语义信息的 RAG 管道。
适合需要从多种文档和代码中提取信息的用户,提供丰富的功能和多种集成方式。
Xberg 是一个基于 Rust 核心的文档智能框架,支持从 101 种格式(115 种文件扩展名)中提取文本、表格、元数据和图像,同时支持 371 种编程语言的代码智能。它具有 15 种语言绑定(Rust、Python、Node.js、Go、Java、C#、Ruby、PHP、Elixir、Dart、Swift、Zig、WASM、Kotlin、C FFI),并提供 CLI、REST API 和 MCP 服务器。该 MCP 服务器提供 9 个工具(extract、extract_batch、detect_mime_type 等)、3 个提示词(extract_document、extract_with_ocr、semantic_search)和 4 个资源(formats、models、OCR languages、embedding presets)。
使用 Homebrew 安装 CLI:brew install xberg-io/tap/xberg,然后配置客户端。例如,在 Claude Desktop 或 Cursor 的配置文件中添加:{ "mcpServers": { "xberg": { "command": "xberg", "args": ["mcp"] } } }。
{
"mcpServers": {
"xberg": {
"command": "xberg",
"args": [
"mcp"
]
}
}
}