ColiVara
活跃简介
ColiVara 是一套基于视觉嵌入的文档检索服务,无需 OCR 或文本提取,直接通过视觉模型对文档进行存储、搜索和检索,在文本和视觉文档上均达到领先的检索性能。
核心特性
- 基于视觉的检索——使用 ColPali 视觉语言模型生成文档嵌入,而非文本分块或 OCR
- 支持 100+ 格式——处理 PDF、DOCX、PPTX 及 100+ 其他文件格式,自动转换为图像
- 元数据过滤——按集合和文档元数据字段(作者、年份、标签等)过滤搜索
- 无需向量数据库——托管的 PostgreSQL + pgVector 后端处理所有嵌入存储
- Python 和 TypeScript SDK——功能齐全的 SDK,附带 REST API 和 Swagger 文档
- 晚期交互嵌入——在纯文本文档和视觉文档基准测试上均优于池化嵌入
适用场景
💡 企业文档检索——检索视觉丰富的文档(图表、布局、表格),这些是基于文本搜索会遗漏的
💡 RAG 系统——为检索增强生成管道提供最先进的文档检索
💡 法律和合规搜索——根据视觉布局和结构在合同中查找相关条款
💡 学术论文检索——通过图表、表格和页面布局搜索学术论文,而非仅搜索文本
分类
快速开始
pip install colivara-py → from colivara_py import ColiVara → client = ColiVara(api_key='YOUR_KEY') → client.upsert_document(name='doc', document_url='https://example.com/file.pdf') → results = client.search('你的查询')