产品介绍
Voyage AI 是什么?
Voyage AI 是面向语义搜索、检索增强生成和非结构化数据发现的模型与 API 平台。嵌入端点将文本和其他支持数据转换为向量并存入向量数据库,重排序器则评估查询与文档相关性,重新排列首轮候选结果。更好的检索可为下游语言模型提供更相关上下文并减少浪费 token,但不能保证答案准确。
模型组合包括通用、轻量、上下文、多模态、多语言、代码、金融和法律选项,以及企业特定模型和定制部署。模型可通过 Voyage API、云与数据平台、VPC 内方案或定制本地许可使用。批处理任务适合大规模语料异步处理,当前文档宣传相比标准推理优惠 33%。
如何使用 Voyage AI
- 根据语言、领域、模态、上下文、维度和延迟选择模型。
- 规范化并切分语料,保留文档标识和访问控制。
- 生成嵌入并存入兼容向量数据库。
- 嵌入查询、检索候选,并按需使用重排序器。
- 只向语言模型传入获授权的高分上下文并附引用。
- 用真实查询评测召回、排序、延迟、成本、偏差和权限泄漏。
核心功能
- 文本嵌入: 生成文档与查询的语义向量表示。
- 上下文嵌入: 在表示片段时保留更广文档上下文。
- 多模态检索: 支持文本与受支持视觉输入的搜索。
- 重排序器: 根据细粒度查询文档相关性重排候选。
- 领域模型: 提供代码、金融、法律和多语言专用检索。
- 灵活部署: 提供 API、云、VPC、定制许可和本地路径。
使用场景
- 对产品、客服或企业文档构建语义搜索。
- 在生成答案前提升 RAG 上下文选择。
- 检索相关代码、法律材料或金融文档。
- 使用指令感知相关性重排关键词或向量搜索结果。
价格
价格按处理 token 计费。当前文本模型根据型号每百万 token 为 0.02 至 0.18 美元,列出的重排序器每百万处理 token 为 0.02 至 0.05 美元。很多当前模型为每账户提供前 2 亿 token 免费,部分旧领域模型为 5,000 万。多模态图像使用基于像素的 token 等价量。生产估算前应确认当前模型表。
常见问题
嵌入等于生成答案吗?
不是。嵌入表示用于检索的语义,最终回答通常由另一个系统生成或展示。
Voyage 重排序器必须配合 Voyage 嵌入吗?
不是。它可优化其他嵌入或关键词搜索得到的候选。
更强检索会消除幻觉吗?
不会。它改善可用上下文,但应用仍需引用、提示词控制、权限过滤和答案评测。


