Voyage AI 介绍
了解工具的详细功能和使用方法
Voyage AI 提供文本、多模态嵌入和重排模型 API,适合已经有文档管线与向量库、想改善 RAG 召回质量的开发团队。它把文本转换成向量,或对候选片段重新排序;文档权限、索引存储、答案生成与来源核验仍需要应用完成。
什么场景值得试
内部知识助手总是找不到正确政策、中文提问与英文手册对不上、同一主题有许多相似旧版本时,可以先评估检索层。嵌入负责从大量片段找候选,rerank 再按问题判断候选的相关性。重排只能调整已经召回的内容,不能补回第一阶段完全漏掉的正确文档。
截至 2026 年 10 月 10 日,官方文档列出的通用嵌入主线是 voyage-4-large、voyage-4、voyage-4-lite,重排主线是 rerank-3、rerank-3-lite。不同档位侧重质量、延迟和成本。检索时文档使用 input_type="document",问题使用 input_type="query";默认向量维度为 1024,4 系列支持选择 256、512、1024、2048。维度降低能减少存储与网络负担,但质量要在自己的问题集上重测。
从已有 RAG 接入
先保留原有切块方式和向量库,选择一份独立试点索引,避免一次换模型、切块、召回与提示词而无法定位改进来源。把文档 ID、版本、租户、模型名、维度和 chunk 规则一起保存。查询向量必须与文档向量处在兼容的空间;Voyage 文档明确说明 4 系列兼容,但不能把这个结论扩大到任意供应商、旧型号或不同维度。
第一阶段先测 Recall@20,再把获准访问的候选送入 rerank,比较前 5 条证据的质量。不要在发给第三方 API 之后才过滤权限,否则未获准的资料已经传出了系统。对关键词精确匹配、料号和金额,可保留 BM25 等词法召回作为对照。
费用与试用边界
官网当前列出的标准文本嵌入价格为每百万输入 token:voyage-4-lite 0.02 美元、voyage-4 0.06 美元、voyage-4-large 0.12 美元;rerank-3-lite 0.02 美元、rerank-3 0.05 美元。重排的处理量包含“查询 token 数 × 候选数 + 候选文档 token 总数”,所以候选越多、片段越长,账单越大。模型对应的初始免费额度须在账号中确认,它不是每月无限免费套餐。Batch 另有计费规则,不应照搬同步接口的免费额度。
完整预算还包括初始索引、增量更新、向量库、重排、生成模型和重试。换向量模型时,要核算重建索引与双索引迁移的成本,而不是只比较每百万 token 的单价。
限制与验收
API 调用会把问题或候选资料发送给服务商。生产前核对地区、数据保留、训练使用、合同和组织预算设置;本文不把嵌入向量当作匿名化后的安全数据。截断、限流或维度不一致都可能让检索退化,必须有日志和可回退的模型配置。向量相似度与重排分数都不是事实可信度;最终答案仍要以获准访问的原始证据验证。
官网也列出云平台、客户租户/VPC 以及定制或本地部署路线,需另行核对可用模型、地区、许可和报价;不能把标准公共 API 的 token 单价当作这些部署方案的完整费用。