Skip to main content

功能概述

文本嵌入(Text Embedding)API 可以将文本转换为高维向量表示,捕捉文本的语义信息。这些向量可用于:
  • 语义搜索:基于含义而非关键词匹配进行搜索
  • 文本分类:将文本自动归类到预定义类别
  • 相似度计算:计算两段文本的语义相似程度
  • 聚类分析:将相似文本自动分组
  • 推荐系统:基于内容相似度进行推荐
  • RAG 应用:检索增强生成的核心能力
YeLIn AI 支持 OpenAI、Cohere、BGE 等多种 Embedding 模型,兼容 OpenAI SDK。

快速开始

基础示例

批量处理

一次请求处理多个文本:

支持的模型

💡 选择建议
  • 大多数场景使用 text-embedding-3-small 即可
  • 对精度要求极高时使用 text-embedding-3-large

核心参数

model(必填)

指定 Embedding 模型:

input(必填)

要转换的文本,支持单个字符串或字符串数组:

dimensions(可选)

指定输出向量维度(仅 v3 模型支持):
降低维度可以减少存储空间和计算成本,但可能略微影响效果。

实用示例

1. 计算文本相似度

2. 语义搜索

3. 文本分类

与向量数据库集成

Pinecone 集成

Chroma 集成

最佳实践

1. 批量处理

2. 文本预处理

3. 缓存向量

定价说明

YeLIn AI 提供更优惠的价格,详见 定价页面

常见问题

向量维度多少合适?
  • 通用场景:1536 维(默认)足够
  • 存储受限:可降到 512 或 256 维
  • 高精度需求:使用 3072 维的 large 模型
单次最多处理多少文本? 建议单次请求不超过 2000 个文本,过多可能超时。 文本长度限制是多少? 最大 8192 tokens,超过会被截断。

相关文档

文本生成

使用 Chat API 进行对话

LangChain 集成

在 LangChain 中使用 Embedding

模型信息

查看所有支持的模型

Dify 配置

在 Dify 中配置向量模型