28

如何选择一个合适的Embedding模型?评估指标有哪些?

RAG检索增强生成中等

📋 面试问题

如何选择一个合适的Embedding模型?评估指标有哪些?

✅ 期望回答

选择因素:
  • 语言支持:中文场景选支持中文的模型(如BGE、GTE、text2vec)
  • 向量维度:768d(平衡)、1024d(高精度)、384d(低延迟),更高维度通常精度更好但检索更慢、存储更大
  • 最大序列长度:512(短文本)、8192(长文档)
  • 领域适配:通用模型(BGE-M3、text-embedding-3)vs 垂类(代码CodeBERT、医学PubMedBERT)
  • 开源 vs API:开源可本地部署保护数据隐私,API更方便但成本随量增长

评估指标:
  • MTEB Leaderboard(中文/英文):检索、分类、聚类、语义相似度等多维度评分
  • 自有数据Retrieval Recall@K:在业务知识库上评估召回率(最直观实用的指标)
  • 检索速度/吞吐量:本地部署时的QPS和延迟

当前推荐:
  • 中文:BGE-M3、GTE-Qwen2、Jina Embeddings v2
  • 英文:BGE-M3(多语言)、text-embedding-3-large(OpenAI API)、E5-Mistral
  • 多语言:BGE-M3(支持稀疏+密集混合检索)
#Embedding#向量模型#MTEB