28
如何选择一个合适的Embedding模型?评估指标有哪些?
RAG检索增强生成中等
📋 面试问题
如何选择一个合适的Embedding模型?评估指标有哪些?
✅ 期望回答
选择因素:
- 语言支持:中文场景选支持中文的模型(如BGE、GTE、text2vec)
- 向量维度:768d(平衡)、1024d(高精度)、384d(低延迟),更高维度通常精度更好但检索更慢、存储更大
- 最大序列长度:512(短文本)、8192(长文档)
- 领域适配:通用模型(BGE-M3、text-embedding-3)vs 垂类(代码CodeBERT、医学PubMedBERT)
- 开源 vs API:开源可本地部署保护数据隐私,API更方便但成本随量增长
- MTEB Leaderboard(中文/英文):检索、分类、聚类、语义相似度等多维度评分
- 自有数据Retrieval Recall@K:在业务知识库上评估召回率(最直观实用的指标)
- 检索速度/吞吐量:本地部署时的QPS和延迟
- 中文:BGE-M3、GTE-Qwen2、Jina Embeddings v2
- 英文:BGE-M3(多语言)、text-embedding-3-large(OpenAI API)、E5-Mistral
- 多语言:BGE-M3(支持稀疏+密集混合检索)
#Embedding#向量模型#MTEB