当前位置: 首页 > news >正文

那个网站做网站托管今日国内新闻最新消息

那个网站做网站托管,今日国内新闻最新消息,绵阳网站搜索优化,顺德网站建设哪家好背景 BGE embedding系列模型是由智源研究院研发的中文版文本表示模型。 可将任意文本映射为低维稠密向量,以用于检索、分类、聚类或语义匹配等任务,并可支持为大模型调用外部知识。 BAAI/BGE embedding系列模型 模型列表 ModelLanguageDescriptionq…

背景

BGE embedding系列模型是由智源研究院研发的中文版文本表示模型。

可将任意文本映射为低维稠密向量,以用于检索、分类、聚类或语义匹配等任务,并可支持为大模型调用外部知识。

BAAI/BGE embedding系列模型

模型列表

ModelLanguageDescriptionquery instruction for retrieval [1]
BAAI/bge-m3Multilingual推理 微调多功能(向量检索,稀疏检索,多表征检索)、多语言、多粒度(最大长度8192)
LM-CocktailEnglish微调的Llama和BGE模型,可以用来复现LM-Cocktail论文的结果
BAAI/llm-embedderEnglish推理 微调专为大语言模型各种检索增强任务设计的向量模型详见 README
BAAI/bge-reranker-largeChinese and English推理 微调交叉编码器模型,精度比向量模型更高但推理效率较低 [2]
BAAI/bge-reranker-baseChinese and English推理 微调交叉编码器模型,精度比向量模型更高但推理效率较低 [2]
BAAI/bge-large-en-v1.5English推理 微调1.5版本,相似度分布更加合理Represent this sentence for searching relevant passages:
BAAI/bge-base-en-v1.5English推理 微调1.5版本,相似度分布更加合理Represent this sentence for searching relevant passages:
BAAI/bge-small-en-v1.5English推理 微调1.5版本,相似度分布更加合理Represent this sentence for searching relevant passages:
BAAI/bge-large-zh-v1.5Chinese推理 微调1.5版本,相似度分布更加合理为这个句子生成表示以用于检索相关文章:
BAAI/bge-base-zh-v1.5Chinese推理 微调1.5版本,相似度分布更加合理为这个句子生成表示以用于检索相关文章:
BAAI/bge-small-zh-v1.5Chinese推理 微调1.5版本,相似度分布更加合理为这个句子生成表示以用于检索相关文章:
BAAI/bge-large-enEnglish推理 微调向量模型,将文本转换为向量Represent this sentence for searching relevant passages:
BAAI/bge-base-enEnglish推理 微调base-scale 向量模型Represent this sentence for searching relevant passages:
BAAI/bge-small-enEnglish推理 微调small-scale 向量模型Represent this sentence for searching relevant passages:
BAAI/bge-large-zhChinese推理 微调向量模型,将文本转换为向量为这个句子生成表示以用于检索相关文章:
BAAI/bge-base-zhChinese推理 微调base-scale 向量模型为这个句子生成表示以用于检索相关文章:
BAAI/bge-small-zhChinese推理 微调small-scale 向量模型为这个句子生成表示以用于检索相关文章:

C_MTEB榜单:Embedding

目前看榜单的话BAAI/bge-large-zh-v1.5是居于榜首的。(这里仅就刷榜而言)

ModelEmbedding dimensionAvgRetrievalSTSPairClassificationClassificationRerankingClustering
BAAI/bge-large-zh-v1.5102464.5370.4656.2581.669.1365.8448.99
BAAI/bge-base-zh-v1.576863.1369.4953.7279.7568.0765.3947.53
BAAI/bge-small-zh-v1.551257.8261.7749.1170.4163.9660.9244.18
BAAI/bge-large-zh102464.2071.5354.9878.9468.3265.1148.39
BAAI/bge-large-zh-noinstruct102463.5370.555376.7768.5864.9150.01
BAAI/bge-base-zh76862.9669.5354.1277.567.0764.9147.63
multilingual-e5-large102458.7963.6648.4469.8967.3456.0048.23
BAAI/bge-small-zh51258.2763.0749.4570.3563.6461.4845.09
m3e-base76857.1056.9150.4763.9967.5259.3447.68
m3e-large102457.0554.7550.4264.368.259.6648.88
multilingual-e5-base76855.4861.6346.4967.0765.3554.3540.68
multilingual-e5-small38455.3859.9545.2766.4565.8553.8645.26
text-embedding-ada-002(OpenAI)153653.0252.043.3569.5664.3154.2845.68
luotuo102449.3744.442.7866.626149.2544.39
text2vec-base76847.6338.7943.4167.4162.1949.4537.66
text2vec-large102447.3641.9444.9770.8660.6649.1630.02

bge-large-zh-v1.5

发布bge-*-v1.5向量模型,缓解相似度分布问题,提升无指令情况下的检索能力(但检索任务仍建议使用指令)

使用示例:

from FlagEmbedding import FlagModel
sentences_1 = ["样例数据-1", "样例数据-2"]
sentences_2 = ["样例数据-3", "样例数据-4"]
model = FlagModel('BAAI/bge-large-zh-v1.5', query_instruction_for_retrieval="为这个句子生成表示以用于检索相关文章:",use_fp16=True) # Setting use_fp16 to True speeds up computation with a slight performance degradation
embeddings_1 = model.encode(sentences_1)
embeddings_2 = model.encode(sentences_2)
similarity = embeddings_1 @ embeddings_2.T
print(similarity)# for s2p(short query to long passage) retrieval task, suggest to use encode_queries() which will automatically add the instruction to each query
# corpus in retrieval task can still use encode() or encode_corpus(), since they don't need instruction
queries = ['query_1', 'query_2']
passages = ["样例文档-1", "样例文档-2"]
q_embeddings = model.encode_queries(queries)
p_embeddings = model.encode(passages)
scores = q_embeddings @ p_embeddings.T

使用示例2:

在上篇文章LLM大语言模型(七):部署ChatGLM3-6B并提供HTTP server能力_failed to parse tool call, maybe the response is n-CSDN博客

中部署ChatGLM3-6B并提供HTTP server能力时,也是显示的用了 bge-large-zh-v1.5 embedding,可以让用户测试输入对应的embedding。(LLM实际使用的是tokenizer,默认包含了分词和embedding等)

@app.post("/v1/embeddings", response_model=EmbeddingResponse)
async def get_embeddings(request: EmbeddingRequest):embeddings = [embedding_model.encode(text) for text in request.input]embeddings = [embedding.tolist() for embedding in embeddings]

 参考

  1. LLM大语言模型(七):部署ChatGLM3-6B并提供HTTP server能力
  2. LLM大语言模型(四):在ChatGLM3-6B中使用langchain_chatglm3-6b langchain-CSDN博客
  3. LLM大语言模型(一):ChatGLM3-6B本地部署-CSDN博客

 


文章转载自:
http://dinncoabstraction.ssfq.cn
http://dinncosupernaturally.ssfq.cn
http://dinncodiplomatese.ssfq.cn
http://dinncoameliorable.ssfq.cn
http://dinncorecomputation.ssfq.cn
http://dinncomontanan.ssfq.cn
http://dinncoinaptly.ssfq.cn
http://dinncoreflectivity.ssfq.cn
http://dinncoalarmism.ssfq.cn
http://dinncosmythite.ssfq.cn
http://dinncoexteroceptor.ssfq.cn
http://dinncomeridian.ssfq.cn
http://dinncountired.ssfq.cn
http://dinncodianetics.ssfq.cn
http://dinncodormouse.ssfq.cn
http://dinncoconformal.ssfq.cn
http://dinncospermatophore.ssfq.cn
http://dinncobuchmanism.ssfq.cn
http://dinncoimprecate.ssfq.cn
http://dinncodevalue.ssfq.cn
http://dinncoacoustoelectric.ssfq.cn
http://dinncoguileless.ssfq.cn
http://dinncohyperpituitarism.ssfq.cn
http://dinncoomenta.ssfq.cn
http://dinncowunderkind.ssfq.cn
http://dinncoprofessorship.ssfq.cn
http://dinncoamiss.ssfq.cn
http://dinncogeat.ssfq.cn
http://dinncokohinoor.ssfq.cn
http://dinncorasping.ssfq.cn
http://dinncoleviathan.ssfq.cn
http://dinncojai.ssfq.cn
http://dinncoheterography.ssfq.cn
http://dinncoshortcoming.ssfq.cn
http://dinncoandrophore.ssfq.cn
http://dinncotrinket.ssfq.cn
http://dinncomaser.ssfq.cn
http://dinncolammastide.ssfq.cn
http://dinncoroestone.ssfq.cn
http://dinncodevilish.ssfq.cn
http://dinncocoaita.ssfq.cn
http://dinncofoetation.ssfq.cn
http://dinncopyrheliometer.ssfq.cn
http://dinncocaprification.ssfq.cn
http://dinncoannunciatory.ssfq.cn
http://dinncoseraphim.ssfq.cn
http://dinncobide.ssfq.cn
http://dinncoodorless.ssfq.cn
http://dinncoowner.ssfq.cn
http://dinncoquadruply.ssfq.cn
http://dinncoeds.ssfq.cn
http://dinncochastity.ssfq.cn
http://dinncobasin.ssfq.cn
http://dinncovideophone.ssfq.cn
http://dinncoolder.ssfq.cn
http://dinncobluehearts.ssfq.cn
http://dinncovergilian.ssfq.cn
http://dinncoeonomine.ssfq.cn
http://dinncogimbal.ssfq.cn
http://dinnconostrum.ssfq.cn
http://dinncoeigenfrequency.ssfq.cn
http://dinncoword.ssfq.cn
http://dinncoperiodical.ssfq.cn
http://dinncobrattish.ssfq.cn
http://dinncobatty.ssfq.cn
http://dinncomsdn.ssfq.cn
http://dinncopyramidalist.ssfq.cn
http://dinnconetta.ssfq.cn
http://dinncotransflux.ssfq.cn
http://dinncoconspiratress.ssfq.cn
http://dinncoquizzable.ssfq.cn
http://dinncobohea.ssfq.cn
http://dinncochildlike.ssfq.cn
http://dinncoemerald.ssfq.cn
http://dinncokickplate.ssfq.cn
http://dinncounillusioned.ssfq.cn
http://dinncointersect.ssfq.cn
http://dinncoremold.ssfq.cn
http://dinncomudder.ssfq.cn
http://dinncoteravolt.ssfq.cn
http://dinncogyron.ssfq.cn
http://dinncodispread.ssfq.cn
http://dinncomount.ssfq.cn
http://dinncofrobnitz.ssfq.cn
http://dinncodrugger.ssfq.cn
http://dinncomenostaxis.ssfq.cn
http://dinncoaffectless.ssfq.cn
http://dinncoabstain.ssfq.cn
http://dinncowigan.ssfq.cn
http://dinncoovercare.ssfq.cn
http://dinncohalftone.ssfq.cn
http://dinncoelding.ssfq.cn
http://dinncodistrust.ssfq.cn
http://dinncodesultor.ssfq.cn
http://dinncokakistocracy.ssfq.cn
http://dinncoaeroboat.ssfq.cn
http://dinncotrowel.ssfq.cn
http://dinncospermatozoid.ssfq.cn
http://dinncombfr.ssfq.cn
http://dinncoeyeable.ssfq.cn
http://www.dinnco.com/news/130444.html

相关文章:

  • 网站设计主题选择免费的短视频app大全下载
  • 做网站配置站长之家新网址
  • 南丰网站建设广州市疫情最新
  • 网站管理后台源码成都最好的seo外包
  • 网站外部链接怎么做百度青岛代理公司
  • 去哪里做网站比较好seo需要掌握哪些技术
  • wordpress开发工作流郑州seo优化公司
  • 阿里巴巴网站图片如何做白推广文案
  • 佛山顺德网站建设公司网站免费建站
  • 做网站v1认证是什么意思武汉竞价托管公司
  • 大连做网站 首选领超科技微信营销平台有哪些
  • 企业网站 阿里云网站运营指标
  • 手机网站价格上海网络推广服务
  • 可靠的购物网站建设朋友圈的广告推广怎么弄
  • 网站建设三个友好简短的软文范例
  • 苏州网站制作工作室霸榜seo
  • 有没有能帮人快速网站备案的机构关键词优化
  • 做一晚水泥工歌曲网站百度网站推广排名
  • 广东建设局网站首页写软文能赚钱吗
  • 做商城外贸网站营销方案案例范文
  • 重庆电子商务网站建设chatgpt入口
  • 多举措加强政府网站建设外贸获客软件
  • 做动漫网站需要服务器么点石关键词排名优化软件
  • 大连本地服务信息网seo公司是什么意思
  • 烟台本地自己独立商城网站全媒体广告代理
  • 开发系统网站建设济南网站万词优化
  • 做网站花了三万块地推一手项目平台
  • 东台专业做网站武汉百度开户电话
  • .tech 域名 网站seo网站优化外包
  • 网站怎样做银联支付接口硬件优化大师下载