Hugging Face 热门 #2 cross-encoder/ms-marco-MiniLM-L6-v2|该模型是面向英文检索的交叉编码器…
Hugging Face 热门第 2 名 · 88,705,504 近 30 天下载(30 天窗口)。该模型是面向英文检索的交叉编码器重排序模型,基于 MS MARCO 段落排序任务训练,可对查询与候选段落逐对打分并排序,提升检索结果相关性。
工具动态、实用教程与值得一读的资源分享。
Hugging Face 热门第 2 名 · 88,705,504 近 30 天下载(30 天窗口)。该模型是面向英文检索的交叉编码器重排序模型,基于 MS MARCO 段落排序任务训练,可对查询与候选段落逐对打分并排序,提升检索结果相关性。
Hugging Face 热门第 3 名 · 64,516,396 近 30 天下载(30 天窗口) · 特征提取模型。BAAI/bge-small-en-v1.5 是智源研究院发布的英文文本特征提取模型,基于 BERT 架构,可将句子映射为稠密向量,用于语义相似度、检索与聚类等任务。
Hugging Face 热门第 4 名 · 52,218,609 近 30 天下载(30 天窗口)。google/electra-base-discriminator 是 ELECTRA 预训练方法的判别器模型,用于英文文本表征学习,可微调至分类、问答与序列标注等下游任务。
Hugging Face 热门第 5 名 · 47,682,222 近 30 天下载(30 天窗口)。BERT base uncased 是谷歌发布的英文预训练语言模型,采用掩码语言建模与下一句预测目标训练,主要供研究者和开发者在下游任务上微调使用。
Hugging Face 热门第 6 名 · 45,730,151 近 30 天下载(30 天窗口) · 句子相似度模型。这是一个多语言句子相似度模型,可将句子和段落映射为384维稠密向量,用于聚类或语义搜索等任务。
Hugging Face 热门第 7 名 · 38,175,398 近 30 天下载(30 天窗口) · 句子相似度模型。BGE-M3 是面向检索的句子相似度模型,支持多语言、多粒度和稠密、稀疏、多向量三种检索方式,最长可处理 8192 个词元。
Hugging Face 热门第 8 名 · 24,859,880 近 30 天下载(30 天窗口) · 翻译模型。T5-Small 是谷歌 T5 系列中约 6000 万参数的小型文本到文本模型,可统一处理翻译、摘要、问答与分类等任务,支持英、法、罗、德等语言,采用 Apache-2.0 许可。
Hugging Face 热门第 9 名 · 22,886,222 近 30 天下载(30 天窗口) · 句子相似度模型。这是一个句子相似度模型,可将句子和段落映射为768维稠密向量,用于聚类或语义搜索等任务。
Hugging Face 热门第 10 名 · 22,498,727 近 30 天下载(30 天窗口) · 文本生成模型。Qwen3-0.6B 是通义千问系列的小型文本生成模型,支持思考与非思考模式切换,具备多语言对话与指令跟随能力,采用 Apache-2.0 许可。
Hugging Face 热门第 20 名 · 14,867,346 近 30 天下载(30 天窗口) · 句子相似度模型。nomic-ai/nomic-embed-text-v1.5 是面向英文句子相似度与特征提取的文本嵌入模型,基于 NomicBert 架构,支持长上下文与 Matryoshka 降维,在 MTEB 多项任务上有公开评测数据。