阿里开源 Qwen3 新模型 Embedding 及 Reranker,带来强大多语言、跨语言支持

阿里开源 Qwen3 新模型 Embedding 及 Reranker,带来强大多语言、跨语言支持

人工智能 2025-06-08 16:01:03 1天前

IT酷哥 6 月 6 日消息,阿里今日凌晨开源了 Qwen3-Embedding 系列模型(Embedding 及 Reranker),专为文本表征、检索与排序任务设计,基于 Qwen3 基础模型进行训练。

官方表示,在多项基准测试中,Qwen3-Embedding 系列在文本表征和排序任务中展现了卓越的性能。

其具备如下特点:

卓越的泛化性:Qwen3-Embedding 系列在多个下游任务评估中达到行业领先水平。其中,8B 参数规模的 Embedding 模型在 MTEB 多语言 Leaderboard 榜单中位列第一(截至 2025 年 6 月 6 日,得分 70.58),性能超越众多商业 API 服务。此外,该系列的排序模型在各类文本检索场景中表现出色,显著提升了搜索结果的相关性。

灵活的模型架构:Qwen3-Embedding 系列提供从 0.6B 到 8B 参数规模的 3 种模型配置,以满足不同场景下的性能与效率需求。开发者可以灵活组合表征与排序模块,实现功能扩展。

此外,模型支持以下定制化特性:

表征维度自定义:允许用户根据实际需求调整表征维度,有效降低应用成本;

指令适配优化:支持用户自定义指令模板,以提升特定任务、语言或场景下的性能表现。

全面的多语言支持:Qwen3-Embedding 系列支持超过 100 种语言,涵盖主流自然语言及多种编程语言。该系列模型具备强大的多语言、跨语言及代码检索能力,能够有效应对多语言场景下的数据处理需求。

据介绍,Embedding 模型接收单段文本作为输入,取模型最后一层「EOS」标记对应的隐藏状态向量,作为输入文本的语义表示;Reranker 模型则接收文本对(例如用户查询与候选文档)作为输入,利用单塔结构计算并输出两个文本的相关性得分。

IT酷哥附开源地址如下:

ModelScope:

https://modelscope.cn/collections/Qwen3-Embedding-3edc3762d50f48

https://modelscope.cn/collections/Qwen3-Reranker-6316e71b146c4f

Hugging Face:

https://huggingface.co/collections/Qwen/qwen3-embedding-6841b2055b99c44d9a4c371f

https://huggingface.co/collections/Qwen/qwen3-reranker-6841b22d0192d7ade9cdefea

GitHub:

https://github.com/QwenLM/Qwen3-Embedding

技术报告:

https://github.com/QwenLM/Qwen3-Embedding/blob/main/qwen3_embedding_technical_report.pdf

文章版权声明:除非注明,否则均为网络转载文章,转载或复制请以超链接形式并注明出处。

相关阅读

  • 可识别 AI 生成的科学文本的新型检测工具问世,号称准确率超 99% 但遭质疑
  • 对公司缺乏信心,Meta 去年流失三分之一 AI 研究人员
  • (更新)消息称谷歌将与联发科合作打造 AI 服务器芯片,后者回应“错误报道”
  • LG 发布首个生成式 AI 商业化服务 Captioning AI:10 秒内为图片提供 5 句描述和 10 个关键词
  • 软银 CEO 孙正义称每天都会使用 ChatGPT,是生成式 AI 服务的“忠实用户”
  • 蚂蚁集团证实正研发语言和多模态大模型,定名“贞仪”
  • Stability AI 推出文字生成图片模型 SDXL 0.9,硬件要求下探至消费级 GPU 水平
  • AI 公司 MosaicML 推出 300 亿参数模型 MPT-30B,号称训练成本仅为竞品零头
  • 香港电台推出 AI 天气主播 Aida,表情、动作均由电脑合成
  • 英国初创公司用 AI 提升垃圾回收效率,每年追踪量达 320 亿件
  • 北京出台机器人产业新政,支持 AI 大模型与机器人融合发展
  • 金山办公宣布与英伟达团队合作,加速 WPS AI 服务
  • MetaGPT AI 模型开源:可模拟软件公司开发过程,生成高质量代码
  • ChatGPT 的 Bing 浏览功能让用户免费阅读付费内容,OpenAI 暂停测试
  • 研究发现 AI 筛选的私募基金回报率高于大部分机构投资者
  • 日本计划在学校内限度使用 ChatGPT 等生成式 AI
  • ChatGPT 技术被滥用,绍兴警方侦破团伙制作虚假视频案
  • MDN Web 文档项目引入生成式 AI 后遭到开发者广泛差评
  • 中国工程院院士高文:将打造 2000 亿参数自然语言大模型底座,性能对标 ChatGPT
  • 奔驰正在车辆生产中测试 ChatGPT,进行质量管理和流程优化等活动
  • 最新资讯

    热门资讯