王小川旗下百川智能发布 Baichuan-13B AI 大模型,号称“130 亿参数开源可商用”

王小川旗下百川智能发布 Baichuan-13B AI 大模型,号称“130 亿参数开源可商用”

人工智能 2023-07-13 16:12:02 1年以前

IT酷哥 7 月 11 日消息,王小川旗下百川智能今日发布 Baichuan-13B 大模型,号称“130 亿参数开源可商用”。

▲ 图源 Baichuang-13B GitHub 页面

据官方介绍,Baichuan-13B 是由百川智能继 Baichuan-7B 之后开发的包含 130 亿参数的开源可商用的大规模语言模型,在中英文 Benchmark 上均取得同尺寸模型中最好的效果。本次发布包含有预训练 (Baichuan-13B-Base) 和对齐 (Baichuan-13B-Chat) 两个版本。

▲ 图源 Baichuang-13B GitHub 页面

官方宣称,Baichuan-13B 有如下几个特点:

更大尺寸、更多数据:Baichuan-13B 在 Baichuan-7B 的基础上进一步扩大参数量到 130 亿,并且在高质量的语料上训练了 1.4 万亿 tokens,超过 LLaMA-13B40%,是当前开源 13B 尺寸下训练数据量最多的模型。支持中英双语,使用 ALiBi 位置编码,上下文窗口长度为 4096。

同时开源预训练和对齐模型:预训练模型是适用开发者的『 基座 』,而广大普通用户对有对话功能的对齐模型具有更强的需求。因此项目中同时具有对齐模型(Baichuan-13B-Chat),具有很强的对话能力,开箱即用,几行代码即可简单地部署。

更高效的推理:为了支持更广大用户的使用,项目中同时开源了 int8 和 int4 的量化版本,相对非量化版本在几乎没有效果损失的情况下大大降低了部署的机器资源门槛,可以部署在如英伟达 RTX3090 这样的消费级显卡上。

开源免费可商用:Baichuan-13B 不仅对学术研究完全开放,开发者也仅需邮件申请并获得官方商用许可后,即可以免费商用。

目前该模型已经在 HuggingFace、GitHub、Model Scope 公布,感兴趣的 IT酷哥小伙伴们可以前往了解。

文章版权声明:除非注明,否则均为网络转载文章,转载或复制请以超链接形式并注明出处。

相关阅读

  • 《黑镜》主创坦言曾试用 ChatGPT 编写剧本,但效果不理想
  • 谷歌推出 SAIF 框架,倡导安全环境下探索和发展人工智能
  • 网易云音乐和小冰联合推出 AI 歌手音乐创作软件,首发内置 12 名 AI 歌手
  • 百度与中国石化签署战略合作框架协议,将在 AI 等领域深化合作
  • 格莱美修订规则:只有“人类创作者”才有资格获奖
  • 腾讯宣布打造行业大模型精选商店,提供一站式服务
  • 语音生成 AI 初创公司 ElevenLabs 发布合成语音检测工具,号称准确率超过 99%
  • 香港电台推出 AI 天气主播 Aida,表情、动作均由电脑合成
  • 特斯拉人形机器人将于 7 月亮相上海 2023 世界人工智能大会
  • “商汤如影 SenseAvatar” 数字人视频生成平台上线,支持定制形象、声音克隆、创作视频等功能
  • 正版文心一言上架 App Store,百度此前起诉苹果“盗版 App 泛滥”
  • 腾讯与西湖大学共同申请 AI 聊天机器人专利,可使问答语句更准确连贯
  • Pixela 推出 ChatGPT 翻译 App:支持中日英韩互译,限时免费上架 Google Play
  • 研究发现 AI 筛选的私募基金回报率高于大部分机构投资者
  • AI 作画工具 Midjourney 推出“pan”功能,可上下左右平移扩展图片外场景
  • 匈牙利公司推出世界首款 AI 研发饮料,口味、包装均由 AI 完成
  • 丁磊:当前网易的首要任务是用最快的速度探索 AI 大模型的创新应用
  • 陈天桥再投 10 亿元支持 AI 脑科学,筹建睡眠梦境、抗衰老等前沿实验室
  • 下一代“世界最快”超级计算机 El Capitan 开始安装 AMD Instinct MI300 人工智能 GPU
  • 全国首个 AI 射击射箭辅助训练系统发布,支持云端存储、实时查询
  • 最新资讯

    热门资讯