您的位置:首页 > 财经 >

王小川旗下百川智能发布Baichuan-13BAI大模型,号称“130亿

2023-07-12 12:22:25 来源:IT之家阅读量:16754   

感谢IT之家网友 航空先生 的线索投递!

,王小川旗下百川智能今日发布 Baichuan-13B 大模型,号称“130 亿参数开源可商用”。

图源 Baichuang-13B GitHub 页面

据官方介绍,Baichuan-13B 是由百川智能继 Baichuan-7B 之后开发的包含 130 亿参数的开源可商用的大规模语言模型,在中英文 Benchmark 上均取得同尺寸模型中最好的效果。本次发布包含有预训练 和对齐 (Baichuan-13B-Chat) 两个版本。

图源 Baichuang-13B GitHub 页面

官方宣称,Baichuan-13B 有如下几个特点:

  • 更大尺寸、更多数据:Baichuan-13B 在 Baichuan-7B 的基础上进一步扩大参数量到 130 亿,并且在高质量的语料上训练了 1.4 万亿 tokens,超过 LLaMA-13B40%,是当前开源 13B 尺寸下训练数据量最多的模型。支持中英双语,使用 ALiBi 位置编码,上下文窗口长度为 4096。

  • 同时开源预训练和对齐模型:预训练模型是适用开发者的『 基座 』,而广大普通用户对有对话功能的对齐模型具有更强的需求。因此项目中同时具有对齐模型,具有很强的对话能力,开箱即用,几行代码即可简单地部署。

  • 更高效的推理:为了支持更广大用户的使用,项目中同时开源了 int8 和 int4 的量化版本,相对非量化版本在几乎没有效果损失的情况下大大降低了部署的机器资源门槛,可以部署在如英伟达 RTX3090 这样的消费级显卡上。

  • 开源免费可商用:Baichuan-13B 不仅对学术研究完全开放,开发者也仅需邮件申请并获得官方商用许可后,即可以免费商用。

目前该模型已经在 HuggingFace、GitHub、Model Scope 公布,感兴趣的 IT之家小伙伴们可以前往了解。

广告声明:文内含有的对外跳转链接,用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

声明:本网转发此文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。文章事实如有疑问,请与有关方核实,文章观点非本网观点,仅供读者参考。

栏目导读
北汽极狐阿尔法S获耐腐蚀性能白金等级证书

北汽极狐阿尔法S获耐腐蚀性能白金等级证书

CA-CAP(中国汽车耐腐蚀与老化性能评价规程)在海南博鳌举办,标志着我国汽车行业耐腐蚀与抗老化测评领域向前迈进一大步,

2022-02-14 19:44
从口罩到健康码,冬奥会如期举行背后的四重科技助力

从口罩到健康码,冬奥会如期举行背后的四重科技助力

北京冬奥会开幕在即,新冠病毒已经进化出传染力更强的奥密克戎新变种,加上病毒喜寒畏热的特性,叠加春运大范围的人员流动,其防

2022-01-28 08:13
好空气“随叫随到”,米家空气净化器4让健康生活更有趣

好空气“随叫随到”,米家空气净化器4让健康生活更有趣

又是一年岁末时,按照惯例,春节应是亲友团聚的欢乐时期。然而疫情的突袭,让家人的团聚变得更加珍贵,也让更多的家庭明白健康的

2022-01-26 16:31
沃尔沃方锡智:用户的困惑和需求,“沃”都在心里

沃尔沃方锡智:用户的困惑和需求,“沃”都在心里

在这个飞速发展的信息化时代,高端产品已经越来越不是“一锤子买卖”,售后服务成为了增强用户黏性、促成口碑向销量转化的关键所

2022-01-26 14:51
钦培吉:借IPO,沃尔沃迎来更大施展舞台

钦培吉:借IPO,沃尔沃迎来更大施展舞台

今年以来,沃尔沃动作频繁,受到了业界内外的广泛关注。3月,沃尔沃宣布将在2030年实现全面电动化,成为纯电豪华品牌,且所

2022-01-18 14:34