王小川旗下百川智能发布 Baichuan-53B 大模型,宣称“写作、文本方面达到行业最好水平”

2023-08-08 18:39IT之家 - 漾仔(实习)
感谢IT之家网友 HH_KK 的线索投递!

IT之家 8 月 8 日消息,王小川旗下百川智能今日宣布发布大模型产品 Baichuan-53B,官方表示,“Baichuan-53B 大模型目前在写作、文本创作能力方面,已经达到行业最好的水平”。

不过IT之家发现,Baichuan-53B 定位“闭源大模型”,目前并没有在 GitHub、HuggingFace 处公布相关信息

官方宣称,“Baichuan-53B 主要面向 B 端用户提供服务,发布后,该大模型也将启动内测,预计下个月将会开放 API 等相关组件”。

在此之前,百川智能已经发布了 Baichuan-7B、Baichuan-13B 两个通用大语言模型,感兴趣的小伙伴们可以在 GitHub 中找到相关内容

▲ 图源 百川智能 GitHub 相关页面

据官方介绍,Baichuan-7B 是一个 70 亿参数量的中英文预训练大模型,在 C-Eval、AGIEval 和 Gaokao 三个最具影响力的中文评估基准进行了综合评估,并且均获得了优异成绩,它已经成为同等参数规模下中文表现最优秀的原生预训练模型。

Baichuan-13B 是由百川智能继 Baichuan-7B 之后开发的包含 130 亿参数的开源可商用的大规模语言模型,在中英文 Benchmark 上均取得同尺寸模型中最好的效果。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

文章价值:
人打分
有价值还可以无价值
置顶评论
    热门评论
      文章发布时间太久,仅显示热门评论
      全部评论
      请登录后查看评论
        取消发送
        软媒旗下人气应用

        如点击保存海报无效,请长按图片进行保存分享