.hd-box .hd-fr

字节跳动最新思考模型 Seed-Thinking-v1.5 技术细节公开,4 月 17 日开放接口

2025-04-14 12:44IT之家(清源)10评
感谢IT之家网友西窗旧事的线索投递!

IT之家 4 月 14 日消息,IT之家从豆包大模型团队获悉,字节跳动最新思考模型 Seed-Thinking-v1.5 技术细节今日公开,该模型将于 4 月 17 日通过火山引擎开放接口供用户体验。

该模型在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出,同时,模型采用 MoE 架构,总参数 200B,激活参数为 20B,具备显著的推理成本优势,单位推理成本相比 DeepSeek R1 降低 50%。

模型各方面具体表现:

数据体系:融合可验证与创意性数据

针对推理与生成任务的不同需求,团队优化了数据处理策略:

奖励模型:双轨体系校准训练方向

团队提出双轨奖励机制,兼顾“对错分明”与“见仁见智”任务:

训练方法:“监督精调 + 强化学习”双阶段优化

Seed-Thinking-v1.5 采用“打基础 + 磨能力”的全链路训练:

训练框架:支撑 20B MoE 的底层架构

为应对 20B MoE(总参数 200B)的复杂训练需求,团队优化了底层架构:

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

下载IT之家APP,分享赚金币换豪礼
space
相关文章
大家都在买广告
热门评论
查看更多评论