字节跳动训练10万亿参数AI模型,规模达Kimi K3三倍,或成中国最大
据金融时报报道,字节跳动正在训练参数高达10万亿的AI模型,规模是月之暗面Kimi K3的三倍,有望成为中国最大AI模型。本文解析其技术意义、对国内AI竞争格局的影响,以及普通用户何时能用上。
一句话看懂
字节跳动正在训练参数高达10万亿的AI模型,规模是月之暗面Kimi K3的三倍,有望成为中国最大的AI模型。
详细发生了什么
据《金融时报》报道,字节跳动正在训练一个参数规模高达10万亿的AI模型。这一数字是当前中国最大模型——月之暗面的Kimi K3——的三倍。Kimi K3此前以约3万亿参数成为中国最大模型,而字节跳动的这一新模型将大幅刷新纪录。
报道没有透露模型的具体名称、训练进度或发布时间,但指出字节跳动正在投入大量计算资源进行训练。字节跳动旗下拥有豆包等AI产品,此前已在AI领域有多次布局,但如此大规模的模型训练尚属首次。
这一消息表明,中国AI大模型的竞争正在从“百模大战”进入“规模竞赛”阶段。10万亿参数意味着远超当前主流模型的容量,可能带来更强的推理能力、更长的context window支持,以及更复杂的多模态处理能力。不过,如此大的模型也面临训练成本、推理效率和部署难度等挑战。
中文圈视角
对国内用户来说,这一消息有几个值得关注的层面:
第一,国产模型的“天花板”正在被抬高。 此前,国内用户能接触到的最大模型是Kimi K3,其长文本处理能力已经让不少用户惊艳。字节跳动若真能推出10万亿参数的模型,意味着中文AI在复杂任务(如长文档分析、深度推理、代码生成)上的能力可能再上一个台阶。对于依赖AI进行写作、编程、研究的用户,这无疑是好消息。
第二,竞争格局可能生变。 字节跳动拥有抖音、今日头条等巨大流量入口,若其大模型能力追平或超越Kimi、DeepSeek等,可能会通过豆包等产品快速触达普通用户。相比之下,月之暗面、智谱等公司需要更努力地保持技术优势或差异化。
第三,合规与成本问题。 如此大规模的模型训练需要海量算力,国内芯片供应受限的背景下,字节跳动如何解决算力来源是个疑问。同时,大模型的内容安全审核压力也会更大,监管层面可能对超大规模模型有更严格的要求。普通用户短期内可能无法直接使用,但可以期待豆包等应用在功能上的升级。
几条值得记住的细节
- 模型参数规模高达10万亿,是Kimi K3(约3万亿)的三倍。
- 消息来源为《金融时报》,字节跳动未官方确认。
- 字节跳动旗下已有豆包等AI产品,但此前未训练过如此大的模型。
- 训练如此大的模型需要海量算力,可能面临芯片供应和成本挑战。
- 模型名称、发布时间、具体能力均未公布,预计还需数月甚至更久。
一句话总结
字节跳动冲击10万亿参数模型,国产AI能力上限有望大幅提升,但落地仍需时间。