英国媒体报道,中国科技巨头字节跳动正训练一款参数量高达10万亿的人工智能(AI)大模型,其体量规模可能已逼近美国AI头部企业Anthropic所开发的尖端系统Mythos。
路透社引述《金融时报》星期五(8月7日)的报道称,据知情人士透露,字节跳动的这款新模型目前正处于预训练阶段。这一过程通常需要耗时三到六个月,随后才能进入微调并最终发布。
报道指出,凭借10万亿的庞大参数量,字节跳动这款模型的体量将是中国AI新锐月之暗面旗下Kimi K3模型(拥有2.8万亿参数)的三倍有余。在此之前,美团的LongCat-2.0与DeepSeek的V4-Pro曾以1.6万亿的参数量领跑中国本土AI行业,国内也有多家竞争对手纷纷跨过了万亿参数的门槛。
在AI领域,参数是指模型从数据中学习到的数值设置,用于识别模式、生成答案并执行任务。它通常被视作衡量大模型规模的粗略指标,尽管规模并不绝对等同于模型的实际能力。
目前,外界很难将中国大模型与美国头部产品进行精准对标,原因在于OpenAI与Anthropic等巨头并未公开披露GPT-5.5、Fable或Mythos等闭源系统的具体参数量。
不过《金融时报》指出,据行业内部估算,Anthropic最先进的Mythos 5参数量约为8万亿,Fable 5约为5万亿。这意味着,单从规模指标来看,字节跳动研发的新模型在规模上已与Mythos相近。
目前,中国科技企业正不断压缩大模型的迭代与发布周期,以应对白热化的全球AI竞赛。它们正与美国同行展开激烈角逐,尝试在控制高昂运行成本的前提下,打造出更强大的系统。
