深网财经科技2026年08月19日 12:33消息,字节拟投入5万亿参数大模型,规模超Kimi K3。
8月7日消息,据《晚点LatePost》报道,字节跳动正在探讨训练一个参数规模超过5万亿的模型,这一规模超过了阿里推出的Qwen3.8-Max(2.4万亿参数)以及月之暗面的K3(2.8万亿参数),成为目前国内已知参数量最大的模型。目前该计划仍处于早期阶段,最终是否发布尚不确定。 从技术发展角度看,大模型的参数量持续攀升,反映出企业在AI领域投入的不断加大。然而,参数量并非衡量模型性能的唯一标准,实际应用效果和优化能力同样关键。字节跳动若能成功推出这一模型,或将对其在AI领域的竞争力产生深远影响。不过,当前仍处于讨论阶段,未来走向仍有待观察。

报道称,新模型将由SeedFoundation负责人项亮负责,与大语言模型预训练数据负责人沈科共同合作。为此,Seed正在调整组织架构,明确职责分工,并合理配置资源。
据接近Seed团队的消息人士透露,Seed团队认为,与其在现有模型规模上持续追赶其他大模型,不如直接将参数量提升至行业水平的数倍,以争取领先地位。报道中提到,该团队正在训练一个参数量超过5万亿的大模型。
值得一提的是,在字节跳动最近的一次内部会议上,创始人张一鸣罕见地发表讲话,强调在打造模型时要坚持长期主义,注重延迟满足,而非依靠他人的成果来获取短期的榜单排名。
他明确指出,字节跳动曾表示,“应该愿意为长期目标牺牲一部分短期收益”。这一表态反映出企业在面对快速发展与持续创新时,更注重长远发展的战略方向。在当前竞争激烈的互联网环境下,企业若能坚持长期主义,往往能在技术积累、用户体验和市场布局上获得更稳固的优势。这种理念不仅有助于企业在波动中保持稳定,也为行业的可持续发展提供了积极的示范。
据了解,目前,字节跳动内部严格禁止对开源模型进行知识蒸馏操作,甚至通过API检测等手段在内部加强相关管控。张一鸣认为,知识蒸馏可能会阻碍真正具有长远意义的技术创新。
另一边,字节跳动于8月6日召开2026年年中全员大会。
大会期间,公司CEO梁汝波表示,未来在大语言模型领域,字节跳动仍将坚持自主研发,夯实基础,愿意接受短期内的落后,持续优化长期发展。
针对“优化长期”,梁汝波表示,应坚持以用户为核心,以创造增量社会价值为导向,不因短期波动而改变方向。具体到AI业务方面,就是要坚定相信通用人工智能(AGI),坚持自主研发。
在梁汝波看来,最关键的是保持动作不走样,从心态上要接受大语言模型在一段时间内可能处于落后状态,要坚持自主研发和持续优化的长期战略。
昨天有外部媒体报道称,我们之所以坚持自主研发,是因为受到了外部压力,对此梁汝波表示这是无端猜测。他指出,真实原因在于团队希望培养延迟满足的能力,打牢技术基础,这对未来实现通用人工智能(AGI)至关重要。
此次字节高层连续表态并非单纯的技术布局,而是一次全面的战略宣示。一方面统一内部研发方向,另一方面向整个行业传递明确信号:字节不再满足于跟随他人的技术路径进行竞争,而是希望开辟属于自己的发展道路。