多彩编程 多彩编程MZPH · CODE BLOG
ARTICLE DETAIL

文章详情

深耕前端与后端开发技术的一线实战笔记与踩坑复盘。

字节跳动预训练 10 万亿参数 AI 模型,最早 2026 年底发布或成全球最大

字节跳动预训练 10 万亿参数 AI 模型,最早 2026 年底发布或成全球最大 【导语据 Financial Times 报道字节跳动正在预训练一个 10 万亿参数的 AI 模型最早可能在 2026 年底或 2027 年初发布若顺利推出将成为全球参数规模最大的公开模型但超大规模模型也面临诸多待解问题。】10 万亿参数跃居全球领先字节跳动正在训练一个 10 万亿参数的 AI 模型且处于预训练阶段。对比来看Anthropic 目前最大的模型 Mythos 5 约 8 万亿参数DeepSeek V4 - Pro 是 1.6 万亿月之暗面的 Kimi K3 是 2.8 万亿美团 LongCat - 2.0 是 1.6 万亿。字节跳动的这个未命名模型直接将参数规模提升到 10 万亿若顺利发布将成为全球参数规模最大的公开模型。训练时间线与微妙节点预训练通常需要 3 到 6 个月之后还有微调阶段按此时间线该模型最早可能在 2026 年底或 2027 年初发布。这个节点颇为微妙Anthropic 刚在 5 月发布了 8 万亿参数的 Mythos 5 并冠绝行业字节跳动此时若成功推出 10 万亿参数模型将在参数规模上实现超越。参数数量并非全部虽然参数数量是衡量模型规模的一个重要指标但并非故事的全部。例如 DeepSeek V4 - Pro 的参数只有 Mythos 5 的五分之一但在多项基准测试中表现相当。而且 MoE混合专家架构让「参数数量」这个指标变得越来越模糊实际推理时可能只激活了万亿参数中的一小部分。超大规模模型的挑战字节跳动在 AI 领域投入速度极快从 2023 年底开始追赶到 2024 年推出豆包系列再到如今挑战全球最大参数规模。然而超大规模模型面临着训练成本、推理成本和商业化路径等悬而未决的问题。一个 10 万亿参数的模型推理一次的成本是多少、谁能用得起都是疑问。字节自己的产品矩阵抖音、头条、飞书或许能消化一部分但要想在 API 市场上和 Anthropic、DeepSeek 竞争定价和效率才是关键。编辑观点字节跳动挑战 10 万亿参数 AI 模型展现了其强大实力与决心但超大规模模型的成本与商业化难题待解未来能否在市场竞争中脱颖而出值得关注。
返回列表