每日推荐
早报
搜索
登录
互联网
产品
技术
金融
京东办了场双11版脱口秀大会,「拿钱办事」的李诞很开心
10.22 21:45
荣耀:卖还是不卖?
10.09 22:36
爱奇艺联合长虹推出电视新物种,乐播投屏构建互联网新基建
10.09 18:47
关于开展工业互联网产业联盟实训基地建设有关工作的通知
10.09 18:22
华为又拿一单
10.09 17:15
超2014亿!AMD或收购赛零思
10.09 17:15
特斯拉被骂「割韭菜」,「老用户」真的不值钱?
10.09 17:00
再也不怕理发店、健身房跑路了!
10.09 16:10
爬取UP主弹幕与评论,进行广告投放分析,这里有一课
10.09 13:08
应用安全的十二个最低参照基准
10.09 11:21
重新认识美菜:用最长的时间,做最难的事| 高瓴未来观
10.09 08:58
美政府或寻求限制腾讯及蚂蚁集团支付系统;传华为或考虑出售荣耀品牌;霸王龙骨架拍卖超 3000 万美元|极客早知道
10.09 08:38
5G网络与地铁开通神同步:揭秘“5G新基建”如何高质量布局
10.08 21:03
爱立信拿下印度5G订单
10.08 15:42
特朗普盯上蚂蚁、腾讯支付系统!
10.08 14:20
特斯拉不需要公关,“宇宙网红”摆平一切?
10.08 11:58
APT“商业化”倒逼企业威胁模型变革
10.08 10:45
SD-WAN的世界大战
10.07 21:29
高启全:做好中低端芯片供应链,中国还需10~15年
10.07 20:55
表情包AI生成器:识别人脸情绪,自动配文字
10.07 19:29
加载更多
24小时热文
大模型竞赛,将再往上抬一个量级。就在刚刚,据《金融时报》报道,字节跳动目前正在训练一款超大规模基础模型,最高可能达到 10 万亿参数。项目仍处于预训练早期,完整训练周期预计需要数月,最终采用多大规模,目前还没有完全确定。(信源链接放在评论区)如果最终接近这一数字,它将成为中国目前已知体量最大的模型。但无论消息是否为真,不断膨胀的模型参数已经是大势所趋。作为参照,月之暗面的 Kimi K3 参数规模约 2.8 万亿,Anthropic 新一代模型 Mythos 5 约 8 万亿。字节的目标已进入全球头部实验室的同一量级。《晚点 LatePost》此前也提到,字节内部在推进一个超过 5 万亿参数的新模型计划。不过参数只是能力的一部分。模型表现还取决于数据、架构、后训练与算力效率。但选择冲击数万亿乃至 10 万亿参数,本身说明字节仍在押注基础模型的规模化上限。过去几年,字节在 AI 上持续重投入。《金融时报》称,Seed 团队约 2000 人,覆盖模型、训练与数据等全链路,同时扩建数据中心、加码火山引擎,并探索自研芯片。产品侧同样具备优势:豆包月活达 3.24 亿,已是国内头部 AI 应用;Seedance 也进入全球领先梯队。依托云、办公与内容生态,字节能将模型快速嵌入真实场景迭代。但在基础大模型层面,字节近一段时间的外部声量相对有限。一个重要原因,可能与 Seed 选择的训练路线有关。过去一年多,Seed 更多依靠自主训练建立能力,而非蒸馏其他领先模型。所谓蒸馏,本质上是让自己的模型学习更强模型已经产生的答案和行为,以较低成本快速获得相近能力。但字节内部则更谨慎对待这种追赶策略。据 The Information 报道,字节跳动创始人张一鸣在上个月的一次员工会议上也表示,字节跳动不会把「蒸馏」当作提升 AI 模型能力的捷径。想做到世界领先,最终还是需要在数据、训练方法和模型能力上形成自己的路线。与此同时,中国大模型的竞争也正在发生变化。过去两年,国内模型最核心的目标之一,是以更低成本、更快速度缩小与全球最强模型之间的差距。如今,当差距逐渐缩小时,真正决定下一阶段竞争的,依旧是能否探索出自己的训练路线,并触碰到此前没人抵达的能力边界。而目前最有成效的策略,可能就是力大飞砖的 Scaling。
一周以后,我想我终于可以来聊聊Seedance 2.5了。
北京购房政策调整
寒王,业绩大增!知名牛散加仓
微信又有新功能
特朗普下令调查谁泄露了美弹药短缺信息
刚收获4连板!沃格光电公告:控股股东信披违法将被罚
国泰君安国际,拟私有化退市
因涉两项违规,这家期货公司被责令改正
【财闻联播】*ST实达:被证监会立案!深交所:本周对传智教育、高争民爆进行重点监控
年费限时8折
所有数据均采集于网络,如有侵权请联系站长删除
粤ICP备18050166号-1