MacTalk
订阅
MacTalk 开通于2012年末,内容起于 Mac 而不止 Mac,内容覆盖了技术、创业、产品和人文思考。文风有趣,又有一点力量。
MacTalk微信公众号二维码
关注该公众号

会员可查看最新的全部文章

^__^ 8 / 17
600 亿,Cursor 终于正式加入了 SpaceX,这亏嘛?前一阵子墨问群里还在讨论,说没啥人用 Cursor 了,一下炸出好几个同学,说他们团队都在用 Cursor,事实上 Cursor 在海外用户基础是非常庞大的,只不过风头被 Codex 和 CC 盖过去了而已,一句话,不性感了。但是,600 亿美金,这价格对任何创业团队都是天价,毕竟,国内互联网公司市值超过 600 亿美金的有几家?腾讯、阿里、拼多多、小米、网易、美团,还有谁?我找不出来了。所以有同学说这个团队挺可惜的,我看一点也不可惜啊,可太不可惜了 8 月 14 日,SpaceX 完成了对 Cursor 的收购。这笔价值 600 亿美元的全股票交易,提前宣布好了个月,期间双方进行了模型训练合作,你要我算力,我用你数据,双向奔赴,还有了共同成果。上周发布的 Grok 4.6,就是 SpaceX 和 Cursor 一起交付的。对 Grok 来说,Cursor 最重要的资产显然不是 IDE 工具。Cursor 之前就披露过,Grok 4.5 的训练使用了万亿级 token 的 Cursor 数据,其中包含开发者与代码库、软件工具和智能体的真实交互。到了 Grok 4.6,重点放到了长程 Agent、复杂交互上,Artificial Analysis Intelligence Index (智能综合能力)得分也从 56 提升至 61。说白了,就是 Cursor 给了 Grok 一条更好的反馈回路:模型进入 Cursor 完成真实任务,任务结果产生新的训练环境、评测方法和改进信号,再回到下一轮模型训练。这个只靠算力是搞不定的,为啥马斯克愿意豪掷 600 亿,他可不做亏本买卖。 Cursor 把 Grok 直接推到了开发者每天工作的界面里。只要客户授权与数据隐私的边界处理得当,这个回路会比单纯刷新榜单更有价值。就像大家在 Vibe 群里讨论的那样,谁在用 Cursor?更多是企业团队。对 SpaceX 来说,600 亿美元买到的是企业 AI 的产品入口、付费客户和软件收入。Cursor 的企业业务年化收入约为 26 亿美元,这些收入不会随着收购消失,反而成了 SpaceX 的一部分。Cursor 还能为 SpaceX 的 GPU 集群提供持续需求,成本直接变收入。模型更强了,推理更便宜了,Cursor 的使用量会增加而不是减少,反过来又会提高算力利用率和模型质量。如果 Grok 4.7 在模型能力上——真像马斯克说的——进入 SOTA 梯队,加上 Harness 能力, Cursor 会重新成为开发者的香饽饽。 600 亿美元是很高的门票,如果 SpaceX 能留住 Cursor 的团队,保持产品开放性和开发者信任,Grok 和 Cursor 完美融合,那将是 Codex 的强力竞争对手。
^__^ 8 / 12
年底决战?字节和 OpenAI 到底在训练什么超大模型?前两天从 Financial Times 上看到消息,字节跳动正在训练一个最多可能达到 10 万亿参数的模型;据知情人士透露,字节的项目尚处于早期预训练阶段,这一过程通常需要三到六个月,之后还要经历微调、安全评估和产品化。10 万亿是可能达到的规模,最终数字仍会随训练方案调整。我个人判断 5 - 10 万亿是可能的。作为参照,月之暗面的 Kimi K3 拥有 2.8 万亿总参数,字节新模型在纸面上接近它的三倍,非常吓人。不过 K3 采用混合专家架构,每个 token 激活约 1040 亿参数,因此总参数不能直接换算成模型能力。把规模做到这个级别,考验的不只是 GPU 集群、综合算力等。数据质量、集群通信、训练稳定性和故障恢复,都需要。字节的优势在于拥有豆包、抖音和 TikTok 等大规模产品,可以持续获得真实反馈,也有能力把模型迅速送到海量用户面前。它最终是否开放权重、推理成本能否压下来,目前都没有确定答案。 OpenAI 同样马不停蹄,他们在训练的模型信息比较确定,一个是 Astra 系列,一个是 Doug。 Astra 是已经对外披露能力的下一代模型家族,OpenAI 称其内部版本在数学和理论计算机科学上取得十项新结果,相关论证随后被整理成人类可读的论文,并给出了形式化证书。 OpenAI 在内部评估后“尚不能排除” Astra 达到了 Critical 级网络安全能力,因此得扩大测试并放慢开发。也就是说,虽然 Astra 还没有被正式判定为首个 Critical 模型,但它已经触发了更严格的隔离、监控和安全措施。在中国开源模型的追赶下,海外报道称 OpenAI 需要通过尽快发布 Astra(GPT 6 级别模型)保持优势。时机至关重要——他们越是拖延,中国的开源模型就会被采用得越多 Doug 则更接近字节正在做的事情。外部消息将 Doug 描述成 OpenAI 迄今规模最大的一次预训练项目,而且它与 GPT-6 并不是同一个模型。OpenAI 尚未正式公布其规模和发布时间。过去两年,OpenAI 通过强化学习和后训练不断挖掘现有的模型底座,能力增长很快,但边际收益也在逐渐变小。 Doug 释放的信号,是它准备重新训练一个更强的基础,再叠加已经成熟的推理与 Agent 训练体系。字节这个事情如果确定,那就证明中国团队能够独立完成世界级超大预训练,并把能力稳定交付给产品,毕竟 Kimi K3 已经突破了;OpenAI 要做的是,证明大规模预训练仍能带来足够大的跃迁,并处理随之而来的安全成本。还有 4 个月,年底的大模型又要天翻地覆了。