MacTalk
订阅
MacTalk 开通于2012年末,内容起于 Mac 而不止 Mac,内容覆盖了技术、创业、产品和人文思考。文风有趣,又有一点力量。
MacTalk微信公众号二维码
关注该公众号

会员可查看最新的全部文章

^__^ 7 / 21
Kimi K3 不让买了,Qwen 3.8 预览版来了 Kimi K3 最近是个引爆点,2.8万亿参数,开放权重,主打 Coding 和 Agent。发布后 48 小时,就限购了。因为请求量大幅超过预测,接近 GPU 集群上限。公司随后暂停了 C 端新订阅,算力优先给已经付费的用户,未来会员可能拆分出 Coding 套餐。报道称 Kimi 正在调整离岸结构,为香港 IPO 做准备,也在讨论最高 20 亿美元的新融资。就在昨天,阿里预览 Qwen3.8 Max 也发了,总参数 2.4 万亿,已接入阿里的 Coding 平台。官方的表达是:整体能力仅次于 Claude Fable 5,并计划开放权重。这个测试主要来自阿里内部评测,未来肯定要上那几个著名的基准平台,另外也得经受真实场景的考验。国内外的模型发布此起彼伏,能力都越来越强。竞争的味道也有点变了。过去一年,开放模型还会被视为低成本生态。现在 Kimi K3 暂停订阅,GLM 5.2 只能买到海外版,都说明了,开放权重不会自动把前沿模型变成轻资产业务。模型可以开放,用户用你的服务还不是得烧 Token 嘛。复杂长任务越多,对算力的要求也越大。尤其是 Coding Agent,读仓库、创建文件、修改文件、测试、回滚……几轮下来,算力的压力就滚滚而至。 K3 这次的基准评测成绩优秀,能力相当强,用的人自然也不少。我听到用户对 K3 的抱怨都不是模型强能力,一个是费 Token,一个是慢。贵的话,其实比 GPT 5.6 还是便宜不少,如果能力和其相当,贵自然有贵的道理;慢,估计和算力有关,或者和推理能力有关。结果就是“订阅暂停”,盲猜算力容量曲线压到天花板了。智谱已经上市了,我看 Kimi 也不会太远,这样的公司不融资和上市,几乎无法在未来扛起用户消耗的算力。真正进入规模化使用,就必须回答成本和 ROI 的问题。模型能力是门票,算力和商业化决定了能走多远。国内字节阿里腾讯的境况和谷歌类似,模型在追赶,整体实力雄厚,比如这次阿里的 Qwen3.8 Max 声量就很足。他们有云、模型、Coding 平台、企业客户和业务通道,都在体系内。这个厚度在,一旦模型突破,就会优势尽显。未来能训练模型的公司不少,能持续供算力、应用产品和承接企业付费的公司会估计不会多,我判断,现在的这些 AI 公司,肯定有掉队的。抢购智谱 5.2,K3 被用户挤爆,Qwen 3.8 追赶 Fable 5,对咱们来说,都是大好事,它证明中国开放模型已经能在 Coding 和 Agent 场景里站到最前沿了,我们只需要想好自己做什么就行了,并开始实践。欢迎加入年度专栏:墨问 Vibe 计划
^__^ 7 / 18
Fable 5 突然开放,但谷歌掉队了。今天看到 Claude 发布消息,从 7 月 20 日起,Claude Fable 5 将包含在所有Max和Team Premium套餐中,限额为50%。之前一直叫嚣不让订阅用户用了,现在为啥改嘴了呢?说是,Fable 5 的需求一直难以预测,这就是为什么分阶段将其推向订阅计划的原因。//原来你们可不是这么说的,还不是用户都去用 GPT 5.6 了…还有个消息,Google Gemini 3.5 Pro 说是 6 月发,到现在了影子都没有。 Gemini 3.1 Pro 是在 2026 年 2 月 20 日正式发布的,之后就没有旗舰模型上线了。Gemini 3.5 Pro 原定 6 月发,现在进度已经落后数月。这个模型被描述为 Google 目前最强的旗舰模型,为啥不发呢?Coding 能力未达预期。 Alphabet CEO 皮察在 5 月 Google I/O 开发者大会上说,同志们,同志们,大家不要慌张,不要慌张,咱们的旗舰 Gemini 3.5 Pro 即将在 6 月发布啦。台下掌声如雷。然而并没有。 Bloomberg 采访了一些 Google 前任和现任员工,他们都很担忧,OpenAI 和 Anthropic 正在发布表现超过 Gemini 的模型,这加剧了内部压力。二爷看到这里表示:慌什么,我还在用 agy cli 做任务呢。其实没什么好担忧的,因为早就被超了啊。这个消息发布后,Alphabet 股价一度下跌近 3%。这也说明了,在当前 AI 竞争中,模型发布时间表、Coding 和 Agent 能力,包括企业级可用性,都会直接影响资本市场对一家公司的判断。 2026 年 AI 基模公司正在持续提高模型性能、降低成本,并扩大企业场景能力。以前咱们说硅谷御三家,就是 OpenAI,Anthropic 和 Google 的基模水平在一个梯队里,他们的推理模型和新系统密集发布,模型竞争激烈,但最近几个月 Google 发布了啥呢?乏善可陈。现在的竞争环境里不仅仅是模型之间的能力差异,技术目标、市场竞争和监管审查都在起作用。之前 Fable 5 和 GPT 5.6 的发布都磕磕绊绊。A 社发了 Fable 5,还从订阅套餐里拿走了,今天又宣布放回来,左右互搏自己打脸,为啥,因为用户都跑到 OpenAI 哪里去了啊。竞争多积累啊,Google 在干嘛?反观国内,上半年还真是欣欣向荣,GLM 5.2、MiniMax M3、Kimi K3、DeepSeek V4 相继发布,开源模型能力直追海外旗舰,阿里的千问和腾讯的混元也颇有起色。苹果用千问做自己的 AI 基座,字节的 Seed 2.1、腾讯刚发的 hy3 口碑都不错……下半年的竞争,应该会更加激烈了,你在用哪几个模型呢?
^__^ 7 / 15
finally,给 Agent 使用的全功能笔记工具来了。保存公众号内容,一句话就搞定。从只读到创作,向前一步。以前写笔记写文章,自然要有舒服的键盘和编辑器,运指如飞,思如泉涌,那是创作。现在我们有大量的内容是在和 Agent 交互的过程里产生的,所以为 Agent 做一个全功能的笔记,也就是顺理成章的事。比如你在 Codex 输入:把这篇公众号文章保存到墨问里,后面跟上公众号链接,图文、来源,原样保存到了墨问笔记里。你和 Agent 进行了多次讨论之后,让 Agent 把讨论结果保存成墨问笔记,一句话的事,按照对应的格式、结论,妥妥存到墨问里。这就是墨问 CLI 为 Agent 新增的写笔记能力。今年 5 月份我们发布了 墨问 CLI 工具,为 Agent 提供了阅读、查询墨问所有公开笔记的功能,还可以查看个人的订阅动态、自己的笔记和用户个人主页等,如果你使用 Agent 工具——比如 Codex、CC、Workbuddy、Trae Work、Claude、龙虾、爱马仕等—— Agent + 墨问 CLI,就等于获得了墨问公开知识库,使用方式如下: 全面开放 API Key,发布墨问官方 CLI 工具 不过,这些都是只读和查询功能,今天墨问 CLI 的版本从 0.3 更新到了 0.4.1,新增了创建笔记、编辑当前笔记、设置笔记状态(公开、私密、禁止转发、定时)、设置标签等写笔记相关功能,同时新增了一份正文语法树 schema,让 Agent 创建笔记变得非常聪明。 >mocli -v mocli version v0.4.1 (PROD-BUILD on 2026-07-15T12:31:53) 更新方式很简单,依然是: npm install -g @mowenxd/cli npx skills add mowenxd/cli -y -g 怎么用呢?你可以让你的 Agent 直接创建笔记,比如:把这篇公众号内容保存到墨问笔记:https://mp.weixin.qq.com/s/gdgsXSqwfqH-H-FmIkl8LA 完事了。更复杂一点的用法,比如你用 墨问 cli 查了一堆结果,可以附加图片和 pdf 文件,一起保存成墨问笔记:结果如下: Codex 高质量笔记与《智能体 AI 的转向》pdf 你也可以把一份 markdown 文本或者文件丢给你的 Agent,直接保存成带富文本格式的墨问笔记,非常方便。比之前的 MCP 快、功能强大,并且聪明。试试吧,在 Agent 里开启你的创作之旅。