MacTalk
订阅
MacTalk 开通于2012年末,内容起于 Mac 而不止 Mac,内容覆盖了技术、创业、产品和人文思考。文风有趣,又有一点力量。
MacTalk微信公众号二维码
关注该公众号

会员可查看最新的全部文章

^__^ 7 / 18
Fable 5 突然开放,但谷歌掉队了。今天看到 Claude 发布消息,从 7 月 20 日起,Claude Fable 5 将包含在所有Max和Team Premium套餐中,限额为50%。之前一直叫嚣不让订阅用户用了,现在为啥改嘴了呢?说是,Fable 5 的需求一直难以预测,这就是为什么分阶段将其推向订阅计划的原因。//原来你们可不是这么说的,还不是用户都去用 GPT 5.6 了…还有个消息,Google Gemini 3.5 Pro 说是 6 月发,到现在了影子都没有。 Gemini 3.1 Pro 是在 2026 年 2 月 20 日正式发布的,之后就没有旗舰模型上线了。Gemini 3.5 Pro 原定 6 月发,现在进度已经落后数月。这个模型被描述为 Google 目前最强的旗舰模型,为啥不发呢?Coding 能力未达预期。 Alphabet CEO 皮察在 5 月 Google I/O 开发者大会上说,同志们,同志们,大家不要慌张,不要慌张,咱们的旗舰 Gemini 3.5 Pro 即将在 6 月发布啦。台下掌声如雷。然而并没有。 Bloomberg 采访了一些 Google 前任和现任员工,他们都很担忧,OpenAI 和 Anthropic 正在发布表现超过 Gemini 的模型,这加剧了内部压力。二爷看到这里表示:慌什么,我还在用 agy cli 做任务呢。其实没什么好担忧的,因为早就被超了啊。这个消息发布后,Alphabet 股价一度下跌近 3%。这也说明了,在当前 AI 竞争中,模型发布时间表、Coding 和 Agent 能力,包括企业级可用性,都会直接影响资本市场对一家公司的判断。 2026 年 AI 基模公司正在持续提高模型性能、降低成本,并扩大企业场景能力。以前咱们说硅谷御三家,就是 OpenAI,Anthropic 和 Google 的基模水平在一个梯队里,他们的推理模型和新系统密集发布,模型竞争激烈,但最近几个月 Google 发布了啥呢?乏善可陈。现在的竞争环境里不仅仅是模型之间的能力差异,技术目标、市场竞争和监管审查都在起作用。之前 Fable 5 和 GPT 5.6 的发布都磕磕绊绊。A 社发了 Fable 5,还从订阅套餐里拿走了,今天又宣布放回来,左右互搏自己打脸,为啥,因为用户都跑到 OpenAI 哪里去了啊。竞争多积累啊,Google 在干嘛?反观国内,上半年还真是欣欣向荣,GLM 5.2、MiniMax M3、Kimi K3、DeepSeek V4 相继发布,开源模型能力直追海外旗舰,阿里的千问和腾讯的混元也颇有起色。苹果用千问做自己的 AI 基座,字节的 Seed 2.1、腾讯刚发的 hy3 口碑都不错……下半年的竞争,应该会更加激烈了,你在用哪几个模型呢?
^__^ 7 / 15
finally,给 Agent 使用的全功能笔记工具来了。保存公众号内容,一句话就搞定。从只读到创作,向前一步。以前写笔记写文章,自然要有舒服的键盘和编辑器,运指如飞,思如泉涌,那是创作。现在我们有大量的内容是在和 Agent 交互的过程里产生的,所以为 Agent 做一个全功能的笔记,也就是顺理成章的事。比如你在 Codex 输入:把这篇公众号文章保存到墨问里,后面跟上公众号链接,图文、来源,原样保存到了墨问笔记里。你和 Agent 进行了多次讨论之后,让 Agent 把讨论结果保存成墨问笔记,一句话的事,按照对应的格式、结论,妥妥存到墨问里。这就是墨问 CLI 为 Agent 新增的写笔记能力。今年 5 月份我们发布了 墨问 CLI 工具,为 Agent 提供了阅读、查询墨问所有公开笔记的功能,还可以查看个人的订阅动态、自己的笔记和用户个人主页等,如果你使用 Agent 工具——比如 Codex、CC、Workbuddy、Trae Work、Claude、龙虾、爱马仕等—— Agent + 墨问 CLI,就等于获得了墨问公开知识库,使用方式如下: 全面开放 API Key,发布墨问官方 CLI 工具 不过,这些都是只读和查询功能,今天墨问 CLI 的版本从 0.3 更新到了 0.4.1,新增了创建笔记、编辑当前笔记、设置笔记状态(公开、私密、禁止转发、定时)、设置标签等写笔记相关功能,同时新增了一份正文语法树 schema,让 Agent 创建笔记变得非常聪明。 >mocli -v mocli version v0.4.1 (PROD-BUILD on 2026-07-15T12:31:53) 更新方式很简单,依然是: npm install -g @mowenxd/cli npx skills add mowenxd/cli -y -g 怎么用呢?你可以让你的 Agent 直接创建笔记,比如:把这篇公众号内容保存到墨问笔记:https://mp.weixin.qq.com/s/gdgsXSqwfqH-H-FmIkl8LA 完事了。更复杂一点的用法,比如你用 墨问 cli 查了一堆结果,可以附加图片和 pdf 文件,一起保存成墨问笔记:结果如下: Codex 高质量笔记与《智能体 AI 的转向》pdf 你也可以把一份 markdown 文本或者文件丢给你的 Agent,直接保存成带富文本格式的墨问笔记,非常方便。比之前的 MCP 快、功能强大,并且聪明。试试吧,在 Agent 里开启你的创作之旅。
^__^ 7 / 13
GLM 唐杰公开信,万亿智谱继续摸高前天智谱创始人唐杰发布了主题为《巨浪已来》的内部信(公开信)。唐杰阐述了他和智谱对 AGI 的理解,以及,为什么上市之后,依然要把资源押注在最不确定的地方。全文很长,我放墨问了: 巨浪已来——致每一位智谱人和关心人工智能未来的伙 巨浪、摸高、AGI,都是信里的关键词,不过这些更多是情绪和概念,唐杰并没有一直停留在云端,他谈了三件事儿,也就是公开信里的三座山峰。长程任务、自治智能体、自我进化。翻译成工程语言,就是让模型从回答问题,走向复杂长任务,还能自我检查,进而参与训练自己的下一代。长程任务要求模型记住上下文,理解目标变化,并把宏大任务拆成数千个步骤;自治 Agent 要求多个模型像一个团队一样分工、审查和调度;自我进化则把问题推向更深处:能不能让 AI 参与数据生成、代码修改和模型训练。最后这个问题我理解是 RSI(Recursive Self-Improvement,递归自进化),海外这块最重要的进展来自 OpenAI、Anthropic,以及一些新公司比如 Recursive、Mirendil、Core Automation,这些公司都在向这个方向探索。公开信里,智谱的判断带有鲜明的实验室气质。它相信商业机会会跟随智能的上限移动,所以短期产品和收入要让位于基础能力。“摸高”计划里有四个方向:让模型完成长任务,让 Agent 进入真实工作,让 AI 参与训练自己,同时把安全治理放在底层。模型越强,越需要解释它为什么这样判断、如何被约束,以及出现错误时谁来负责。关于开源,唐杰也给出了方向,智谱希望一只手向上摸高,挑战模型能力极限;另一只手向下铺路,把前沿能力交给开发者。开源并不天然等于安全,也不等于商业成功,但它能带来更多使用者、反馈和外部监督。显然,国内 GLM 5.2 已经是 Agent 顶配了。我觉得智谱要回答的,是下一代智能由谁来定义、以及如何被使用。是的没错,智谱市值高了,雄心也大了。至于“触达 AGI”能否按计划发生,现在没有人能给出答案。我们能确定的是,大模型公司的下一阶段,除了比拼模型,还得看长期主义、工程纪律和承担不确定性的能力。上市之后选择继续投入,意味着智谱愿意放弃一部分短期确定性,换取一次更大的技术下注。它最终能否摸到那个高度,还要看模型效果、成本控制、人才组织和安全治理能否同时成立。如唐杰所言,巨浪已来,会波及每一个人。最后要看的是,潮水退去之后,谁能建成坚固的堡垒和开放的生态。