MacTalk
订阅
MacTalk 开通于2012年末,内容起于 Mac 而不止 Mac,内容覆盖了技术、创业、产品和人文思考。文风有趣,又有一点力量。
MacTalk微信公众号二维码
关注该公众号

会员可查看最新的全部文章

^__^ • 9 / 27
Codex 突发最高级别宕机,然后扔过来一个重置 Codex 又送额度重置了。这次理由多少有点尴尬:服务宕机。对于那些等着它干活的人来说,假期福利来得有点戏剧性。周六早上 7 点,墨问 Vibe 群里已经有小伙伴爆出来,Codex 出现 unexpected status 401 Unauthorized,完全不可用,很快陆续发现是大范围故障。官方状态页标记为“Full outage”,即全面宕机,涉及网页版、API、命令行和 VS Code 扩展。基本是最高级别的故障。从第一条官方通报到恢复,间隔约 56 分钟。对国内用户来说,这是周六早晨的一次工作中断。说起来,谁周六早上蹬 Codex 啊,我也是服了这帮 Vibe 用户。截至目前,官方并未解释具体根因。随后,OpenAI 产品负责人,赛博义父 Tibo 发帖道歉,宣布为 Codex 和 ChatGPT Work 的所有付费用户重置使用额度。结合上次重置的时间点,这次重置算是不疼不痒,本来我的自然重置也是在周六下午五点,只不过提前了几小时,而我正在徒步摄影,可以说毫无关系。额度重置现在都被大模型厂商玩成了基操。这东西之所以这么吸睛,是因为额度已经成了开发者安排工作的一个重要变量。我看社区里不少用户,看到故障乐呵呵,已经开始等补偿了;网上还有专门的重置追踪站,这几乎成了一种赛博文化。还有看热闹不嫌事大的用户开始玩梗,之前 Codex 团队号称超过九成代码由它自己编写,那么 Codex 挂了,谁来修 Codex?推上群众说了:Codex 挂了,让 Claude Code 抢修啊 同一天还有个披露分享给大家,OpenAI 表示研究环境中的智能体曾向第三方服务传输训练和评估数据,已发现 53 起用户图片被上传到图床的情况,这种类似事件 Claude Code 发生过,Grok Build 发生过,ZCode 发生过,现在是 Codex。我想这是需要严肃追问的数据使用问题,比宕机和重置更加值得人们关注。随着 AI 产品覆盖的人群基数越来越大,故障频发。只看 OpenAI,截至 9 月 27 日,官方列出 9 月共发生 36 个事件,涵盖不同产品的错误、延迟乃至客服响应问题。这个数字说明头部 AI 产品的稳定性依然值得关注。为什么会这样呢?感觉还是大模型的不确定性在捣乱。Agent 越来越能干了,人类越容易把自己的各种活丢给 Agent 完成,编程、测试、作图、制作视频和音乐、写文档、查资料,工具越顺手,依赖就越深。用户该何以应对?一方面多备几个 Agent 和模型;另一方面,一让要适时让自己的工作状态持久化,当 A 不灵光的时候,可以无缝切换到另一个 B Agent 上。
^__^ • 9 / 23
新模型 Jev 为什么能在硅谷爆火,因为它解决了一个真需求 9 月 15 日,TypeSafe AI 发布新模型 Jev,发布视频获得了 3600 万次观看(相比之下,OpenAI 的千禧年猜想获得了 7400 万次观看,Anthropic 的 Fable 5 获得了 5700 万次观看,两天之内)。这几天很多开发者在测试这款模型,各大基模厂商也在把 Jev 接入自己的模型。 Jev 是干啥的?咋这么火。先说场景,一封售后邮件进来,系统需要判断:是否紧急,该给哪个部门处理,要不要人工介入,等等。都是小问题,但以前 AI Agent 的处理方式是让大模型读完材料,生成答案,再做判断选择。一天重复十万次,时间和账单儿都是问题。 Jev 专门处理这种判断,简单直接,是/否加一个概率,快如闪电。创始人 Diogo Almeida 曾参与 OpenAI 的指令跟随研究,如今关注的是:怎样直接使用 AI 的判断。 Jev 只接收文本,不写文章,不生成代码,也不解释推理过程。它提供三种回答:Choice 做选择,Score 按标尺评分,Noul 返回命题成立的概率。邮件给技术支持,客户着急吗,要不要退款,都可以变成 Agent 直接使用的结果。关于概率,这里有个重要的区别:模型说“我有九成把握”,这份把握未必经过检验。Jev 做的是让返回的概率与实际结果能对得上:一批被判断为九成可能紧急的邮件确实很紧急。同时,它会直接计算多个独立问题的概率,并省去逐字生成答案的过程。 TypeSafe 把这类模型叫作“System One”,借用了《思考,快与慢》的概念。我觉得这是一个 Agent 分工细化的产物:大模型负责规划与生成内容,决策模型(Jev)处理范围明确的小的判断,普通代码负责计算和执行规则。省钱快速直接。官方公布的端到端延迟为 70—500 毫秒,每百万输入 token 收费 0.042 美元,输出免费,确实又快又好又省钱。开发者想要接入可以去官网注册信息,按 Quick Start 接入即可,步骤如下: 1. 获取 API Key 在 console.typesafe.ai 注册账号获取 API key。 2. Python SDK 安装 pip install "pydantic-ai-slim[typesafe]"设置环境变量: export TYPESAFE_API_KEY='your-api-key' 3. TypeScript SDK 安装 npm install @typesafe-ai/sdk 目前该模型过于火爆以至于无法注册,不过不用着急,很快各路开源和其他基模厂商会快速跟进,估计中秋和十一又不休息了 关于 Jev 的架构详解,可以看我整理的这一篇: Jev 架构揭秘:一个不生成文本的决策模型是怎么工作的 比较长,一万多字,可以先收藏再读。