唐韧
订阅
前非著名程序员,现不知名产品人。畅销书《产品经理必懂的技术那点事儿》作者。在这里聊聊产品、说说职场、谈谈个人成长!
唐韧微信公众号二维码
关注该公众号

会员可查看最新的全部文章

^__^ 9 / 07
很多用上 GPT-6 Astra 的读者都遇到一个问题,就是 token 烧得太快,额度完全不够用。这里推荐你们几个方法,可以降低额度消耗,让你们的账单不那么炸。第一种,学会分任务选模型。如果你一上来就把 GPT-6 的推理等级开到 Ultra,相信我,对于 99% 的人来说属于杀鸡用大牛刀。一句话,完全没必要。我现在处理日常工作流的任务,基本上 GPT-6 版本的推理等级开到「中」就够用了,大多数甚至「低」就可以完成。如果是涉及复杂任务的,最多也是开到「高」。至于「极高」和 Ultra,纯属用不上。我对比测试过,GPT-5.6 Sol 开到「高」的模式和 GPT-6 Astra 开到「低」其实差不多。因此,你可以把自己的任务做个分类,分别用不同模型和推理登记试一下,不要全部默认用最强模式。如果自己对任务都没有实际感觉,只会一股脑全丢给 AI 去干,那这不是 AI 的问题。第二种,重写你的 Skill。如果你的 AI 工作流里已经有多个 Skill 在运转的,尤其是那种多个 Skill 来回嵌套使用的,建议你们重写一下 Skill 规则。这里有两方面的事要做,一个是用 GPT-6 这种比较强的模型去重写你之前的 Skill,它会变得更简洁、更聪明。还有就是告诉你的 Agent 采用「渐进式披露」的原则去读取和调用 Skill,不要每次都读全篇,那样就比较费 token。我一般是用比较强的模型去写 Skill,然后修改迭代都是,但是调用 Skill 其实用一般模型或者根据任务类型把推理等级调低就可以。另外,你还可以给 Agent 做一些约束,比如什么情况下应该遍历,什么情况下省去分析直接给结果,这得根据你的工作流任务来设计。总之,不要直接丢给 AI 你就不管了。某种程度上说,你还是那个把门的监护人。第三种,让 Agent 去复刻你的方法,不要让它肆意发挥。现在使用 Agent 有两种模式,一种是你直接口喷需求让它干,它怎么干、用什么方法、干得怎么样,纯靠运气。就好比你让他做个产品数据分析,用的是它随机找来的方法,其实这就相对来说不靠谱,而且可能比较耗 token。如果你把自己分析产品数据的方法、流程、结构通过 Skill 训练的方式让你的 Agent 掌握,它就会在你的框架约束下去工作,而且每次稳定发挥。这个过程有点像构建你自己的 Harness,让你的 Agent 在有监督的情况下去完成工作。最后,我觉得 GPT-6 实力还是挺强的,今天它帮了我个大忙被吓到了!GPT-6 竟然帮我找到了 2 个致命 bug
^__^ 9 / 06
我喜提了三张 Codex 额度重置卡,而且 GPT-6 确实带来了一些惊喜,不过我劝你用起来要小心。首先,体感最强的是速度变快了。同样一个工作流任务,之前我用 GPT-5.6 Sol 要跑半小时,GPT-6 大概就用了不到 5 分钟。原因跟硬件没关系,而是它的思维链变了,绕路少,无效思考少。但说实话,我认为现在的快有可能是初期算力倾斜,一两周后会不会回落,还得看。还有就是额度消耗,我开 GPT-6 Astra 中等强度,做一个视频封面图的额度消耗会比 Sol 的高强度模式要多。强是强,但烧起 token 来还是要小心,不要一开始就拉到顶。第二个值得说的是审美能力,这个进步可以说是非常明显了。我看了一些别人的实测案例,一句话就能生成高细节 3D 网页,月面探测车、可进房间浏览的家居模型,细节和物理表现直接碾压上一代。我也试了下用 5.6 来重构之前的一些产品原型设计稿,效果是好了很多。如果你做产品、做设计、做前端,这个提升你会很有感觉。第三个是代码能力。这个我到没有明显的感知,可能是我的项目复杂度不高,就一个小程序和一个网站,其实这种级别的模型都能胜任了。但通过一些榜单测评可以看出,5.6 在处理深度复杂编程任务和 bug 处理能力上还是提升了一档。再说几个使用建议。额度方面,GPT-6 是 100% 可用,不像 Fable 5 只占总额度一半,这个很实在。 OpenAI 还给 Plus、Pro、Business 用户追加了可留存的完整重置机会。写作方面,我的体感会比 5.6 Sol 好不少,机械感减轻了,但中文的那种语感和活人感还是不如 Claude Opus 4.6。还有一点。 GPT-6 比之前聪明了不少,如果你之前给它写了很详细的规则文件,现在建议精简一下,给模型更多自由发挥空间,因为老规则会限制聪明模型。在我看来,GPT-6 是一次很扎实的升级,代码和前端能力进步最大,日常使用体验明显变好,速度也更快。但离科幻片里那个贾维斯,还是差一点点意思,但我也期待后续 6 系列的迭代。如果你是 Plus 或 Pro 的 Codex 用户,更新一下直接用起来就行,体感提升是实打实的。至于 AGI 有没有真的来,可以让子弹再飞一会儿。
^__^ 9 / 04
昨晚发生了两件大事,一个是全球 AI 出现了集体宕机,另外就是 GPT-6 发布,人类进入 AGI 时代。晚上 11 点左右,包括 ChatGPT 和 Claude 在内的部分地区 AI 服务器崩溃,用户反馈无法使用。于是有人说,第一次体验到了 AI 掉线后自己的无助。这也说明,很多人的工作和生活已经离不开 AI 了。说实话,如果我现在用的 AI 突然宕机,确实会让我手忙脚乱且效率极大降低,这是一个不可逆的过程。然后是昨晚的重头戏,GPT-6 Astra 正式发布。 OpenAI 总裁对此的总结是:欢迎来到 AGI 时代!估计相关的介绍和报道你们都看过了,我挑几个重点跟你们说一下。 1、GPT-6 Astra 电脑操作能力更强现在的 Agent 使用电脑的场景越来越多,GPT-6 对于电脑操作做了特别升级和优化。简单说,就是让 Agent 操作电脑更顺了、更快了、更准了。之前我用 Codex 或者其他 Agent 完成电脑操作时有一个明显的感受,就是等的时间有点长。根据这次的介绍,GPT-6 在速度和质量上都有明显提升。 2、审美能力大大提升之前我吐槽 GPT 系列模型在审美上不如 Claude,比如产品前端页面设计或者 PPT 只做。这次我看了下 GPT-6 的 demo 效果,跟前代比有了比较大的提升,像是从设计助理升级到了设计总监。审美对于一个 AI 来说挺重要的,尤其是对应越来越多的可视化场结果交付场景。以后,Codex 估计也会越来越好用了。 3、安全机制更强现在的 Agent 权限越来越大,触碰的都是用户本地最核心的数据,所以安全机制被认为是红线。 OpenAI 说 GPT-6 Astra 是目前最符合人类意图的模型,他们用了一个词叫 Aligned。在一项测试模型是否会突破任务边界的评估中,GPT-5.6 Sol 在没有生产防护措施时越过授权范围的比例为 48%,而 Astra 是 0%。这说明,Astra 是比前代模型安全机制更强的。最后说下价格。 GPT-6 Astra 的 API 价格是 10美元/百万输入token,50美元/百万输出token。这个定价,和 Claude Fable 5 是持平的。虽然价格一样,但各方面能力还是强了一截,而且是第一个敢说 AGI 模型的产品。足以可见,OpenAI 对 GPT-6 Astra 的信心。目前 GPT-6 Astra 还只对部分机构开放,普通订阅用户再等几天。也难怪,跳过了 GPT-5 系列直接来到了 6,而 Astra 的意思就是星辰。从此,人类进入了 AGI 的星辰大海。