叁拾玖2026-09-24 12:51

AI圈这半个月有点疯,随手记几条

9 1

本来这周想接着写点后端的东西,结果这一两周刷到的AI新闻实在太多了,不记下来总觉得亏。挑几条印象深的说说,纯个人视角,想到哪写到哪。

OpenAI 九月三连发

九月还没过完,OpenAI 已经发了三波东西。

月初 GPT-6 Astra 上线,官方说法是"迄今最聪明的模型",计算机操作和编程能力拉满。企业版 9 号跟进,月中又出了个金融专版的 ChatGPT。这些其实都还好,属于常规操作。

真正让我愣住的是 9 月 22 号的 Sol 和 Luna。双模型,一个管复杂编程和 Agent 工作流,一个管高频日常调用。关键在价格:API 定价直接在上一代基础上砍半,Luna 的输入价格一百万 token 只要 0.1 美元,免费用户也能用。有人说这波"打折比梁文锋还狠",虽然夸张,但大模型卷到价格战,对开发者是真金白银的好事。

这波API降价有点狠

同一个 OpenAI,另一边在砍东西:Sora 的 API 9 月 24 号停用,就是今天。Web 版四月份就关了。一边疯狂上新一边下架产品线,大公司的"敏捷"算是被它玩明白了。

DeepSeek 悄悄做了减法

9 月 10 号前后 V4.1 Flash 上线,支持原生多模态。然后 14 号 V4 Pro 直接下线,请求全部路由到新模型。App 界面也改了,原来快速、专家、识图三个模式合并成了一个。

刚看到还有点不习惯,用两天发现确实没必要分了——模型本身够强,模式切换这个交互就成了历史包袱。敢做减法的产品,现在不多了。

华为上了道硬菜

9 月 17 号全联接大会,昇腾 960 超节点。全球第一个用 NPO 光引擎的超节点,单节点 4096 张卡,1PB 的 HBM,官方说能扛十万亿参数模型的训练和推理。

写代码的看到这种参数基本就是看个热闹,但"十万亿"这个数字还是让我沉默了一下。半年前大家还在聊千亿模型怎么部署,现在十万亿都排上日程了。算力国产替代的速度,比想象中快。

零零碎碎几条

斑马智行的 AutoOmni 2.0 值得一看,23B 的端侧模型,官方说任务能力接近十倍参数量的云模型。车机上跑全模态,这个卷法有点狠。

阿里安全的伏渊息壤 XekRung-27B,27B 的小模型在 CyberGym 网络安全榜单上干翻了一堆万亿参数的对手。垂直领域小模型打大模型,这波叫"以小博大"。

还有个不起眼但挺有标志性的:运营商开始对 AI 流量单独计费了。连流量账单都给 AI 开了专门类目,说明 AI 的用量真的到了绕不开的程度。

视频生成那边,可灵 3.0 和 Veo 3.1 都原生 4K 了。讽刺的是叙事能力公认最强的 Sora 2,产品线都快关完了。

最后

粗略一算,这半个月的大新闻顶得上过去小半年。

我的感觉是,模型能力的"军备竞赛"慢慢让位给价格和落地的竞争了。对写代码的人是好事,API 越来越便宜,能塞进工作流的场景越来越多。

与其焦虑"AI 会不会取代我",不如想想今晚哪个重复劳动可以先丢给模型。反正 Luna 一百万 token 才一毛钱,试错成本约等于白嫖。

全文完